Gemini Omni: Η απάντηση της Google στο «νεκρό» Sora της OpenAI φέρνει επανάσταση στη δημιουργία AI βίντεο

Gemini Omni: Η απάντηση της Google στο «νεκρό» Sora της OpenAI φέρνει επανάσταση στη δημιουργία AI βίντεο

Το Sora της OpenAI δεν υπάρχει πια, αλλά η Google καλύπτει το κενό με τη δική της λειτουργία δημιουργίας βίντεο με τεχνητή νοημοσύνη, που ονομάζεται Gemini Omni. Στο Google I/O, η εταιρεία παρουσίασε για πρώτη φορά το Gemini Omni, ένα εργαλείο για τη δημιουργία βίντεο κλιπ που παράγονται από τεχνητή νοημοσύνη από τις υπάρχουσες φωτογραφίες, τις selfies ή τα βίντεό σας. Σε μια επίδειξη, ο επικεφαλής τεχνητής νοημοσύνης της Google, Demis Hassabis, έδειξε πώς μπορείτε να χρησιμοποιήσετε το νέο μοντέλο τεχνητής νοημοσύνης για να αλλάξετε δραστικά το περιβάλλον σας ενώ τραβάτε ένα βίντεο με τον εαυτό σας. Αυτό μπορεί να περιλαμβάνει το να τοποθετήσετε τον εαυτό σας στον Άρη, σε ένα καταπράσινο δάσος ή να προσθέσετε μια μπάλα ντίσκο στο φόντο. (Credit: PCMag/Michael Kan) Η Google σχεδιάζει να διαθέσει το μοντέλο Omni Flash σήμερα μέσω της εφαρμογής Gemini, του Google Flow και του YouTube Shorts. Αυτό έρχεται μετά την επίσημη διακοπή τόσο της εφαρμογής Sora όσο και της διαδικτυακής εμπειρίας από την OpenAI τον περασμένο μήνα, προκειμένου να χρησιμοποιηθεί η υπολογιστική ισχύς τεχνητής νοημοσύνης της εταιρείας για άλλα έργα. H Google παρουσιάζει το Omni ως ένα εργαλείο για να επανασχεδιάσετε τις προσωπικές σας φωτογραφίες ή βίντεο προσθέτοντας φανταστικά στοιχεία τεχνητής νοημοσύνης, κάτι που μπορεί να βοηθήσει στην αποφυγή πιθανών νομικών διαμαχών. Ωστόσο, θα μπορούσαμε επίσης να δούμε αυτή τη δυνατότητα να δημιουργεί deepfakes που θα μπορούσαν να ξεγελάσουν το κοινό. Προς το παρόν, το Omni θα επικεντρωθεί στη δημιουργία βίντεο. Ωστόσο, η εταιρεία θα το επεκτείνει τελικά ώστε να περιλαμβάνει εικόνες και κείμενο.