Σύνοψη
Η παραγωγή οπτικοακουστικού υλικού στο εταιρικό περιβάλλον αλλάζει μορφή. Η Google ανακοίνωσε την πλήρη ενσωμάτωση του πολυτροπικού μοντέλου Gemini Omni στο Google Vids, την εφαρμογή δημιουργίας βίντεο του Google Workspace. Η συγκεκριμένη αναβάθμιση δεν προσθέτει απλώς φίλτρα ή βασικά εργαλεία κοπής, αλλά εισάγει ριζικές αλλαγές στον τρόπο με τον οποίο οι επαγγελματίες δημιουργούν, επεξεργάζονται και παρουσιάζουν πληροφορίες, με αιχμή του δόρατος τη δυνατότητα δημιουργίας Personal AI Avatars.
Η εξέλιξη αυτή αυτοματοποιεί τις πλέον χρονοβόρες διαδικασίες της βιντεοσκόπησης, όπως το στήσιμο του εξοπλισμού, την ηχογράφηση πολλαπλών λήψεων και το παραδοσιακό μοντάζ, μεταφέροντας το βάρος της παραγωγής στους cloud servers της Google.
Το Google Vids, μέσω του μοντέλου Gemini Omni, επιτρέπει πλέον στους χρήστες του Workspace να δημιουργούν τα δικά τους Personal Avatars. Αυτά τα ψηφιακά αντίγραφα μπορούν να εκφωνούν κείμενα (scripts) και να πρωταγωνιστούν σε εταιρικά βίντεο, εξαλείφοντας την ανάγκη για συνεχή φυσική βιντεοσκόπηση, εξοικονομώντας δραστικά χρόνο και πόρους για τις επιχειρήσεις.
Η διαδικασία δημιουργίας του ψηφιακού avatar απαιτεί από τον χρήστη την παροχή ενός σύντομου δείγματος βίντεο και ήχου. Το Gemini Omni αναλύει τα χαρακτηριστικά του προσώπου, τη χροιά της φωνής, την προσωδία και τις μικροεκφράσεις, δημιουργώντας ένα ψηφιακό μοντέλο ικανό να «διαβάσει» οποιοδήποτε κείμενο του δοθεί στη συνέχεια.
Πέρα από τα ψηφιακά αντίγραφα των χρηστών, το update φέρνει στο Google Vids σημαντικές αναβαθμίσεις στη συνολική διαχείριση της εικόνας. Το Gemini Omni είναι πολυτροπικό (multimodal) by design, γεγονός που του επιτρέπει να «κατανοεί» την εικόνα, τον ήχο και το κείμενο ταυτόχρονα.
Οι χρήστες μπορούν να εισάγουν ακατέργαστα πλάνα (raw footage) και να ζητήσουν από το AI να πραγματοποιήσει το μοντάζ μέσω γραπτών εντολών. Για παράδειγμα, μια εντολή της μορφής “Αφαίρεσε τα κενά σιωπής, κράτησε τα τρία βασικά επιχειρήματα και πρόσθεσε b-roll υλικό με θέμα την τεχνολογία στα σημεία αλλαγής” εκτελείται άμεσα. Το Vids, χρησιμοποιώντας τη βάση δεδομένων του Workspace και τη γενετική ικανότητα του Gemini, παράγει υψηλής ανάλυσης AI video clips για να γεμίσει τα κενά της παρουσίασης, προσφέροντας ένα άρτιο τελικό αποτέλεσμα.
Η ανάλυση και το framerate των παραγόμενων AI clips έχουν δεχθεί σημαντική βελτίωση σε σχέση με τις προηγούμενες εκδόσεις, εξαλείφοντας σε μεγάλο βαθμό τα τεχνουργήματα και τις παραμορφώσεις που χαρακτήριζαν τις πρώτες γενιές AI βίντεο.
Η εισαγωγή τεχνολογίας κλωνοποίησης φωνής και εικόνας στο εταιρικό περιβάλλον εγείρει προφανή ζητήματα ασφαλείας. Η Google ενσωματώνει αυστηρά πρωτόκολλα επαλήθευσης. Η δημιουργία ενός Personal Avatar απαιτεί ρητή, on-camera συγκατάθεση του ίδιου του χρήστη μέσω μιας συγκεκριμένης διαδικασίας ελέγχου, αποτρέποντας τη δημιουργία ψηφιακών αντιγράφων τρίτων προσώπων χωρίς την άδειά τους. Επιπλέον, τα παραγόμενα βίντεο φέρουν κρυπτογραφική υδατογράφηση μέσω της τεχνολογίας SynthID της Google DeepMind, επιτρέποντας σε οποιοδήποτε σύστημα να αναγνωρίσει ότι το περιεχόμενο έχει παραχθεί τεχνητά.
Η διαχείριση ογκωδών ψηφιακών δεδομένων έχει μετατραπεί σε μία από τις σημαντικότερες προκλήσεις που αντιμετωπίζουν…
Σύνοψη Η Alibaba ανακοίνωσε επίσημα το Qwen 3.8-Max, ένα κορυφαίο πολυτροπικό μοντέλο τεχνητής νοημοσύνης με…
Σύνοψη Η Ρωσία προχώρησε στην αποκάλυψη του Volna Kupol Garant, ενός νέου συστήματος ηλεκτρονικού πολέμου…
Όταν αποσυσκευάζει κανείς ένα μηχανικό πληκτρολόγιο στην κατηγορία κάτω των εκατό ευρώ, οι προσδοκίες είναι…
Σύνοψη Η Xiaomi Auto παρουσίασε επίσημα στην αγορά της Κίνας το επταθέσιο SUV SkyNomad N90…
Η αξιοπιστία της Τεχνητής Νοημοσύνης ξεκινά από τα δεδομένα και τους ανθρώπους πίσω από αυτή.…
Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.
Leave a Comment