Categories: Technology

Πρόγραμμα τεχνητής νοημοσύνης που «διαβάζει» τα χείλη πολύ καλύτερα από ανθρώπους


Οι κωφοί, αλλά και οι απανταχού κατάσκοποι, θα βρουν χρήσιμο ένα νέο πρόγραμμα τεχνητής νοημοσύνης που «διαβάζει» τα χείλη των ανθρώπων εξ αποστάσεως με μεγαλύτερη ακρίβεια όχι μόνο από κάθε άλλο μέχρι σήμερα, αλλά και από τους ανθρώπους με τη σχετική εξειδίκευση.

Το πρόγραμμα ανέπτυξαν ερευνητές της Google και της βρετανικής θυγατρικής της Deep Mind, η οποία πρωτοπορεί διεθνώς στην τεχνητή νοημοσύνη, με επικεφαλής ένα νεαρό ελληνικής καταγωγής ειδικό της πληροφορικής, τον Γιάννη Ασσαέλ.

Για τα εκατομμύρια των ανθρώπων που δεν μπορούν να ακούσουν, η ανάγνωση των χειλιών των άλλων αποτελεί ένα «παράθυρο» για την επικοινωνία, πέρα από τη νοηματική γλώσσα. Όμως το «διάβασμα» των χειλιών δεν είναι εύκολο και συχνά είναι ανακριβές, όπως αναφέρει το Αθηναϊκό Πρακτορείο Ειδήσεων.

Το νέο «έξυπνο» σύστημα εμφανίζει μέσο ποσοστό λαθών 41% στην ορθή κατανόηση των λέξεων που σχηματίζουν τα χείλη. Μπορεί να φαίνεται υψηλό αυτό το ποσοστό, αλλά η καλύτερη μέχρι σήμερα υπολογιστική μέθοδος είχε ποσοστό αποτυχίας 77%, συνεπώς το νέο πρόγραμμα έχει περιορίσει σχεδόν στο μισό τα λάθη.

Οι ερευνητές, με επικεφαλής τον Ασσαέλ και τον Μπρένταν Σίλινγκφορντ, οι οποίοι έκαναν τη σχετική προδημοσίευση στο arXiv, σύμφωνα με το «Science», δημιούργησαν αλγόριθμους καλύτερους από κάθε άλλους στο παρελθόν, που τα καταφέρνουν αποτελεσματικότερα και από επαγγελματίες αναγνώστες χειλιών. Αν το νέο σύστημα τελειοποιηθεί και ενσωματωθεί σε ηλεκτρονικές συσκευές, όπως τα «έξυπνα» κινητά τηλέφωνα, μπορεί μελλοντικά να προσφέρει τη δυνατότητα ανάγνωσης των χειλιών στον καθένα (κάτι που μάλλον δεν θα αρέσει σε όλους…).

Έως τώρα η δημιουργία αλγορίθμων που να μπορούν να διαβάσουν χείλη ήταν τρομερά δύσκολη. Οι ερευνητές τροφοδότησαν το σύστημά τους με 140.000 ώρες βίντεο από το You Tube που έδειχναν ανθρώπους να μιλάνε στα αγγλικά, μαζί με τα αντίστοιχα απομαγνητοφωνημένα κείμενα. Στη συνέχεια, άφησαν το σύστημα μηχανικής μάθησης μόνο του να μάθει να «παντρεύει» τις διαφορετικές κινήσεις των χειλιών με τα αντίστοιχα φωνήματα και τελικά με τις αντίστοιχες λέξεις.

Το σύστημα βασίζεται στα τεχνητά νευρωνικά δίκτυα, δηλαδή σε μια ομάδα αλγόριθμων που ο καθένας εκτελεί ένα διαφορετικό και απλούστερο έργο, ενώ ταυτόχρονα όλοι μαζί συνδέονται και συνεργάζονται για να επεξεργασθούν τις πληροφορίες, περίπου όπως κάνουν οι νευρώνες του ανθρώπινου εγκεφάλου.

Αφού το σύστημα «αυτο-εκπαιδεύθηκε», δοκιμάσθηκε από τους ερευνητές στην ανάγνωση των χειλιών των ανθρώπων ενός 37λεπτου βίντεο, που ποτέ πριν το σύστημα δεν είχε «δει». Το πρόγραμμα έσφαλε στο 41% των λέξεων, αλλά οι άνθρωποι -ακόμη και οι ειδικοί στο διάβασμα του στόματος- που είδαν το ίδιο βίντεο, είχαν μέσο ποσοστό αποτυχίας 93% (πάντως σε πραγματικές συνθήκες και όχι παρακολούθησης βίντεο, το ποσοστό ανθρώπινης αποτυχίας είναι κάπως μικρότερο, καθώς ο ανθρώπινος εγκέφαλος μπορεί να αξιοποιήσει και άλλα στοιχεία, όπως η γλώσσα του σώματος αυτού που μιλάει).

Είναι σαφές ωστόσο ότι ένα ποσοστό αποτυχίας της τάξης του 40% στην αναγνώριση των λέξεων σημαίνει ότι το σύστημα χρειάζεται ακόμη ουσιαστική βελτίωση, αν και σε κάθε περίπτωση η εξέλιξη αυτή συνιστά πραγματική πρόοδο. Όταν η βελτίωση υπάρξει, το σύστημα μπορεί να αξιοποιηθεί ευρύτερα και στην καθημερινότητα. Για παράδειγμα, όταν θα βλέπουμε στην τηλεόραση έναν ποδοσφαιριστή να βρίζει ένα διαιτητή ή έναν αντίπαλο παίκτη, αλλά φυσικά δεν ακούμε τι λέει, θα ξέρουμε πια τι είπε!

Ο Γιάννης Ασσαέλ υπήρξε μαθητής του Κολλεγίου Ανατόλια της Θεσσαλονίκης και σπούδασε εφαρμοσμένη πληροφορική στο Πανεπιστήμιο Μακεδονίας (2008-2013). Στη συνέχεια, έκανε μεταπτυχιακά (μάστερ) στην επιστήμη των υπολογιστών στο Πανεπιστήμιο της Οξφόρδης, όπου σήμερα ολοκληρώνει το διδακτορικό του πάνω στη μηχανική μάθηση, ενώ παράλληλα εργάζεται για τη Deep Mind της Google.

Δείτε εδώ την επιστημονική προδημοσίευση

fbq('init', '1706173679639449'); fbq('track', "PageView");

var options = { type: "scroll", scripts: [ "//connect.facebook.net/en_US/sdk.js#xfbml=1&appId=219378041527087" ], success: function () {

FB.init({ appId: '219378041527087', cookie: true, xfbml: true, version: 'v3.0' }); } }; if ($(window).scrollTop() > 0) { window.fbAsyncInit = function () { FB.init({ appId: '219378041527087', cookie: true, xfbml: true, version: 'v3.0' }); //jQuery('#fb-root').trigger('facebook:init'); document.body.className += " fbinit"; };

(function (d, s, id) { var js, fjs = d.getElementsByTagName(s)[0]; if (d.getElementById(id)) { return; } js = d.createElement(s); js.id = id; js.src = "http://connect.facebook.net/en_US/sdk.js"; fjs.parentNode.insertBefore(js, fjs); }(document, 'script', 'facebook-jssdk')); } else { $.lazyscript(options); } });

$.getScript("http://connect.facebook.net/en_US/sdk.js", function(){ FB.init({ appId: '219378041527087', cookie: true, xfbml: true, version: 'v3.0' }); facebookAPILoaded = true; }); }



Πηγή

iTech News

Leave a Comment
Share
Published by
iTech News

Recent Posts

Αυτό είναι το ακόμα πιο ικανό και γρήγορο AI μοντέλο του OpenAI

Ο OpenAI πραγματοποίησε την εκδήλωση Spring Update, η οποία μεταδόθηκε ζωντανά πριν από λίγη ώρα…

11 ώρες ago

Έφτασε το iOS 17.5 και σου επιτρέπει να κατεβάζεις εφαρμογές από ιστοσελίδες

Η Apple κυκλοφόρησε πριν από λίγη ώρα τα iOS 17.5 και iPadOS 17.5, δύο σημαντικές…

12 ώρες ago

Η ARM ετοιμάζει AI chips για να μπει δυναμικά στην αγορά από το 2025

Η ARM, η θυγατρική εταιρεία ημιαγωγών του ιαπωνικού επενδυτικού γίγαντα SoftBank Group, επιθυμεί να εισέλθει…

12 ώρες ago

Το Assassin’s Creed Shadows είναι το επόμενο flagship game της σειράς!

Η Ubisoft επιβεβαίωσε ότι Assassin's Creed Shadows θα είναι το πραγματικό όνομα του επερχόμενου παιχνιδιού…

12 ώρες ago

Eπίσημα ο ανταγωνιστής του Χiaomi 14 Ultra

Σειρά της vivo να ανακοινώσει τη ναυαρχίδα της για το 2024, με την κινέζικη εταιρεία…

12 ώρες ago

Ερευνητές «έπιασαν» άτομα να μετατρέπονται σε κύματα και δικαιώνουν τον Schrödinger!

Για πρώτη φορά στα χρονικά, οι Φυσικοί κατάφεραν να συλλάβουν μια καθαρή εικόνα μεμονωμένων ατόμων…

13 ώρες ago

Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.