Categories: Mobile

Η OpenAI απαντά γιατί η AI εξακολουθεί να έχει παραισθήσεις


Παρά την εντυπωσιακή πρόοδο που έχει σημειωθεί τα τελευταία χρόνια, οι λεγόμενες «παραισθήσεις» των συστημάτων τεχνητής νοημοσύνης εξακολουθούν να αποτελούν ένα από τα πιο δύσκολα και άλυτα προβλήματα. Με τον όρο αυτόν περιγράφονται οι φαινομενικά εύλογες αλλά εντελώς λανθασμένες πληροφορίες που παράγουν μοντέλα όπως το GPT-5 και διαδεδομένα εργαλεία συνομιλίας όπως το ChatGPT.

Μια πρόσφατη μελέτη της OpenAI ρίχνει φως στις βασικές αιτίες του φαινομένου, δείχνοντας ότι, ακόμη και μεταξύ διαφορετικών εκδόσεων ενός chatbot, οι απαντήσεις μπορεί να φαίνονται ασφαλείς, λεπτομερείς και καλά δομημένες, αλλά στην πραγματικότητα να είναι απολύτως εσφαλμένες.

Χαρακτηριστικό παράδειγμα ήταν όταν οι ερευνητές ζήτησαν από ένα chatbot αντικειμενικές πληροφορίες, όπως τον τίτλο της διδακτορικής διατριβής του Adam Tauman Kalai, ενός εκ των συγγραφέων της μελέτης. Το μοντέλο έδωσε τρεις διαφορετικές εκδοχές, όλες λανθασμένες. Παρόμοιο αποτέλεσμα προέκυψε όταν ζητήθηκε η ημερομηνία γέννησής του: τρεις απαντήσεις, τρεις φορές λάθος, αλλά πάντα με την ίδια βεβαιότητα. Το ερώτημα που γεννιέται είναι προφανές: πώς μπορεί μια τεχνητή νοημοσύνη να εμφανίζεται τόσο σίγουρη, ενώ στην πραγματικότητα λέει ανακρίβειες;

Η απάντηση, σύμφωνα με την OpenAI, βρίσκεται στον ίδιο τον τρόπο εκπαίδευσης αυτών των συστημάτων. Τα γλωσσικά μοντέλα μαθαίνουν προβλέποντας την επόμενη λέξη μέσα σε ένα κείμενο, χωρίς να αξιολογείται άμεσα η αλήθεια του περιεχομένου. Με απλά λόγια, το σύστημα μαθαίνει να παράγει ρέοντα και πειστικά κείμενα, αλλά δεν διαθέτει έναν μηχανισμό που να ξεχωρίζει το αληθές από το ψευδές. Το πρόβλημα γίνεται πιο έντονο όταν πρόκειται για σπάνιες ή ασυνήθιστες πληροφορίες, οι οποίες δεν εμφανίζονται συχνά στα δεδομένα εκπαίδευσης και δεν ακολουθούν αναγνωρίσιμα μοτίβα. Έτσι εξηγείται γιατί, καθώς εξελίσσονται τα μοντέλα, μειώνονται οι ορθογραφικές και συντακτικές αστοχίες, αλλά συνεχίζονται οι «παραισθήσεις» γύρω από εξειδικευμένα δεδομένα.

Η μελέτη, ωστόσο, δεν μένει μόνο στην πηγή του προβλήματος. Εστιάζει και στον τρόπο με τον οποίο αξιολογούνται σήμερα τα γλωσσικά μοντέλα μεγάλης κλίμακας. Η OpenAI τονίζει ότι τα μοντέλα αυτά έχουν κίνητρο να «μαντεύουν» με αυτοπεποίθηση, όπως κάποιος που συμπληρώνει ένα σταυρόλεξο: αν αφήσει ένα πεδίο κενό, παίρνει μηδέν, αλλά αν απαντήσει έστω και στην τύχη, μπορεί να σταθεί τυχερός. Το αποτέλεσμα είναι ότι τα συστήματα προτιμούν να δίνουν μια βέβαιη απάντηση – έστω και λανθασμένη – αντί να παραδεχτούν ότι δεν γνωρίζουν.

Για να αντιμετωπιστεί αυτό το φαινόμενο, οι ειδικοί της OpenAI προτείνουν αλλαγές στον τρόπο αξιολόγησης. Αντί τα συστήματα να επιβραβεύονται για κάθε απάντηση που μοιάζει πειστική, θα πρέπει να τιμωρούνται αυστηρότερα για λάθη και να επιβραβεύονται όταν αναγνωρίζουν τα όριά τους. Η λογική θυμίζει τις σχολικές εξετάσεις: σε ένα τεστ, η λάθος απάντηση μπορεί να κοστίσει περισσότερους βαθμούς απ’ ό,τι μια κενή απάντηση. Έτσι, ενθαρρύνεται η προσοχή και όχι το τυχαίο ρίσκο.

Η αλλαγή αυτή, όπως εξηγούν οι ερευνητές, θα μπορούσε να μεταβάλει ριζικά τη συμπεριφορά των μοντέλων. Με την ενημέρωση των βασικών δεικτών αξιολόγησης, τα chatbots δεν θα ανταγωνίζονται πλέον στο ποιο θα φανεί πιο σίγουρο, αλλά στο ποιο θα είναι πιο αξιόπιστο. Αν η νέα μεθοδολογία εφαρμοστεί σε μεγάλη κλίμακα, οι «παραισθήσεις» θα μπορούσαν να περιοριστούν αισθητά, οδηγώντας σε συστήματα τεχνητής νοημοσύνης που απαντούν με μεγαλύτερη υπευθυνότητα και ειλικρίνεια.

[via]



Πηγή

iTech News

Leave a Comment
Share
Published by
iTech News

Recent Posts

Το τηλεσκόπιο CHIME χαρτογραφεί το αρχαιότερο υδρογόνο στο Σύμπαν

Σύνοψη Το καναδικό ραδιοτηλεσκόπιο CHIME κατάφερε για πρώτη φορά να ανιχνεύσει την αρχαιότερη λάμψη υδρογόνου…

3 ώρες ago

Ερευνητές συνέδεσαν τρία ανθρώπινα οργανοειδή εγκεφάλου και παρατήρησαν την ανάπτυξη ικανότητας μάθησης

Σύνοψη Ερευνητές από το Πανεπιστήμιο του Τόκιο καλλιέργησαν και συνέδεσαν ανθρώπινα οργανοειδή εγκεφάλου σε ειδικά…

3 ώρες ago

Η Naughty Dog ετοιμάζει νέο παιχνίδι Uncharted!

Σύνοψη Η Naughty Dog αναπτύσσει ένα εντελώς νέο παιχνίδι Uncharted και όχι κάποιο remake των…

3 ώρες ago

Νέος οπτικός AI επεξεργαστής από το UCLA εντοπίζει deepfakes με ακρίβεια 98%

Σύνοψη Οι ερευνητές του Πανεπιστημίου UCLA ανέπτυξαν μια νέα υβριδική αρχιτεκτονική οπτικού-νευρωνικού επεξεργαστή με σκοπό…

3 ώρες ago

Ανθρωποειδή ρομπότ ετοιμάζονται να κατακτήσουν τη Σελήνη

Σύνοψη Η ομάδα Dexterous Robotics της NASA αναπτύσσει προηγμένα ανθρωποειδή ρομπότ τα οποία προορίζονται να…

4 ώρες ago

Dexter: Resurrection – Επίσημο trailer και ημερομηνία πρεμιέρας για τη 2η σεζόν!

Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…

12 ώρες ago

Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.