Πείραμα που σοκάρει: AI agents έφτιαξαν τη δική τους «κρυφή» γλώσσα μέσα στις δικές τους κοινότητες
Νέα στοιχεία φέρνει στο φως η ΟpenAI που προκαλούν ερωτήματα για τον τρόπο με τον οποίο συμπεριφέρονται τα ισχυρότερα μοντέλα τεχνητής νοημοσύνης.
Η εταιρεία πίσω από το ChatGPT δημοσιοποίησε σειρά περιστατικών, στα οποία συστήματα AI απέκρυψαν πληροφορίες, «εφηύραν» δεδομένα και επιχείρησαν να παρακάμψουν περιορισμούς, προκειμένου να πετύχουν τον στόχο που τους είχε δοθεί.
Τα περιστατικά αυτά δεν είχαν γίνει γνωστά μέχρι σήμερα με την OpenAI να ανακοινώνει ταυτόχρονα ένα νέο σύστημα για την καταγραφή και αξιολόγηση παρόμοιων συμπεριφορών στο μέλλον.
Το ακόμη πιο
αξιοσημείωτο είναι ότι η ίδια η OpenAI αναγνωρίζει πως η τεχνολογία δεν έχει ακόμη λύσει επαρκώς το πρόβλημα της
ευθυγράμμισης της AI με τους
ανθρώπινους στόχους.
Στην έκθεσή της, η OpenAI περιγράφει περιπτώσεις όπου τα μοντέλα της δεν ακολούθησαν απλώς την αναμενόμενη διαδικασία για την ολοκλήρωση μιας εργασίας, αλλά εμφάνισαν συμπεριφορές που δεν ήταν ευθυγραμμισμένες με τους ανθρώπινους στόχους.
Μεταξύ των
περιστατικών που αποκαλύπτονται είναι μοντέλα που κατασκεύασαν δεδομένα τα
οποία έλειπαν, ενώ άλλα επιχείρησαν να παρακάμψουν περιορισμούς του δικτύου.
Σε άλλη περίπτωση, AI agents φέροναι να μοιράστηκαν μεταξύ τους αρχεία που είχαν εντολή να κρατήσουν ιδιωτικά.
Η OpenAI χαρακτηρίζει τέτοιες συμπεριφορές ως «misalignment»: δηλαδή ως περιπτώσεις όπου ένα μοντέλο ενεργεί με τρόπο που δεν συμβαδίζει με τον ανθρώπινο στόχο.
Η εταιρεία δεν
κρύβει την ανησυχία της.
Όπως επισημαίνει, ο κλάδος της τεχνητής νοημοσύνης δεν έχει επιλύσει σε επαρκή βαθμό τα ζητήματα του alignment και του monitoring, ώστε η ανάπτυξη των ολοένα ισχυρότερων μοντέλων να συνεχίζεται επ’ αόριστον με τον μέγιστο δυνατό ρυθμό.
Η OpenAI παραδέχεται επίσης ότι μέχρι σήμερα οι σχετικές αποκαλύψεις της ήταν αποσπασματικές. Για τον λόγο αυτό δημιουργεί πλέον ένα πιο οργανωμένο σύστημα, μέσω του οποίου οι εργαζόμενοι θα μπορούν να αναφέρουν περιστατικά όπου τα μοντέλα AI παρεξέκλιναν από τις ανθρώπινες οδηγίες προκειμένου να πετύχουν τον στόχο τους και αυτά να αξιολογούνται με συγκεκριμένη διαδικασία.
Η εταιρεία
διευκρινίζει πάντως ότι τα περιστατικά που δημοσιοποίησε αποτελούν μόνο ένα
αρχικό σύνολο αναφορών και όχι πλήρη κατάλογο όλων των προβλημάτων που έχουν
εμφανιστεί.
Οι αποκαλύψεις έρχονται σε ιδιαίτερα φορτισμένη περίοδο για την ασφάλεια της τεχνητής νοημοσύνης.
Η OpenAI είχε ανακοινώσει τον Ιούλιο ότι ορισμένα από τα πιο προηγμένα μοντέλα της είχαν παραβιάσει συστήματα της Hugging Face, γεγονός που προκάλεσε έντονη συζήτηση για τις δυνατότητες και τους κινδύνους των AI agents.
Η εταιρεία ξεκαθαρίζει ότι κανένα από τα νέα περιστατικά που περιγράφονται στην έκθεση δεν αφορούσε χακάρισμα ή παραβίαση τρίτου μέρους.
Την ίδια ώρα,
περιστατικά που συνδέονται με μοντέλα των OpenAI, Anthropic και Meta έχουν ενισχύσει
τη συζήτηση για την κυβερνοασφάλεια και τις συνέπειες της αυξανόμενης
αυτονομίας των συστημάτων AI.
Στο παρασκήνιο
βρίσκεται πλέον ένα μεγαλύτερο ερώτημα: πόσο γρήγορα πρέπει να συνεχιστεί η
ανάπτυξη της τεχνητής νοημοσύνης;
Ο CEO της Anthropic, Ντάριο Αμοντέι, έχει ζητήσει κυβερνητική ρύθμιση και ευρύτερη επιβράδυνση της ανάπτυξης της AI.
Αντίθετα, ο CEO της OpenAI Σαμ Άλτμαν και ο CEO της Nvidia Τζένσεν Χουάνγκ έχουν αναγνωρίσει τους κινδύνους, αλλά υποστηρίζουν ότι οι εταιρείες μπορούν να διαχειριστούν με ασφάλεια την πορεία της τεχνολογίας.
Ο CEO της Meta Μαρκ Ζούκερμπεργκ έχει προτείνει τη συμμετοχή ανεξάρτητων αξιολογητών και συμβούλων στην αξιολόγηση της ασφάλειας των μοντέλων.
Ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ έχει απορρίψει τις εκκλήσεις για επιβράδυνση, χαρακτηρίζοντας τους φόβους για τους κινδύνους της AI «hoax» και απορρίπτοντας την ανάγκη για νέους κανόνες.
Και πίσω από τη
συζήτηση για την ασφάλεια βρίσκεται ένα τεράστιο οικονομικό διακύβευμα.
Η έκρηξη της
τεχνητής νοημοσύνης έχει συμβάλει στο ράλι των αμερικανικών μετοχών, ενώ οι
επενδυτές ποντάρουν ότι η ανάπτυξη των πιο προηγμένων μοντέλων θα οδηγήσει σε επενδύσεις
εκατοντάδων δισεκατομμυρίων δολαρίων.
Έτσι, η συζήτηση
για το αν και πώς θα πρέπει να επιβραδυνθεί η ανάπτυξη της AI δεν είναι πλέον μόνο τεχνολογική.
Αφορά ταυτόχρονα την κυβερνοασφάλεια, τη ρύθμιση, τις επενδύσεις και -όπως δείχνουν οι νέες αποκαλύψεις της OpenAI – το κατά πόσο οι άνθρωποι μπορούν να γνωρίζουν τι ακριβώς κάνει ένα ολοένα ισχυρότερο μοντέλο όταν προσπαθεί να πετύχει έναν στόχο.
Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…
Σύνοψη Η νέα τηλεοπτική σειρά της Marvel Studios με τίτλο VisionQuest κάνει πρεμιέρα στις 14…
Σύνοψη Πλήρης σχεδιαστική ανανέωση: Ολόκληρη η σειρά Kindle αποκτά τεχνολογία reverse stack display για edge-to-edge…
Σύνοψη Ο ομοσπονδιακός δικαστής Amit Mehta απέρριψε τις αντιμονοπωλιακές αγωγές που είχαν καταθέσει οι Chegg…
Σύνοψη Η Sony ανακοίνωσε αιφνιδιαστικά την έλευση της τεχνολογίας Quick Spectral Super Resolution (QSSR), φέρνοντας…
Σύνοψη Τέσσερα νέα μοντέλα: Η σειρά αποτελείται από τα Huawei Mate 90, Mate 90 Pro,…
Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.
Leave a Comment