Categories: Technology

OpenAI: Mοντέλα AI άρχισαν να «κρύβουν» την αλήθεια -Νέες αποκαλύψεις που προκαλούν ανησυχία


Νέα στοιχεία φέρνει στο φως η ΟpenAI που προκαλούν ερωτήματα για τον τρόπο με τον οποίο συμπεριφέρονται τα ισχυρότερα μοντέλα τεχνητής νοημοσύνης.

Η εταιρεία πίσω από το ChatGPT δημοσιοποίησε σειρά περιστατικών, στα οποία συστήματα AI απέκρυψαν πληροφορίες, «εφηύραν» δεδομένα και επιχείρησαν να παρακάμψουν περιορισμούς, προκειμένου να πετύχουν τον στόχο που τους είχε δοθεί.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Τα περιστατικά αυτά δεν είχαν γίνει γνωστά μέχρι σήμερα με την OpenAI να ανακοινώνει ταυτόχρονα ένα νέο σύστημα για την καταγραφή και αξιολόγηση παρόμοιων συμπεριφορών στο μέλλον.

Το ακόμη πιο
αξιοσημείωτο είναι ότι η ίδια η OpenAI αναγνωρίζει πως η τεχνολογία δεν έχει ακόμη λύσει επαρκώς το πρόβλημα της
ευθυγράμμισης της AI με τους
ανθρώπινους στόχους.

Όταν η AI κάνει τα πάντα για να πετύχει τον στόχο

Στην έκθεσή της, η OpenAI περιγράφει περιπτώσεις όπου τα μοντέλα της δεν ακολούθησαν απλώς την αναμενόμενη διαδικασία για την ολοκλήρωση μιας εργασίας, αλλά εμφάνισαν συμπεριφορές που δεν ήταν ευθυγραμμισμένες με τους ανθρώπινους στόχους.

Bloomberg: Κοινό μέτωπο OpenAI, Google και Anthropic για την ασφάλεια στην Τεχνητή Νοημοσύνη

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Μεταξύ των
περιστατικών που αποκαλύπτονται είναι μοντέλα που κατασκεύασαν δεδομένα τα
οποία έλειπαν, ενώ άλλα επιχείρησαν να παρακάμψουν περιορισμούς του δικτύου.

Σε άλλη περίπτωση, AI agents φέροναι να μοιράστηκαν μεταξύ τους αρχεία που είχαν εντολή να κρατήσουν ιδιωτικά.

Η OpenAI χαρακτηρίζει τέτοιες συμπεριφορές ως «misalignment»: δηλαδή ως περιπτώσεις όπου ένα μοντέλο ενεργεί με τρόπο που δεν συμβαδίζει με τον ανθρώπινο στόχο.

«Δεν έχουμε λύσει
το πρόβλημα»

Η εταιρεία δεν
κρύβει την ανησυχία της.

Όπως επισημαίνει, ο κλάδος της τεχνητής νοημοσύνης δεν έχει επιλύσει σε επαρκή βαθμό τα ζητήματα του alignment και του monitoring, ώστε η ανάπτυξη των ολοένα ισχυρότερων μοντέλων να συνεχίζεται επ’ αόριστον με τον μέγιστο δυνατό ρυθμό.

Πείραμα που σοκάρει: AI agents έφτιαξαν τη δική τους «κρυφή» γλώσσα μέσα στις δικές τους κοινότητες

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Η OpenAI παραδέχεται επίσης ότι μέχρι σήμερα οι σχετικές αποκαλύψεις της ήταν αποσπασματικές. Για τον λόγο αυτό δημιουργεί πλέον ένα πιο οργανωμένο σύστημα, μέσω του οποίου οι εργαζόμενοι θα μπορούν να αναφέρουν περιστατικά όπου τα μοντέλα AI παρεξέκλιναν από τις ανθρώπινες οδηγίες προκειμένου να πετύχουν τον στόχο τους και αυτά να αξιολογούνται με συγκεκριμένη διαδικασία.

Η εταιρεία
διευκρινίζει πάντως ότι τα περιστατικά που δημοσιοποίησε αποτελούν μόνο ένα
αρχικό σύνολο αναφορών και όχι πλήρη κατάλογο όλων των προβλημάτων που έχουν
εμφανιστεί.

Στο μικροσκόπιο ξανά το ChatGPT και τα ισχυρά μοντέλα AI

Οι αποκαλύψεις έρχονται σε ιδιαίτερα φορτισμένη περίοδο για την ασφάλεια της τεχνητής νοημοσύνης.

Η OpenAI είχε ανακοινώσει τον Ιούλιο ότι ορισμένα από τα πιο προηγμένα μοντέλα της είχαν παραβιάσει συστήματα της Hugging Face, γεγονός που προκάλεσε έντονη συζήτηση για τις δυνατότητες και τους κινδύνους των AI agents.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Η εταιρεία ξεκαθαρίζει ότι κανένα από τα νέα περιστατικά που περιγράφονται στην έκθεση δεν αφορούσε χακάρισμα ή παραβίαση τρίτου μέρους.

To γνωρίζατε ότι υπάρχει κίνημα για τα δικαιώματα της τεχνητής νοημοσύνης; Ο άνδρας που πιστεύει ότι τα chatbots έχουν συνείδηση

Στα άκρα η σύγκρουση για την Τεχνητή Νοημοσύνη -«Φάρσα», λέει ο Τραμπ, ο κίνδυνος αφανισμού της ανθρωπότητας

Την ίδια ώρα,
περιστατικά που συνδέονται με μοντέλα των OpenAI, Anthropic και Meta έχουν ενισχύσει
τη συζήτηση για την κυβερνοασφάλεια και τις συνέπειες της αυξανόμενης
αυτονομίας των συστημάτων AI.

Οι τεχνολογικοί
κολοσσοί διαφωνούν για το «φρένο»

Στο παρασκήνιο
βρίσκεται πλέον ένα μεγαλύτερο ερώτημα: πόσο γρήγορα πρέπει να συνεχιστεί η
ανάπτυξη της τεχνητής νοημοσύνης;

Ο CEO της Anthropic, Ντάριο Αμοντέι, έχει ζητήσει κυβερνητική ρύθμιση και ευρύτερη επιβράδυνση της ανάπτυξης της AI.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Αντίθετα, ο CEO της OpenAI Σαμ Άλτμαν και ο CEO της Nvidia Τζένσεν Χουάνγκ έχουν αναγνωρίσει τους κινδύνους, αλλά υποστηρίζουν ότι οι εταιρείες μπορούν να διαχειριστούν με ασφάλεια την πορεία της τεχνολογίας.

Ο CEO της Meta Μαρκ Ζούκερμπεργκ έχει προτείνει τη συμμετοχή ανεξάρτητων αξιολογητών και συμβούλων στην αξιολόγηση της ασφάλειας των μοντέλων.

Η Τεχνητή Νοημοσύνη απαντά αν και με ποιον τρόπο μπορεί να αφανίσει την ανθρωπότητα -Τι έγραψαν ChatGPT, Gemini, Claude και Grok

Ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ έχει απορρίψει τις εκκλήσεις για επιβράδυνση, χαρακτηρίζοντας τους φόβους για τους κινδύνους της AI «hoax» και απορρίπτοντας την ανάγκη για νέους κανόνες.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Το μεγάλο
στοίχημα των δισεκατομμυρίων

Και πίσω από τη
συζήτηση για την ασφάλεια βρίσκεται ένα τεράστιο οικονομικό διακύβευμα.

Η έκρηξη της
τεχνητής νοημοσύνης έχει συμβάλει στο ράλι των αμερικανικών μετοχών, ενώ οι
επενδυτές ποντάρουν ότι η ανάπτυξη των πιο προηγμένων μοντέλων θα οδηγήσει σε επενδύσεις
εκατοντάδων δισεκατομμυρίων δολαρίων.

Έτσι, η συζήτηση
για το αν και πώς θα πρέπει να επιβραδυνθεί η ανάπτυξη της AI δεν είναι πλέον μόνο τεχνολογική.

Αφορά ταυτόχρονα την κυβερνοασφάλεια, τη ρύθμιση, τις επενδύσεις και -όπως δείχνουν οι νέες αποκαλύψεις της OpenAI – το κατά πόσο οι άνθρωποι μπορούν να γνωρίζουν τι ακριβώς κάνει ένα ολοένα ισχυρότερο μοντέλο όταν προσπαθεί να πετύχει έναν στόχο.

Ακολουθήστε το στο Google News και μάθετε πρώτοι όλες τις ειδήσεις
Δείτε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο, στο 



Πηγή

iTech News

Leave a Comment
Share
Published by
iTech News

Recent Posts

Dexter: Resurrection – Επίσημο trailer και ημερομηνία πρεμιέρας για τη 2η σεζόν!

Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…

6 ώρες ago

Ο Ultron επιστρέφει στο νέο trailer της επερχόμενης σειράς του Disney+

Σύνοψη Η νέα τηλεοπτική σειρά της Marvel Studios με τίτλο VisionQuest κάνει πρεμιέρα στις 14…

6 ώρες ago

Edge-to-edge οθόνες, κατασκευή από αλουμίνιο και το τηλεχειριστήριο Kindle Click

Σύνοψη Πλήρης σχεδιαστική ανανέωση: Ολόκληρη η σειρά Kindle αποκτά τεχνολογία reverse stack display για edge-to-edge…

6 ώρες ago

Η Google δικαιώθηκε απέναντι στους εκδότες στις ΗΠΑ σχετικά με τα AI Overviews…

Σύνοψη Ο ομοσπονδιακός δικαστής Amit Mehta απέρριψε τις αντιμονοπωλιακές αγωγές που είχαν καταθέσει οι Chegg…

6 ώρες ago

Η Sony φέρνει AI upscaling στο βασικό PS5

Σύνοψη Η Sony ανακοίνωσε αιφνιδιαστικά την έλευση της τεχνολογίας Quick Spectral Super Resolution (QSSR), φέρνοντας…

7 ώρες ago

Επίσημα 4 νέα μοντέλα με μοναδικές καινοτομίες στην κατηγορία των smartphones

Σύνοψη Τέσσερα νέα μοντέλα: Η σειρά αποτελείται από τα Huawei Mate 90, Mate 90 Pro,…

10 ώρες ago

Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.