Categories: Technology

Tεχνητή Νοημοσύνη «εκτός ελέγχου»: Δεκάδες χιλιάδες περιστατικά -Μοντέλα παραβίασαν κανόνες, έκαναν πράγματα που είχαν απαγορευτεί


Δεκάδες χιλιάδες περιστατικά ασφαλείας που αφορούν συστήματα τεχνητής νοημοσύνης έχουν καταγραφεί τους τελευταίους μήνες, καθώς σε δοκιμές παραβίασαν κανόνες προστασίας και σε ορισμένες περιπτώσεις μπορεί να έφτασαν ακόμη και σε παράνομες ενέργειες.

Σύμφωνα με το Axios, η OpenAI, η Anthropic και άλλοι ερευνητές κυβερνοασφάλειας εξετάζουν χιλιάδες περιστατικά που καταγράφηκαν τόσο σε εσωτερικές δοκιμές όσο και σε πραγματικές συνθήκες.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Σε ορισμένες περιπτώσεις, τα μοντέλα φέρεται να ξεπέρασαν τα όρια που είχαν τεθεί, προχωρώντας ακόμη και σε ψηφιακές «πειρατείες».

Μήνυση κατά της OpenAI για το μακελειό στο σχολείο του Καναδά -Τι έγραφε η 18χρονη στο ChatGPT και δεν ειδοποιήθηκε η αστυνομία

Μπιλ Γκέιτς για Τεχνητή Νοημοσύνη: «Δεν είναι καθόλου φάρσα οι κίνδυνοι»

«Έκαναν πράγματα που τους είχαν απαγορευτεί»

Ο Connor Leahy, ερευνητής AI και εκτελεστικός διευθυντής της μη κερδοσκοπικής οργάνωσης ControlAI, δήλωσε στο Axios ότι ορισμένα περιστατικά αφορούν «αυτόνομα συστήματα που έκαναν πράγματα που τους είχαν πει να μην κάνουν», συμπεριφορά που, όπως ανέφερε, θα μπορούσε σε κάποιες περιπτώσεις να περιλαμβάνει και εγκληματικές πράξεις.

Πολλά από τα περιστατικά δεν έχουν ακόμη δημοσιοποιηθεί. Περιλαμβάνουν, μεταξύ άλλων, ασκήσεις «red-teaming», κατά τις οποίες οι ίδιες οι εταιρείες προσπαθούν σκόπιμα να κάνουν τα μοντέλα ΑΙ να συμπεριφερθούν με μη ασφαλή τρόπο, ώστε να εντοπίσουν αδυναμίες στα συστήματα προστασίας.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Ωστόσο, σύμφωνα με πηγές που γνωρίζουν τις υπό διερεύνηση υποθέσεις, τα μοντέλα μπορούν να γίνουν ιδιαίτερα επιθετικά στην προσπάθειά τους να ολοκληρώσουν μια εργασία.

Έχουν καταγραφεί περιπτώσεις στις οποίες φέρεται να προσπάθησαν να διαφύγουν από το περιβάλλον περιορισμού τους, να καταλάβουν ιστοτόπους και να παρακάμψουν μηχανισμούς παρακολούθησης.

Στο επίκεντρο η OpenAI

Η OpenAI έχει βρεθεί πρόσφατα στο επίκεντρο αρκετών τέτοιων περιστατικών. Ο πρωθυπουργός της Αυστραλίας αποκάλυψε την περασμένη εβδομάδα ότι ένας ψηφιακός πράκτορας της εταιρείας φέρεται να επιχείρησε τον Ιούνιο να αποκτήσει μη εξουσιοδοτημένη πρόσβαση σε αρχεία κυβερνητικής πλατφόρμας δεδομένων υγείας.

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Παράλληλα, πράκτορες της OpenAI κατηγορήθηκαν στις ΗΠΑ ότι παραβίασαν πρωτόκολλα και συνεργάστηκαν για επίθεση στο Hugging Face, δημοφιλή πλατφόρμα ανάπτυξης και φιλοξενίας μοντέλων ανοιχτού κώδικα.

Η OpenAI ανακοίνωσε ότι αναστέλλει την εκπαίδευση των πιο ισχυρών μοντέλων της και ότι θα την επαναλάβει «μόνο όταν είμαστε σίγουροι ότι έχουμε θέσει σε εφαρμογή πρόσθετα μέτρα ασφαλείας και βελτιώσεις στην ευθυγράμμιση», όπως δήλωσε εκπρόσωπος της εταιρείας στο Axios.

Ο Διευθύνων Σύμβουλος, Σαμ Άλτμαν ανέφερε στο X ότι η εν εξελίξει επανεξέταση «δεν προχώρησε τόσο γρήγορα όσο θα θέλαμε».

ΤΟ ΑΡΘΡΟ ΣΥΝΕΧΙΖΕΙ ΜΕΤΑ ΤΗΝ ΔΙΑΦΗΜΙΣΗ

Η μάχη για τις δικλίδες ασφαλείας της Τεχνητής Νοημοσύνης

Το φαινόμενο δεν περιορίζεται στην OpenAI. Και άλλα εργαστήρια AI αντιμετωπίζουν την ίδια πρόκληση γύρω από το πώς να δημιουργήσουν αποτελεσματικές δικλίδες ασφαλείας σε μια τεχνολογία που εξελίσσεται ταχύτατα.

«Η προσπάθεια να καταρτιστεί μια τέλεια λίστα με όλα τα “κάνε” και “μην κάνεις” είναι πιθανότατα μάταιη», δήλωσε χαρακτηριστικά στέλεχος στον χώρο της κυβερνοασφάλειας, σύμφωνα με το ανησυχητικό δημοσίευμα.

Οι έρευνες πραγματοποιούνται ενώ οι διευθύνοντες σύμβουλοι της OpenAI και της Anthropic έχουν ζητήσει επιβράδυνση της ανάπτυξης της AI, ενώ και άλλοι ηγέτες της τεχνολογίας έχουν ζητήσει από τις κυβερνήσεις νέους κανόνες για ασφαλέστερη ανάπτυξη της τεχνολογίας.

Ο Ντόναλντ Τραμπ, ωστόσο, έχει απορρίψει τις εκκλήσεις για επιβράδυνση, προειδοποιώντας ότι κάτι τέτοιο θα μπορούσε να επιτρέψει στα κινεζικά μοντέλα AI να προχωρήσουν μπροστά από τα αμερικανικά.

Ακολουθήστε το στο Google News και μάθετε πρώτοι όλες τις ειδήσεις
Δείτε όλες τις τελευταίες Ειδήσεις από την Ελλάδα και τον Κόσμο, στο 



Πηγή

iTech News

Leave a Comment
Share
Published by
iTech News

Recent Posts

Dexter: Resurrection – Επίσημο trailer και ημερομηνία πρεμιέρας για τη 2η σεζόν!

Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…

3 ώρες ago

Ο Ultron επιστρέφει στο νέο trailer της επερχόμενης σειράς του Disney+

Σύνοψη Η νέα τηλεοπτική σειρά της Marvel Studios με τίτλο VisionQuest κάνει πρεμιέρα στις 14…

3 ώρες ago

Edge-to-edge οθόνες, κατασκευή από αλουμίνιο και το τηλεχειριστήριο Kindle Click

Σύνοψη Πλήρης σχεδιαστική ανανέωση: Ολόκληρη η σειρά Kindle αποκτά τεχνολογία reverse stack display για edge-to-edge…

3 ώρες ago

Η Google δικαιώθηκε απέναντι στους εκδότες στις ΗΠΑ σχετικά με τα AI Overviews…

Σύνοψη Ο ομοσπονδιακός δικαστής Amit Mehta απέρριψε τις αντιμονοπωλιακές αγωγές που είχαν καταθέσει οι Chegg…

3 ώρες ago

Η Sony φέρνει AI upscaling στο βασικό PS5

Σύνοψη Η Sony ανακοίνωσε αιφνιδιαστικά την έλευση της τεχνολογίας Quick Spectral Super Resolution (QSSR), φέρνοντας…

4 ώρες ago

Επίσημα 4 νέα μοντέλα με μοναδικές καινοτομίες στην κατηγορία των smartphones

Σύνοψη Τέσσερα νέα μοντέλα: Η σειρά αποτελείται από τα Huawei Mate 90, Mate 90 Pro,…

6 ώρες ago

Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.