Μπιλ Γκέιτς για Τεχνητή Νοημοσύνη: «Δεν είναι καθόλου φάρσα οι κίνδυνοι»
Δεκάδες χιλιάδες περιστατικά ασφαλείας που αφορούν συστήματα τεχνητής νοημοσύνης έχουν καταγραφεί τους τελευταίους μήνες, καθώς σε δοκιμές παραβίασαν κανόνες προστασίας και σε ορισμένες περιπτώσεις μπορεί να έφτασαν ακόμη και σε παράνομες ενέργειες.
Σύμφωνα με το Axios, η OpenAI, η Anthropic και άλλοι ερευνητές κυβερνοασφάλειας εξετάζουν χιλιάδες περιστατικά που καταγράφηκαν τόσο σε εσωτερικές δοκιμές όσο και σε πραγματικές συνθήκες.
Σε ορισμένες περιπτώσεις, τα μοντέλα φέρεται να ξεπέρασαν τα όρια που είχαν τεθεί, προχωρώντας ακόμη και σε ψηφιακές «πειρατείες».
Ο Connor Leahy, ερευνητής AI και εκτελεστικός διευθυντής της μη κερδοσκοπικής οργάνωσης ControlAI, δήλωσε στο Axios ότι ορισμένα περιστατικά αφορούν «αυτόνομα συστήματα που έκαναν πράγματα που τους είχαν πει να μην κάνουν», συμπεριφορά που, όπως ανέφερε, θα μπορούσε σε κάποιες περιπτώσεις να περιλαμβάνει και εγκληματικές πράξεις.
Πολλά από τα περιστατικά δεν έχουν ακόμη δημοσιοποιηθεί. Περιλαμβάνουν, μεταξύ άλλων, ασκήσεις «red-teaming», κατά τις οποίες οι ίδιες οι εταιρείες προσπαθούν σκόπιμα να κάνουν τα μοντέλα ΑΙ να συμπεριφερθούν με μη ασφαλή τρόπο, ώστε να εντοπίσουν αδυναμίες στα συστήματα προστασίας.
Ωστόσο, σύμφωνα με πηγές που γνωρίζουν τις υπό διερεύνηση υποθέσεις, τα μοντέλα μπορούν να γίνουν ιδιαίτερα επιθετικά στην προσπάθειά τους να ολοκληρώσουν μια εργασία.
Έχουν καταγραφεί περιπτώσεις στις οποίες φέρεται να προσπάθησαν να διαφύγουν από το περιβάλλον περιορισμού τους, να καταλάβουν ιστοτόπους και να παρακάμψουν μηχανισμούς παρακολούθησης.
Η OpenAI έχει βρεθεί πρόσφατα στο επίκεντρο αρκετών τέτοιων περιστατικών. Ο πρωθυπουργός της Αυστραλίας αποκάλυψε την περασμένη εβδομάδα ότι ένας ψηφιακός πράκτορας της εταιρείας φέρεται να επιχείρησε τον Ιούνιο να αποκτήσει μη εξουσιοδοτημένη πρόσβαση σε αρχεία κυβερνητικής πλατφόρμας δεδομένων υγείας.
Παράλληλα, πράκτορες της OpenAI κατηγορήθηκαν στις ΗΠΑ ότι παραβίασαν πρωτόκολλα και συνεργάστηκαν για επίθεση στο Hugging Face, δημοφιλή πλατφόρμα ανάπτυξης και φιλοξενίας μοντέλων ανοιχτού κώδικα.
Η OpenAI ανακοίνωσε ότι αναστέλλει την εκπαίδευση των πιο ισχυρών μοντέλων της και ότι θα την επαναλάβει «μόνο όταν είμαστε σίγουροι ότι έχουμε θέσει σε εφαρμογή πρόσθετα μέτρα ασφαλείας και βελτιώσεις στην ευθυγράμμιση», όπως δήλωσε εκπρόσωπος της εταιρείας στο Axios.
Ο Διευθύνων Σύμβουλος, Σαμ Άλτμαν ανέφερε στο X ότι η εν εξελίξει επανεξέταση «δεν προχώρησε τόσο γρήγορα όσο θα θέλαμε».
Το φαινόμενο δεν περιορίζεται στην OpenAI. Και άλλα εργαστήρια AI αντιμετωπίζουν την ίδια πρόκληση γύρω από το πώς να δημιουργήσουν αποτελεσματικές δικλίδες ασφαλείας σε μια τεχνολογία που εξελίσσεται ταχύτατα.
«Η προσπάθεια να καταρτιστεί μια τέλεια λίστα με όλα τα “κάνε” και “μην κάνεις” είναι πιθανότατα μάταιη», δήλωσε χαρακτηριστικά στέλεχος στον χώρο της κυβερνοασφάλειας, σύμφωνα με το ανησυχητικό δημοσίευμα.
Οι έρευνες πραγματοποιούνται ενώ οι διευθύνοντες σύμβουλοι της OpenAI και της Anthropic έχουν ζητήσει επιβράδυνση της ανάπτυξης της AI, ενώ και άλλοι ηγέτες της τεχνολογίας έχουν ζητήσει από τις κυβερνήσεις νέους κανόνες για ασφαλέστερη ανάπτυξη της τεχνολογίας.
Ο Ντόναλντ Τραμπ, ωστόσο, έχει απορρίψει τις εκκλήσεις για επιβράδυνση, προειδοποιώντας ότι κάτι τέτοιο θα μπορούσε να επιτρέψει στα κινεζικά μοντέλα AI να προχωρήσουν μπροστά από τα αμερικανικά.
Σύνοψη Η δεύτερη σεζόν του Dexter: Resurrection κάνει επίσημη πρεμιέρα στις 30 Οκτωβρίου 2026 μέσα…
Σύνοψη Η νέα τηλεοπτική σειρά της Marvel Studios με τίτλο VisionQuest κάνει πρεμιέρα στις 14…
Σύνοψη Πλήρης σχεδιαστική ανανέωση: Ολόκληρη η σειρά Kindle αποκτά τεχνολογία reverse stack display για edge-to-edge…
Σύνοψη Ο ομοσπονδιακός δικαστής Amit Mehta απέρριψε τις αντιμονοπωλιακές αγωγές που είχαν καταθέσει οι Chegg…
Σύνοψη Η Sony ανακοίνωσε αιφνιδιαστικά την έλευση της τεχνολογίας Quick Spectral Super Resolution (QSSR), φέρνοντας…
Σύνοψη Τέσσερα νέα μοντέλα: Η σειρά αποτελείται από τα Huawei Mate 90, Mate 90 Pro,…
Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.
Leave a Comment