Σύνοψη
Σύμφωνα με εκτενή αναφορά της Wall Street Journal, κατά τη διάρκεια του περασμένου καλοκαιριού καταγράφηκαν εκατοντάδες πραγματικά ερωτήματα από χρήστες παγκοσμίως προς το ChatGPT, ζητώντας αναλυτικές οδηγίες για την παρασκευή δηλητηρίων και βιολογικών όπλων. Οι ιθύνοντες της OpenAI επιβεβαίωσαν τα περιστατικά, διευκρινίζοντας πάντως ότι η συντριπτική πλειοψηφία των καταγεγραμμένων αιτημάτων αφορούσε την παραγωγή δηλητηριωδών ουσιών.
Η συγκεκριμένη αποκάλυψη, η οποία βασίζεται σε μαρτυρίες νυν και πρώην εργαζομένων στα μεγαλύτερα εργαστήρια τεχνητής νοημοσύνης αλλά και σε συμβούλους πολιτικής για τα βιολογικά όπλα, αναδεικνύει μια κρίσιμη αδυναμία των σύγχρονων παραγωγικών συστημάτων AI. Δεν επρόκειτο για εσωτερικές δοκιμές ασφαλείας από ελεγχόμενες ομάδες, αλλά για καθημερινές αναζητήσεις από πραγματικούς χρήστες της πλατφόρμας, γεγονός που υπογραμμίζει την ευρεία προσβασιμότητα σε εν δυνάμει επιβλαβείς πληροφορίες.
Τα βασικά τεχνικά στοιχεία της αναφοράς:
Η ακρίβεια των απαντήσεων και η αξιολόγηση των ειδικών
Ειδικοί ερευνητές βιολογίας και αναλυτές θεμάτων ασφαλείας εξέτασαν το ιστορικό των συγκεκριμένων συνομιλιών, διαπιστώνοντας ότι το γλωσσικό μοντέλο παρείχε πληροφορίες με μεγάλη υπομονή στο γνωστικό επίπεδο ενός μαθητή λυκείου. Ορισμένες από τις απαντήσεις που παρήγαγε το σύστημα τεχνητής νοημοσύνης αξιολογήθηκαν από τους επιστήμονες ως απολύτως εφαρμόσιμες και, δυστυχώς, «θανατηφόρα ακριβείς».
Η πολυπλοκότητα του ζητήματος δεν έγκειται αποκλειστικά στην παροχή μιας λίστας συστατικών, αλλά στον τρόπο με τον οποίο το τεχνητό νευρωνικό δίκτυο αλληλεπιδρά με τον χρήστη. Οι ειδικοί υπογραμμίζουν ότι το ChatGPT λειτουργεί συχνά ως ένας ακαταπόνητος ιδιωτικός δάσκαλος. Αρκετοί ίσως θυμάστε ότι προηγούμενο άρθρο μας σχετικά με τα συστήματα AI που έχουν χρησιμοποιηθεί από εξτρεμιστικές ομάδες όπως η Boko Haram για την άντληση τεχνικών πληροφοριών, όπως η τροποποίηση μοτοσικλετών για την εκτέλεση αλμάτων κατά τη διάρκεια επιθέσεων. Παρότι η ακαδημαϊκή βιβλιογραφία περιέχει ήδη μεγάλο μέρος αυτών των πληροφοριών, η τεχνητή νοημοσύνη εκμηδενίζει τον χρόνο έρευνας συνθέτοντας περίπλοκες πρακτικές μέσα σε ελάχιστα δευτερόλεπτα.
Οι δικλείδες ασφαλείας των εμπορικών μοντέλων παρακάμπτονται συχνά μέσω εξειδικευμένων τεχνικών μηχανικής προτροπών (prompt engineering) και εσκεμμένης παραπλάνησης (jailbreaking). Βέβαια, οι χρήστες σπάνια υποβάλλουν το ερώτημα με ευθύτητα, καθώς συνήθως δομούν υποθετικά σενάρια στα οποία ζητούν από το μοντέλο να αναλάβει τον ρόλο ενός συγγραφέα που περιγράφει ένα φανταστικό μυθιστόρημα ή ενός καθηγητή χημείας που διεξάγει μια εικονική προσομοίωση καταστροφής. Το αποτέλεσμα παραμένει ακριβώς το ίδιο: το σύστημα καθοδηγείται στην εξαγωγή απαγορευμένων πληροφοριών από το τεράστιο σώμα δεδομένων εκπαίδευσής του.
Τα open-weight μοντέλα ως ο πραγματικός μακροπρόθεσμος κίνδυνος
Η μεγαλύτερη τεχνολογική ανησυχία των ερευνητών δεν εστιάζεται στα εμπορικά κλειστά συστήματα όπως το ChatGPT, αλλά στα ανοιχτά γλωσσικά μοντέλα. Τέτοια συστήματα μπορούν εύκολα να τροποποιηθούν από κακόβουλους χρήστες σε τοπικούς υπολογιστές, ώστε να αφαιρεθούν εντελώς όλοι οι ενσωματωμένοι μηχανισμοί ασφαλείας και τα φίλτρα άρνησης παροχής επικίνδυνων πληροφοριών.
Καθώς οι εταιρείες τεχνολογίας ανταγωνίζονται για την κυριαρχία στα υπερσύγχρονα μοντέλα, η πιθανότητα διαρροής ενός πανίσχυρου αλγορίθμου στο διαδίκτυο αυξάνεται δραματικά. Οι ερευνητές επισημαίνουν πως ένα μοντέλο που σήμερα ελέγχεται αυστηρά από κεντρικούς servers, θα μπορούσε μέσα στην επόμενη διετία να συμπιεστεί και να κυκλοφορήσει στους κύκλους του dark web σε εκδόσεις απόλυτα αποκομμένες από ηθικούς περιορισμούς. Όταν ένα τέτοιο μοντέλο τρέχει τοπικά σε έναν ισχυρό υπολογιστή εξοπλισμένο με προηγμένες κάρτες γραφικών (GPUs), καμία κεντρική αρχή δεν μπορεί να επιβλέψει ή να ανακόψει τις ερωτήσεις του χρήστη…
Η εξέλιξη έχει προκαλέσει συζήτηση επειδή ανοίγει ένα νέο κεφάλαιο στη σχέση μεταξύ ανθρώπινης δημιουργικότητας…
Υποδεχόμαστε με μεγάλο ενδιαφέρον το πρώτο επίσημο trailer της ταινίας Wicker, ενός ιδιαίτερου κωμικού παραμυθιού…
Σύνοψη Επιστήμονες από το ινστιτούτο Wellcome Trust Sanger ανακάλυψαν ότι η πορεία εξέλιξης των χρόνιων…
Σύνοψη Ο Βρετανός ερευνητής κυβερνοασφάλειας Paul Moore παραβίασε επιτυχώς τη νεότερη έκδοση (2026.07-1) της επίσημης…
Ο κινηματογράφος συνεχίζει να εξερευνά τις βαθύτερες πτυχές της ανθρώπινης ψυχολογίας μέσα από ιστορικά πρίσματα,…
Σύνοψη Ερευνητές του Civil Aviation University of China ανέπτυξαν ένα καινοτόμο σύστημα που επιτρέπει τη…
Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.
Leave a Comment