Σύνοψη
Η αντίληψη της ασφάλειας που προσφέρει ένα διαδικτυακό ψευδώνυμο καταρρίπτεται πλέον επιστημονικά. Μια νέα, αναλυτική έρευνα που δημοσιεύθηκε με τίτλο «Large-scale online deanonymization with LLMs» από ακαδημαϊκούς και ερευνητές της Anthropic, τεκμηριώνει την πλήρη αυτοματοποίηση της αποανωνυμοποίησης.
Μέσα από πειράματα σε πλατφόρμες όπως το Reddit και το Hacker News, η ερευνητική ομάδα, αποτελούμενη από τους Simon Lermen, Daniel Paleka, Joshua Swanson, Michael Aerni, Nicholas Carlini και Florian Tramèr, απέδειξε ότι τα Μεγάλα Γλωσσικά Μοντέλα (LLMs) μπορούν να συνδέσουν ανώνυμα σχόλια με πραγματικά ονόματα με τρομακτική ακρίβεια. Το πρακτικό απόρρητο, ο μοναδικός πυλώνας προστασίας εκατομμυρίων χρηστών, παύει να υφίσταται απέναντι στην υπολογιστική ισχύ της σύγχρονης AI.
Ναι. Σύμφωνα με τη νέα έρευνα της Anthropic, τα Μεγάλα Γλωσσικά Μοντέλα (LLMs) αναλύουν αδόμητα κείμενα από πλατφόρμες όπως το Reddit, εξάγουν γλωσσικά ιδιώματα και τα συνδέουν με πραγματικά προφίλ, επιτυγχάνοντας ποσοστό ταυτοποίησης 68% με 90% ακρίβεια, μια διαδικασία που καταργεί πρακτικά την έννοια της διαδικτυακής ανωνυμίας.
Οι κλασικές μέθοδοι αποανωνυμοποίησης δεδομένων (όπως αυτές που χρησιμοποιήθηκαν στο παρελθόν στον διάσημο διαγωνισμό του Netflix) απαιτούσαν αυστηρά δομημένα δεδομένα, όπως πίνακες με συγκεκριμένες ημερομηνίες, αξιολογήσεις και γεωγραφικά στίγματα. Το επίτευγμα των σύγχρονων LLMs έγκειται στην επεξεργασία του απολύτως αδόμητου, ελεύθερου κειμένου.
Η ροή εργασίας της επίθεσης που ανέπτυξαν οι ερευνητές χωρίζεται σε τρία κρίσιμα στάδια:
Ιδιαίτερη έμφαση στην έρευνα δόθηκε στη συσχέτιση της επιτυχίας με τον χρόνο συλλογισμού. Η ερευνητική ομάδα εφάρμοσε το μοντέλο σε ρυθμίσεις αυξημένης επεξεργασίας. Τα αποτελέσματα ήταν σαφή: παρέχοντας στο LLM περισσότερο χρόνο και πόρους κατά τη διάρκεια εξαγωγής συμπερασμάτων, η απόδοση εκτοξεύτηκε.
Στο πιο αυστηρό επίπεδο ακρίβειας (99%), το υψηλό επίπεδο συλλογιστικής προσπάθειας διπλασίασε το ποσοστό επιτυχίας ανάκλησης (από 1,4% σε 2,8%) συγκριτικά με τις ταχύτερες αποκρίσεις. Αυτό πρακτικά σημαίνει ότι η αποτελεσματικότητα του profiling εξαρτάται άμεσα από την ποσότητα των compute resources που είναι διατεθειμένος να αφιερώσει ο εκάστοτε επιτιθέμενος.
Για την επιβεβαίωση της μεθόδου, δημιουργήθηκαν τρία διαφορετικά datasets με γνωστά δεδομένα.
Σε όλες τις περιπτώσεις, ενώ οι κλασικές στατιστικές μέθοδοι απέτυχαν παταγωδώς με ποσοστά κοντά στο 0%, η προσέγγιση μέσω LLM έφτασε σε εντυπωσιακά επίπεδα, με το 68% των χρηστών να ταυτοποιείται σωστά (στο όριο του 90%). Ειδικά για χρήστες που μοιράζονταν πλούσιο περιεχόμενο (όπως κριτικές για πάνω από 10 ταινίες), τα ποσοστά αποκάλυψης ανήλθαν στο 48,1%.
Το διαδίκτυο μέχρι σήμερα λειτουργούσε υπό ένα σιωπηρό μοντέλο απειλής. Η υπόθεση εργασίας ήταν ότι το να βρει κάποιος την πραγματική ταυτότητα ενός απλού χρήστη, απαιτεί τεράστιο χρόνο χειροκίνητης έρευνας ανοιχτών πηγών (OSINT) από εξειδικευμένους αναλυτές. Αυτό ορίζεται ως “πρακτική αφάνεια”.
Τα LLMs ανατρέπουν αυτή τη συνθήκη αυτοματοποιώντας πλήρως τη διαδικασία. Μια εργασία που χρειαζόταν δεκάδες εργατοώρες από έναν ιδιωτικό ερευνητή, τώρα εκτελείται από μια δέσμη κώδικα μέσα σε δευτερόλεπτα, επιτρέποντας αναλύσεις μαζικής κλίμακας, και μάλιστα με εξαιρετικά χαμηλό κόστος API.
Η εφαρμογή τέτοιων τεχνολογιών δημιουργεί σημαντικά ερωτήματα για τους Έλληνες χρήστες. Στην εγχώρια διαδικτυακή πραγματικότητα, πλατφόρμες όπως το r/greece στο Reddit ή διάφορα Facebook groups, φιλοξενούν καθημερινά εκατομμύρια ανώνυμα σχόλια. Πολλοί χρήστες χρησιμοποιούν λογαριασμούς μίας χρήσης για να καταγγείλουν δυσμενείς εργασιακές συνθήκες σε ελληνικές εταιρείες, να συζητήσουν θέματα υγείας ή να μοιραστούν πολιτικές απόψεις.
Η τεχνολογική εξέλιξη των LLMs φέρνει τους χρήστες αντιμέτωπους με ένα πρακτικό πρόβλημα: μια εταιρεία, ένας ερευνητής ή ένας αλγόριθμος scraping, θα μπορούσε θεωρητικά να “τρέξει” τις εν λόγω αυτοματοποιημένες ρουτίνες για να συνδέσει τα αιχμηρά σχόλια ενός λογαριασμού στο Reddit με το ελληνικό προφίλ του δημιουργού του στο LinkedIn. Ακόμα και αν η προστασία των δεδομένων ορίζεται νομικά από τον ευρωπαϊκό κανονισμό GDPR, η τεχνική δυνατότητα των εργαλείων να συμπεραίνουν δεδομένα ταυτότητας μέσα από δημόσια, νόμιμα αναρτημένα αδόμητα κείμενα, δημιουργεί μια τεχνική πραγματικότητα αδύνατον να αναστραφεί.
Η μελέτη της Anthropic επιβεβαιώνει αυτό που υποπτευόμασταν κατά τη χρήση των πιο προηγμένων AI μοντέλων. Η αναλυτική τους ικανότητα στην “κατανόηση” του αδόμητου κειμένου είναι ασύλληπτη. Όταν αλληλεπιδρούμε με ένα σύστημα και διαπιστώνουμε πόσο γρήγορα προσαρμόζεται στον προσωπικό μας τόνο, σπάνια σκεφτόμαστε την αντίστροφη μηχανική αυτού του φαινομένου: το ίδιο το μοντέλο μπορεί να κάνει reverse-engineer τη σκέψη και τη γλώσσα μας για να κάνει de-anonymize την οντότητά μας.
Για τους αναγνώστες του Techgear, η συμβουλή είναι ξεκάθαρη και στερείται υπερβολών. Πρέπει πλέον να θεωρούμε δεδομένο ότι το “ψηφιακό αποτύπωμα” δεν αφορά μόνο cookies ή διευθύνσεων IP, αλλά την ίδια τη σύνταξη και το ύφος του λόγου μας. Εάν γράφετε ανώνυμα σε ένα forum και ταυτόχρονα διατηρείτε ένα επώνυμο προφίλ με κείμενα της δικής σας συγγραφής, ο συσχετισμός τους είναι πλέον θέμα μερικών API calls. Η προστασία της ιδιωτικότητας μετατοπίζεται πλέον από τη διαγραφή cookies, στη συνειδητή απόκρυψη του προσωπικού γλωσσικού ύφους.
Σύνοψη Αύξηση της τάξεως των 150 έως 200 ευρώ σε όλες τις εκδόσεις των Xbox…
Σύνοψη Διεθνής ερευνητική ομάδα υπό το Πανεπιστήμιο της Χιροσίμα ταυτοποίησε την ουράνια πηγή LHAASO J1912+1014u…
Σύνοψη Μαθηματικοί από τα Πανεπιστήμια Cambridge και Κοπεγχάγης απέδειξαν ότι δεν υφίσταται εκλογικό σύστημα ικανό…
Σύνοψη Η πρωτεΐνη TRF2, η οποία παραδοσιακά θεωρείτο αποκλειστικά υπεύθυνη για την προστασία των τελομερών…
Η εξέλιξη έχει προκαλέσει συζήτηση επειδή ανοίγει ένα νέο κεφάλαιο στη σχέση μεταξύ ανθρώπινης δημιουργικότητας…
Υποδεχόμαστε με μεγάλο ενδιαφέρον το πρώτο επίσημο trailer της ταινίας Wicker, ενός ιδιαίτερου κωμικού παραμυθιού…
Αυτό το site χρησιμοποιεί cookies, για την παροχή των υπηρεσιών της, να προσαρμόσετε τις διαφημίσεις και να αναλύσει την επισκεψιμότητα. Με τη χρήση αυτής της ιστοσελίδας, συμφωνείτε με τη πολιτική χρήση των cookies.
Leave a Comment