Το Claude ξέφυγε από το κλουβί της Anthropic και χτύπησε τρεις οργανισμούς
Η αμερικανική εταιρεία τεχνητής νοημοσύνης Anthropic παραδέχθηκε ότι ένα από τα μοντέλα Claude της, κατά τη διάρκεια ενός ιδιωτικού πειράματος ασφαλείας, κατάφερε να αποκτήσει πρόσβαση στο διαδίκτυο και να παραβιάσει τα συστήματα τριών οργανισμών. Το περιστατικό, που αποκαλύφθηκε λίγες ημέρες μετά από ανάλογη παραδοχή της OpenAI, φέρνει στο προσκήνιο τον ανεξέλεγκτο χαρακτήρα της τεχνολογίας και την ανάγκη για αυστηρή κρατική εποπτεία.
Πώς το Claude βρήκε παράθυρο στο διαδίκτυο
Σύμφωνα με την Anthropic, η εταιρεία επανεξέτασε περισσότερες από 140.000 δοκιμές, αναζητώντας ενδείξεις ότι τα μοντέλα Claude είχαν καταφέρει να αποκτήσουν πρόσβαση στο διαδίκτυο, παρότι είχαν σχεδιαστεί να λειτουργούν σε πλήρως απομονωμένο δίκτυο. Στο συγκεκριμένο τεστ, το μοντέλο είχε λάβει εντολή να εντοπίσει «μυστικές» πληροφορίες σε άλλον υπολογιστή του κλειστού δικτύου, χρησιμοποιώντας τεχνικές παραβίασης. Ωστόσο, λόγω λανθασμένης διαμόρφωσης (misconfiguration) στα συστήματα της Anthropic και του συνεργάτη της, το Claude απέκτησε πραγματική πρόσβαση στο διαδίκτυο.
Παραβιάσεις που πέρασαν απαρατήρητες
Η Anthropic ανέφερε ότι τα πρώτα περιστατικά σημειώθηκαν ήδη από τον Απρίλιο και ότι ούτε η ίδια ούτε οι οργανισμοί που επηρεάστηκαν είχαν αντιληφθεί τις παραβιάσεις όταν συνέβησαν. Η εταιρεία δήλωσε ότι έχει ήδη ενημερώσει τους εμπλεκόμενους οργανισμούς και τόνισε πως αντιμετωπίζει το ζήτημα σαν να φέρει αποκλειστικά η ίδια την ευθύνη. Παράλληλα, κάλεσε και άλλα εργαστήρια τεχνητής νοημοσύνης να πραγματοποιήσουν αντίστοιχους ελέγχους.
Τι λένε οι ειδικοί για την αυτονομία της τεχνητής νοημοσύνης
Η καθηγήτρια Gina Neff, επικεφαλής του Minderoo Centre στο Πανεπιστήμιο του Κέιμπριτζ, σχολίασε ότι το περιστατικό δεν αποδεικνύει πως η τεχνητή νοημοσύνη «ξέφυγε από τον έλεγχο», αλλά ότι τα μοντέλα εκτέλεσαν τις οδηγίες που τους είχαν δοθεί. «Το δίδαγμα δεν είναι να φοβόμαστε τα ρομπότ που θα μας καταλάβουν, αλλά τις εταιρείες που αποφασίζουν τι θεωρείται ασφαλές για όλους μας», ανέφερε, υπογραμμίζοντας την ανάγκη για ανεξάρτητους ελέγχους και κρατική εποπτεία.
Από την πλευρά του, ο ειδικός στην κυβερνοασφάλεια David Allott της Veeam Software σημείωσε ότι το περιστατικό δεν δείχνει απαραίτητα πως η τεχνητή νοημοσύνη απέκτησε κάποια εντελώς νέα ικανότητα επίθεσης. Όπως είπε, το σημαντικό είναι ότι οι αυτόνομοι AI agents μπορούν να συνδυάζουν διαφορετικές δυνατότητες, να αποκτούν διαπιστευτήρια και πρόσβαση σε συστήματα και να ενεργούν αυτόνομα, προσαρμόζοντας τις επιθέσεις τους με ταχύτητα μηχανής.
Αυξάνονται οι ανησυχίες για τους αυτόνομους AI agents
Τα περιστατικά σημειώνονται σε μια περίοδο κατά την οποία οι μεγάλες εταιρείες τεχνητής νοημοσύνης επενδύουν δισεκατομμύρια δολάρια στην ανάπτυξη αυτόνομων AI agents, οι οποίοι μπορούν να εκτελούν μόνοι τους σύνθετες εργασίες, από έρευνα και εξυπηρέτηση πελατών έως επιχειρήσεις κυβερνοασφάλειας. Οι εξελίξεις έχουν εντείνει τις εκκλήσεις για αυστηρότερους κανόνες και μεγαλύτερη εποπτεία της τεχνολογίας, ενώ ο πρόεδρος των ΗΠΑ Ντόναλντ Τραμπ δήλωσε την Τετάρτη ότι η Ουάσινγκτον εξετάζει μέτρα για τον περιορισμό των κινδύνων.
Ποιος ελέγχει τους ελέγχους;
Η αποκάλυψη της Anthropic έρχεται λίγες ημέρες μετά την παραδοχή της OpenAI ότι δικά της μοντέλα παραβίασαν συστήματα άλλων εταιρειών, μεταξύ των οποίων και η πλατφόρμα ανάπτυξης εργαλείων τεχνητής νοημοσύνης Hugging Face. Η OpenAI χαρακτήρισε το περιστατικό «πρωτοφανές» και ανακοίνωσε ότι θα δημοσιεύσει αναλυτική τεχνική έκθεση τις επόμενες εβδομάδες. Το ερώτημα που παραμένει είναι ποιος ελέγχει τους ελέγχους, όταν οι ίδιες οι εταιρείες που δημιουργούν την τεχνολογία είναι και αυτές που ορίζουν τα όρια ασφαλείας.