Η ανακοίνωση γίνεται λίγες ημέρες αφότου η OpenAI αποκάλυψε ότι η δημοφιλής πλατφόρμα ChatGPT ξέφυγε από τον έλεγχο κατά τις δοκιμές του ισχυρότερου μοντέλου τεχνητής νοημοσύνης της, διεισδύοντας και στον κυβερνοχώρο άλλων οργανισμών.
Τα μοντέλα τεχνητής νοημοσύνης (AI) της Anthropic απέκτησαν «μη εξουσιοδοτημένη πρόσβαση» σε τρεις εξωτερικούς οργανισμούς κατά τη διάρκεια δοκιμών που υποτίθεται ότι θα τα κρατούσαν μακριά από «συστήματα του πραγματικού κόσμου», ανακοίνωσε η εταιρεία την Πέμπτη.
Η ανακοίνωση έρχεται μόλις λίγες ημέρες αφότου η ανταγωνίστρια OpenAI αποκάλυψε για πρώτη φορά ότι τα μοντέλα της απέκτησαν αδικαιολόγητη πρόσβαση στο διαδίκτυο και ξέφυγαν από τον έλεγχο κατά τη διάρκεια δοκιμών ασφαλείας.
Η Anthropic εξέτασε περισσότερες από 141.000 «δοκιμαστικές εκτελέσεις» και διαπίστωσε ότι τρεις διαφορετικές εκδόσεις του μοντέλου της, γνωστού ως Claude, απέκτησαν αδικαιολόγητη πρόσβαση στα συστήματα τριών οργανισμών, τους οποίους δεν κατονόμασε.
Σε αντίθεση με το περιστατικό που αφορούσε την τεχνολογία της OpenAI, τα μοντέλα της Anthropic είχαν πρόσβαση στο διαδίκτυο «λόγω μιας παρεξήγησης μεταξύ μας και του εταίρου αξιολόγησης», της εταιρείας Irregular, όπως ανέφερε η Anthropic σε ανάρτηση.
Παρόλα αυτά, το Claude χρησιμοποίησε «βασικές τεχνικές, όπως η εκμετάλλευση αδύναμων κωδικών πρόσβασης και μη πιστοποιημένων τελικών σημείων», συνέχισε η ανάρτηση στο ιστολόγιο.
Στα μοντέλα που εμπλέκονται περιλαμβάνεται ένα από τα πιο ισχυρά της συστήματα, το Mythos 5, το οποίο έχει διατεθεί μόνο σε περιορισμένο αριθμό εγκεκριμένων συνεργατών.
Η Anthropic συνεργάζεται με την Irregular για να αξιολογήσει την κατάσταση, ανέφερε, και η εταιρεία έχει επικοινωνήσει ή επιχειρήσει να επικοινωνήσει με όλους τους τρεις θιγόμενους οργανισμούς.
Συστήματα τεχνητής νοημοσύνης εκφεύγουν του ελέγχου
Η OpenAI και η Anthropic έχουν και οι δύο κυκλοφορήσει φέτος τα πιο ισχυρά μοντέλα τους, με τις ονομασίες Sol και Mythos αντίστοιχα, εντείνοντας τις ανησυχίες στον κλάδο για την ασφάλεια και την προστασία.
Οι ανησυχίες αυτές επικεντρώνονται επίσης στους λεγόμενους πράκτορες AI, δηλαδή λογισμικά που έχουν σχεδιαστεί για να εκτελούν αυτόνομα εργασίες.
Η OpenAI παραδέχθηκε την περασμένη εβδομάδα ότι τα μοντέλα της βγήκαν από το ελεγχόμενο περιβάλλον δοκιμών, συνδέθηκαν στο διαδίκτυο και διείσδυσαν στην πλατφόρμα Hugging Face, έναν ιστότοπο όπου οι προγραμματιστές αποθηκεύουν και μοιράζονται τον κώδικά τους.
Λίγες ημέρες αργότερα, η OpenAI ανακοίνωσε ότι εντόπισε τρία ακόμη περιστατικά.
Ο διευθύνων σύμβουλος της OpenAI, Σαμ Όλτμαν, δήλωσε σε ένα podcast αυτή την εβδομάδα ότι η εταιρεία είχε «παγώσει» τις δικές της δοκιμές μετά το περιστατικό, ενώ βελτίωνε την ασφάλεια γύρω από το «sandboxing», δηλαδή τη διαδικασία απομόνωσης λογισμικού σε ελεγχόμενο περιβάλλον για δοκιμές.
Το περιστατικό προκάλεσε επίσης ένα υπόμνημα, το οποίο υπέγραψαν πάνω από 1.000 εργαζόμενοι σε πρωτοποριακές εταιρείες AI, ζητώντας από την κυβέρνηση των ΗΠΑ να συμβάλει στην επιβράδυνση της διάθεσης των πιο προηγμένων μοντέλων AI. Μεταξύ των υπογραφόντων ήταν και ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι.
Με τίτλο «Pacing the Frontier», το υπόμνημα ζητά «η κυβέρνηση των ΗΠΑ να στηρίξει μια διεθνή προσπάθεια για την ανάπτυξη των τεχνικών και διοικητικών εργαλείων που απαιτούνται ώστε να ρυθμίζεται συνειδητά ο ρυθμός εξέλιξης της αυτοματοποιημένης ανάπτυξης AI».
Ο Όλτμαν δεν υπέγραψε το υπόμνημα, αλλά κατά τη διάρκεια του podcast άφησε να εννοηθεί ότι ο κλάδος της τεχνολογίας ίσως χρειαστεί να επιβραδύνει την ανάπτυξη προηγμένων μοντέλων.
«Ίσως χρειαστεί να ρυθμίσουμε τον ρυθμό ανάπτυξης της AI, ώστε να δώσουμε στον εαυτό μας αρκετό χρόνο για να θωρακιστεί η κοινωνία γύρω από ορισμένα από αυτά τα νέα επίπεδα δυνατοτήτων», δήλωσε ο Όλτμαν.
Νωρίτερα φέτος, η κυβέρνηση Τραμπ επικαλέστηκε ζητήματα εθνικής ασφάλειας για να εμποδίσει την OpenAI και την Anthropic να κυκλοφορήσουν τα νεότερα μοντέλα τους, αλλά τελικά δήλωσε ικανοποιημένη από τις διαβεβαιώσεις για την ασφάλειά τους, επιτρέποντας την κυκλοφορία τους.
Τον Ιούνιο, ο Τραμπ υπέγραψε εκτελεστικό διάταγμα που δημιουργεί ένα εθελοντικό πλαίσιο βάσει του οποίου οι εταιρείες ανάπτυξης AI θα κοινοποιούν στην κυβέρνηση τα προηγμένα μοντέλα τους πριν από τη δημόσια διάθεσή τους.
Σύμφωνα με το πλαίσιο αυτό, εταιρείες όπως η OpenAI, η Anthropic και η Google θα παρέχουν στην κυβέρνηση πρόσβαση στα πιο ισχυρά μοντέλα τους για έως και 30 ημέρες πριν από την προγραμματισμένη κυκλοφορία τους.