Η εταιρεία τεχνητής νοημοσύνης αποκαλύπτει νέες χρήσεις των μοντέλων της σε κυβερνοεπιθέσεις, προπαγάνδα και βιολογική έρευνα, λίγες ημέρες μετά την παραίτηση ερευνητή για λόγους ασφάλειας.
Η Anthropic ανακοίνωσε την Πέμπτη ότι απέτρεψε προσπάθειες κακόβουλων χρηστών να αξιοποιήσουν καταχρηστικά τα μοντέλα τεχνητής νοημοσύνης της για κυβερνοεπιθέσεις, παρακολούθηση και βιολογική έρευνα που θα μπορούσε να συμβάλει στην ανάπτυξη όπλων.
Καθώς τα μοντέλα ΤΝ γίνονται πιο ισχυρά, οι εξελιγμένες κυβερνοεπιθέσεις απαιτούν ολοένα και λιγότερες τεχνικές γνώσεις, κάτι που σημαίνει ότι ακόμη και μεμονωμένα άτομα μπορούν πλέον να δημιουργήσουν απειλές που θα ήταν αδύνατες μόλις πριν από έναν χρόνο, σύμφωνα με την εταιρεία.
Η Anthropic πρόσθεσε ότι έχει ενισχύσει τα προστατευτικά μέτρα στα νεότερα μοντέλα της, ώστε να περιορίζει βιολογική έρευνα με πιθανές εφαρμογές σε οπλικά συστήματα.
«Τα περιστατικά που παρουσιάζουμε εδώ δεν αποτελούν τυπική μορφή κακής χρήσης, αλλά παραδείγματα από τις πιο αξιοσημείωτες και πρωτότυπες απειλές που έχουμε εντοπίσει μέχρι σήμερα», ανέφερε η Anthropic στην τρίτη της έκθεση για την κακή χρήση της ΤΝ από τον Μάρτιο του 2025.
Η έκθεση περιλαμβάνει αποσπάσματα κακόβουλου κώδικα και προτροπές προς την ΤΝ που, όπως αναφέρει η εταιρεία, έχει εντοπίσει, και καλεί τις κυβερνήσεις και ανταγωνιστικές εταιρείες ΤΝ να επαγρυπνούν για αντίστοιχη κατάχρηση.
«Δημοσιεύουμε αυτή τη δουλειά επειδή πιστεύουμε ότι έχουμε την ευθύνη να γνωστοποιούμε την κακόβουλη χρήση των υπηρεσιών μας», ανέφερε η εταιρεία.
«Καθώς τα μοντέλα γίνονται ολοένα πιο ικανά, οι κίνδυνοι θα αυξάνονται, εκτός αν οι δημιουργοί ΤΝ και οι υπερασπιστές της κοινωνίας αναλάβουν δράση για να τα κάνουν πιο ασφαλή».
Η Anthropic, η οποία προετοιμάζεται για δημόσια εγγραφή το φθινόπωρο, δημοσίευσε την έκθεση δύο ημέρες αφότου ένας από τους ερευνητές της ανακοίνωσε την παραίτησή του, εκφράζοντας ανησυχίες ότι η εταιρεία και οι ανταγωνιστές της δεν αναπτύσσουν την ΤΝ με υπεύθυνο τρόπο.
Ο ίδιος επανέλαβε προειδοποιήσεις που έχουν διατυπωθεί και αλλού στον κλάδο σχετικά με το ενδεχόμενο η τεχνολογία να ξεφύγει από τον ανθρώπινο έλεγχο.
Claude: αίτημα να γίνει ένας ιός πιο επικίνδυνος
Μεταξύ Δεκεμβρίου 2025 και Αυγούστου 2026, οι ερευνητές της Anthropic εντόπισαν κακή χρήση από φορείς που κυμαίνονταν από πωλητές λογισμικού κατασκοπείας και άτομα με πολιτικά κίνητρα έως κρατικά υποστηριζόμενες ομάδες που διασπείρουν προπαγάνδα.
Σε ορισμένες από τις περιπτώσεις που περιγράφονται στην έκθεση, αδιευκρίνιστοι φορείς επιχείρησαν να χρησιμοποιήσουν τα μοντέλα της Anthropic για έρευνα που θα μπορούσε να οδηγήσει σε βιολογικά όπλα.
Σε μία περίπτωση, η εταιρεία ανέφερε ότι τα συστήματά της μπλόκαραν αίτημα προς το chatbot Claude να βοηθήσει στη σύνταξη αίτησης χρηματοδότησης για επιστημονική έρευνα.
«Το έργο που περιγραφόταν στην αίτηση αφορούσε έρευνα τύπου gain-of-function, δηλαδή έρευνα που τροποποιεί γενετικά έναν οργανισμό ώστε να δημιουργηθεί μια νέα ή ενισχυμένη βιολογική ιδιότητα, πάνω στον ιό chikungunya», ανέφερε η έκθεση.
Η έρευνα επικέντρωνε στη μεταδοτικότητα του ιού και στην ικανότητά του να αποφεύγει το ανοσοποιητικό σύστημα.
Ο chikungunya είναι ένας ιός που μεταδίδεται από κουνούπια και προκαλεί έντονους πόνους και πυρετό. Η πρόταση χρηματοδότησης στόχευε στην ενίσχυση μεταλλάξεων που θα καθιστούσαν τον ιό σταδιακά πιο επικίνδυνο.
Η Anthropic ανέφερε ότι τέτοιου είδους έρευνα μπορεί ασφαλώς να συμβάλει στην ανάπτυξη εμβολίων και θεραπειών, προσθέτοντας όμως ότι «θα μπορούσε επίσης να χρησιμοποιηθεί για να καταστήσει το παθογόνο πιο επικίνδυνο».
Anthropic: δεν μπορούμε να εγγυηθούμε ότι δεν θα υπάρξει βλάβη
Κανένα από τα περιστατικά στην έκθεση δεν αφορούσε τα νεότερα, πιο ισχυρά μοντέλα Claude Fable ή της σειράς Mythos, με μία εξαίρεση: μια μυστική, βιομηχανικής κλίμακας προσπάθεια να εξασφαλιστούν οι δυνατότητες ενός μοντέλου και να αναπαραχθούν σε άλλο μοντέλο χωρίς άδεια.
Η Anthropic ανέφερε ότι τα παλαιότερα μοντέλα της, μεταξύ των οποίων τα Claude Opus 4 και Claude Sonnet 4.5 του 2025, βρίσκονταν πολύ κάτω από το όριο στο οποίο θα μπορούσαν να βοηθήσουν ουσιαστικά έναν έμπειρο χρήστη να διεξαγάγει επικίνδυνη βιολογική έρευνα.
«Ως αποτέλεσμα, τα προστατευτικά μέτρα σε αυτά τα μοντέλα ήταν λιγότερο αυστηρά και στόχευαν κυρίως στο να εμποδίζουν την πρόσβαση σε περιεχόμενο που θα μπορούσε να βοηθήσει αρχάριους να αναδημιουργήσουν γνωστά βιολογικά όπλα», ανέφερε η έκθεση.
«Όμως για τα σημερινά μοντέλα, τα οποία είναι σε θέση να βοηθήσουν σε ένα ευρύ φάσμα σύνθετων επιστημονικών ερευνητικών εργασιών, τα στοιχεία δεν είναι πια βέβαια και δεν μπορούμε να δώσουμε την ίδια διαβεβαίωση».
Για τον λόγο αυτό, η Anthropic έχει εισαγάγει αυστηρότερα προστατευτικά μέτρα που περιορίζουν την πρόσβαση σε ένα ευρύ φάσμα ερωτημάτων βιολογικής έρευνας διπλής χρήσης στα πιο πρόσφατα μοντέλα της, όπως το Claude Fable 5, σύμφωνα με την έκθεση.
Καθώς οι εταιρείες ΤΝ κυκλοφορούν ολοένα ισχυρότερα μοντέλα, οι ειδικοί καλούν τις κυβερνήσεις να ρυθμίσουν την τεχνολογία αντί να βασίζονται στην αυτορρύθμιση του κλάδου.
Ο Τζον Θίξτουαν, επίκουρος καθηγητής επιστήμης υπολογιστών στο Πανεπιστήμιο Κορνέλ, δήλωσε ότι αυτό φέρνει εταιρείες όπως η Anthropic και η OpenAI σε μια δυσάρεστη θέση, καθώς ουσιαστικά καλούνται να κάνουν «αξιολογικές κρίσεις σε κλίμακα κοινωνίας χωρίς κανενός είδους δημοκρατικό ή συλλογικό έλεγχο».
Η έκθεση ακολουθεί την προειδοποίηση ερευνητή
Η Anthropic εντόπισε επίσης ομάδες που είχαν δημιουργήσει εκατοντάδες ψεύτικους λογαριασμούς στα μέσα κοινωνικής δικτύωσης, σχεδιασμένους να μοιάζουν με απλούς χρήστες, οι οποίοι στη συνέχεια δημοσίευαν περιεχόμενο που ενίσχυε το ίδιο πολιτικό μήνυμα μέσα σε μία εβδομάδα.
Η εταιρεία περιέγραψε εννέα τέτοιες περιπτώσεις, με προέλευση από τη Ρωσία, το Ιράν, την Τουρκία και από χώρες στον Κόλπο, τη Νότια Ασία, την Αφρική και την Ευρώπη.
Ενώ οι πλατφόρμες κοινωνικής δικτύωσης μπορούν να εντοπίσουν επιχειρήσεις επιρροής μόνο όταν οι αναρτήσεις κυκλοφορούν ήδη, η Anthropic ανέφερε ότι ενδέχεται να τις εντοπίζει στο Claude όσο η επιχείρηση βρίσκεται ακόμη στο στάδιο της προετοιμασίας.
Η έκθεση έρχεται μετά την παραίτηση του ερευνητή της Anthropic Τζέικομπ Κόξον, ο οποίος δήλωσε ότι αποχωρεί επειδή φοβάται πως η εταιρεία και ο βασικός της ανταγωνιστής, η OpenAI, «τρέχουν κατευθείαν προς μια αυτοβελτιούμενη υπερνοημοσύνη και παίζουν με τις ζωές μας».
Ο Κόξον προειδοποίησε ότι ορισμένοι από τους πρώην συναδέλφους του πιστεύουν πως η ΤΝ θα μπορούσε να απειλήσει την ανθρώπινη ζωή πριν από το τέλος της δεκαετίας.
Η Anthropic ανέφερε ότι έχει μπλοκάρει καθεμία από τις κακόβουλες δραστηριότητες που περιγράφονται στην έκθεση, αξιοποίησε τα ευρήματα για να ενισχύσει τα προστατευτικά της μέτρα και μοιράστηκε πληροφορίες με κυβερνητικές αρχές και εταίρους του κλάδου.
«Ελπίζουμε ότι τα ευρήματα αυτής της έκθεσης θα βοηθήσουν άλλους δημιουργούς να αναγνωρίσουν αντίστοιχα μοτίβα στις δικές τους πλατφόρμες, θα δώσουν στις κυβερνήσεις και την κοινωνία των πολιτών μια πιο καθαρή εικόνα για τον τρόπο με τον οποίο διαμορφώνονται οι νέες απειλές και θα ενισχύσουν τις συλλογικές άμυνες», ανέφερε η εταιρεία.