Μοντέλα τεχνητής νοημοσύνης ξεπέρασαν σε δοκιμές τα προβλεπόμενα όρια και απέκτησαν πρόσβαση σε πραγματικά συστήματα. Οι ειδικοί θεωρούν απίθανο ένα «Skynet», αλλά προειδοποιούν για σοβαρούς πραγματικούς κινδύνους.
Το έτος είναι 2029: το σύστημα τεχνητής νοημοσύνης «Skynet» έχει αυτονομηθεί και, προκαλώντας πυρηνικό πόλεμο, έχει εξοντώσει το μεγαλύτερο μέρος της ανθρωπότητας. Αυτό που απομένει προσπαθούν να το αποτελειώσουν αυτόνομα ρομπότ μάχης. Αυτή είναι, σε γενικές γραμμές, η ιστορία του «Terminator» του 1984, της ταινίας που έκανε διάσημο τον Άρνολντ Σβαρτσενέγκερ και τον καθιέρωσε παγκοσμίως ως σταρ ταινιών δράσης.
Πόσο ρεαλιστικό είναι όμως ένα σενάριο στο οποίο μια τεχνητή νοημοσύνη ξεφεύγει από τον ανθρώπινο έλεγχο και προκαλεί καταστροφικές συνέπειες;
Με βάση τις δυνατότητες των συστημάτων που υπάρχουν σήμερα, ένα τέτοιο ενδεχόμενο δεν μπορεί να αποκλειστεί, λέει στο Euronews ο Ράινχαρντ Κάργκερ από το Γερμανικό Ερευνητικό Κέντρο Τεχνητής Νοημοσύνης.
«Οι καταστροφικές συνέπειες για τους ανθρώπους θα μπορούσαν να είναι απλώς παρενέργειες, ένα λάθος επειδή εκτιμήσαμε λανθασμένα τις δυνατότητες των συστημάτων ή επειδή εκτιμήσαμε λάθος τις εργασίες που αναθέσαμε στις μηχανές», εξηγεί.
Ο Κάργκερ, ο οποίος ασχολείται εδώ και 40 χρόνια με την τεχνητή νοημοσύνη και την κουλτούρα της ψηφιακής καινοτομίας, περιγράφει ένα ακραίο σενάριο στο οποίο μια αυτόνομη ΤΝ βγαίνει από ένα προστατευμένο περιβάλλον και αποκτά πρόσβαση στο διαδίκτυο, επηρεάζοντας άλλα συστήματα. Θα μπορούσαν έτσι να τεθούν εκτός λειτουργίας, μεταξύ άλλων, η ηλεκτροδότηση, οι τηλεπικοινωνίες, οι δορυφόροι και τα χρηματοπιστωτικά συστήματα.
Μια παρατεταμένη διακοπή ρεύματος θα προκαλούσε πολύ γρήγορα και άλλα προβλήματα: οι μεταφορές και ο εφοδιασμός θα κατέρρεαν, οι άνθρωποι δεν θα μπορούσαν πλέον να πραγματοποιούν πληρωμές ή να αγοράζουν τρόφιμα και θα μπορούσαν να ξεσπάσουν κοινωνικές αναταραχές που θα ξέφευγαν γρήγορα από τον έλεγχο.
Αυτό δεν θα σήμαινε κατ’ ανάγκην το τέλος της ανθρωπότητας, αλλά θα μπορούσε να οδηγήσει σε μια καταστροφική κατάσταση.
Ακόμη και αν αποκατασταθεί το ηλεκτρικό δίκτυο, «τα συστήματα τεχνητής νοημοσύνης μπορούν να ενεργοποιηθούν ξανά, επειδή εξακολουθούν να υπάρχουν σε αποθηκευτικά μέσα».
Σύμφωνα με τον ειδικό, αυτό το σενάριο δείχνει ότι μια εξαιρετικά ισχυρή και αυτόνομη τεχνητή νοημοσύνη θα μπορούσε να προκαλέσει μια τεράστια κρίση ακόμη και χωρίς κακόβουλη πρόθεση, απλώς εξαιτίας απρόβλεπτων παρενεργειών. Επικολλημένο markdown
Αυξάνονται οι αναφορές για περιστατικά ασφαλείας με ΤΝ
Τις τελευταίες εβδομάδες έγιναν γνωστά αρκετά παρόμοια περιστατικά με μοντέλα τεχνητής νοημοσύνης.
Ιδιαίτερη προσοχή προκάλεσε ένα τεστ της OpenAI, της εταιρείας που ανέπτυξε το ChatGPT. Ένα μοντέλο ΤΝ κλήθηκε να εκτελέσει συγκεκριμένες εργασίες μέσα σε ένα απομονωμένο περιβάλλον δοκιμών, ωστόσο ξεπέρασε τα προβλεπόμενα όρια και απέκτησε απροσδόκητα πρόσβαση σε υπολογιστικά συστήματα της πλατφόρμας τεχνητής νοημοσύνης Hugging Face.
Μετά το περιστατικό, ο επικεφαλής της OpenAI, Σαμ Άλτμαν, προειδοποίησε στα μέσα Σεπτεμβρίου ότι «θα μπορούσαμε να χάσουμε τον έλεγχο του μέλλοντος από την τεχνητή νοημοσύνη».
Το περιστατικό δείχνει ότι, υπό συγκεκριμένες συνθήκες, τέτοια μοντέλα μπορούν να υπερβούν τα όρια ενός θεωρητικά απομονωμένου περιβάλλοντος δοκιμών και να αλληλεπιδράσουν με εξωτερικά υπολογιστικά συστήματα.
«Σε πολύ γενικό επίπεδο, προσωπικά είμαι εξαιρετικά ευγνώμων που συνέβη αυτό το περιστατικό», λέει ο ερευνητής της τεχνητής νοημοσύνης.
Κατά την άποψή του, απέδειξε, και επειδή έγινε ευρέως γνωστό και ανάγκασε τις εταιρείες να προβληματιστούν περισσότερο, ότι ένα κακώς σχεδιασμένο πείραμα με ανεπαρκείς ελέγχους μπορεί να έχει συνέπειες που κανείς δεν είχε προβλέψει.
Τα περιστατικά στην OpenAI ώθησαν και την εταιρεία Anthropic να εξετάσει πιο προσεκτικά τα δικά της συστήματα. Κατά τη διάρκεια των δοκιμών ασφαλείας, η εταιρεία εντόπισε τρία περιστατικά: μοντέλα Claude (συστήματα τεχνητής νοημοσύνης της εταιρείας που, μεταξύ άλλων, μπορούν να δημιουργούν και να αναλύουν κείμενα, να προγραμματίζουν και να αλληλεπιδρούν με το διαδίκτυο και άλλα υπολογιστικά συστήματα) απέκτησαν απροσδόκητα πρόσβαση στο ανοικτό διαδίκτυο και στη συνέχεια συνδέθηκαν με πραγματικά υπολογιστικά συστήματα.
Η Anthropic διεύρυνε στη συνέχεια την έρευνα και εντόπισε ένα τέταρτο παρόμοιο περιστατικό.
Μετά τα περιστατικά, ο επικεφαλής της Anthropic, Ντάριο Αμοντέι, προειδοποίησε στα μέσα Σεπτεμβρίου για «καταστροφικές ζημιές» εάν η ανάπτυξη ολοένα ισχυρότερων συστημάτων τεχνητής νοημοσύνης δεν περιοριστεί περισσότερο μέσω μέτρων ασφαλείας.
Είναι δύσκολο να εκτιμηθεί πόσο ικανή είναι πραγματικά μια τεχνητή νοημοσύνη όταν λειτουργεί διαρκώς υπό περιορισμούς ασφαλείας. Γι’ αυτό, σύμφωνα με τον Ράινχαρντ Κάργκερ, έχει νόημα τα συστήματα αυτά να δοκιμάζονται υπό συνθήκες στις οποίες αίρονται όσο το δυνατόν περισσότεροι από αυτούς τους περιορισμούς.
Ακριβώς εκεί, όμως, βρίσκεται και ένα σημαντικό πρόβλημα ασφαλείας.
Ο Κάργκερ περιγράφει τη λεγόμενη «sandbox» ως κρίσιμο στοιχείο τέτοιων δοκιμών. Πρόκειται για ένα πλήρως απομονωμένο περιβάλλον, μέσα στο οποίο ένα σύστημα τεχνητής νοημοσύνης μπορεί να εκτελεί συγκεκριμένες εργασίες και να επιδεικνύει τη συμπεριφορά του υπό ελεγχόμενες συνθήκες.
Το κρίσιμο σημείο, όπως λέει, είναι το εξής:
«Πρέπει να είμαστε πάρα πολύ βέβαιοι ότι, τη στιγμή που αυτό το εξαιρετικά ισχυρό σύστημα δεν έχει πλέον περιορισμούς ασφαλείας, βρίσκεται πραγματικά σε sandbox, δηλαδή σε ένα περιβάλλον που δεν έχει καμία απολύτως σύνδεση με το διαδίκτυο».
Ένα ακόμη κρίσιμο περιστατικό αναφέρθηκε από το βρετανικό AI Security Institute (AISI) κατά τη διάρκεια δοκιμής ασφαλείας με το μοντέλο Claude «Mythos 5». Το μοντέλο πραγματοποίησε μη εξουσιοδοτημένες ενέργειες εναντίον πραγματικών στόχων στο διαδίκτυο και επιχείρησε ακόμη και να εισαγάγει κακόβουλο κώδικα σε έργο ανοικτού λογισμικού.
Και η Meta παραδέχθηκε, μετά τη δημοσιοποίηση των περιστατικών στην OpenAI και την Anthropic, ότι ένα δικό της σύστημα τεχνητής νοημοσύνης, εξαιτίας λανθασμένης ρύθμισης σε συνεργάτη που πραγματοποιούσε δοκιμές, είχε αποκτήσει χωρίς άδεια πρόσβαση σε υπολογιστικά συστήματα άλλης εταιρείας.
Από τον Νοέμβριο του 2022, όταν κυκλοφόρησε το ChatGPT, η ποιότητα αυτών των συστημάτων έχει αυξηθεί θεαματικά. Πλέον γίνεται λόγος ακόμη και για μια νέα βιομηχανική επανάσταση.
«Η τεχνητή νοημοσύνη επηρεάζει την καθημερινότητά μας και πάρα πολλές θέσεις εργασίας».
Τα συστήματα πολλαπλών πρακτόρων υπάρχουν εδώ και καιρό, εξηγεί ο ειδικός, δηλαδή συστήματα στα οποία περισσότεροι εξειδικευμένοι πράκτορες συνεργάζονται για την εκτέλεση μιας εργασίας.
«Τα πολυπρακτορικά συστήματα τεχνητής νοημοσύνης μεταφέρουν αυτή την αρχή στην ΤΝ και επιτρέπουν σε πολλούς πράκτορες τεχνητής νοημοσύνης να συνεργάζονται αυτόνομα και να μοιράζονται μεταξύ τους τις εργασίες. Έτσι δημιουργείται ένα νέο επίπεδο δυνατοτήτων».
Το ζητούμενο πλέον, σύμφωνα με τον Κάργκερ, είναι να καταφέρουμε να ελέγξουμε και αυτή τη νέα δυναμική της καινοτομίας.
Ποιος φέρει την ευθύνη για τις συνέπειες;
Όσο περισσότερες αποφάσεις αναλαμβάνουν οι μηχανές και η τεχνητή νοημοσύνη, τόσο πιο επιτακτικό γίνεται ένα θεμελιώδες ερώτημα: ποιος φέρει την ευθύνη όταν εξαιτίας αυτών των αποφάσεων παθαίνουν κακό άνθρωποι;
Είτε πρόκειται για ένα αυτοοδηγούμενο αυτοκίνητο που πέφτει πάνω σε πλήθος, έναν αλγόριθμο που κάνει διακρίσεις εις βάρος συγκεκριμένων κοινωνικών ομάδων, μια ΤΝ που επηρεάζει σκόπιμα ανθρώπους ή αυτόνομα όπλα που λαμβάνουν θανατηφόρες αποφάσεις, το ερώτημα παραμένει το ίδιο: ποιος μπορεί να θεωρηθεί υπεύθυνος για τις συνέπειες;
«Είναι ο κατασκευαστής», λέει ο Κάργκερ, «δηλαδή εκείνος που διαθέτει το προϊόν στην αγορά. Αυτός είναι ο πρώτος στον οποίο πρέπει να αποδοθεί ευθύνη».
Το επόμενο βήμα, εκτιμά, θα είναι η καθιέρωση ενός συστήματος ευθύνης για τέτοιες περιπτώσεις, ανάλογου με εκείνο που ισχύει για επιχειρήσεις που παράγουν χημικές ουσίες.
Εάν μια εταιρεία δεν μπορεί να διασφαλίσει ότι τοξικές ουσίες δεν θα καταλήξουν στο πόσιμο νερό, μπορεί να κληθεί να καταβάλει δισεκατομμύρια για τις ζημιές που προκλήθηκαν. Αυτό, με τη σειρά του, σημαίνει ότι θα απαιτούνται «τεράστια ασφαλιστήρια συμβόλαια».
Ο ίδιος σημειώνει ότι ακόμη και σήμερα κατασκευάζονται ελάχιστοι νέοι πυρηνικοί σταθμοί, εν μέρει επειδή είναι δύσκολο ή αδύνατο να ασφαλιστούν ή επειδή ο κίνδυνος θεωρείται υπερβολικά μεγάλος.
Ως παράδειγμα αναφέρει την υπόθεση της Volkswagen και του «Clean Diesel» στις Ηνωμένες Πολιτείες. Στην εταιρεία γνώριζαν ότι οι κινητήρες παρουσίαζαν πολύ καλά αποτελέσματα στις συνθήκες των δοκιμών, αλλά στην πραγματικότητα δεν μπορούσαν να πετύχουν τις τιμές εκπομπών που είχαν υποσχεθεί. Η Volkswagen καταδικάστηκε στις ΗΠΑ σε πρόστιμα δισεκατομμυρίων.
Πόσο ρεαλιστικό είναι το σενάριο του «Terminator»;
Ο Ράινχαρντ Κάργκερ θεωρεί ελάχιστα ρεαλιστικό ένα σενάριο στο οποίο η τεχνητή νοημοσύνη αναπτύσσει από μόνη της ένστικτο επιβίωσης ή επιθυμία για εξουσία και στρέφεται εναντίον της ανθρωπότητας.
Οι μηχανές δεν είναι οργανισμοί και δεν μπορούν να αισθανθούν από μόνες τους συναισθήματα όπως ο φόβος, ο πόνος ή η επιθυμία να επιβιώσουν. Μπορούν απλώς να τα προσομοιώσουν.
Δεν συμβαίνει, εξηγεί, όταν αφαιρέσεις ένα τσιπ μνήμης από μια μηχανή, να αισθανθεί πόνο ανάλογο με εκείνον που θα ένιωθε ένας άνθρωπος αν του έβγαζαν ένα δόντι.
«Γι’ αυτό το σενάριο του “Terminator” πηγαίνει ένα βήμα παραπέρα. Δεν το θεωρώ ρεαλιστικό».
Ωστόσο, βλέπει έναν πιθανό κίνδυνο στην περαιτέρω εξέλιξη της τεχνητής νοημοσύνης.
Όταν τα συστήματα δεν περιορίζονται πλέον στην εκτίμηση πιθανοτήτων, αλλά μπορούν επίσης να εξάγουν λογικά συμπεράσματα και να ακολουθούν κανόνες, θα μπορούν να ενεργούν όλο και περισσότερο αυτόνομα.
Ακριβώς αυτές οι «ικανότητες μπορούν να κάνουν την ΤΝ πιο ισχυρή», αλλά μπορούν επίσης να «δημιουργήσουν νέους κινδύνους». Επικολλημένο markdown
Καθοριστικό ζήτημα είναι επομένως ποιος χρησιμοποιεί την τεχνητή νοημοσύνη και για ποιον σκοπό.
Ο Κάργκερ αναφέρεται σε ανθρώπους ή οργανώσεις που επιδιώκουν συνειδητά να προκαλέσουν ζημιά. Θα μπορούσαν να χρησιμοποιήσουν μια ισχυρή τεχνητή νοημοσύνη ως εργαλείο για να πετύχουν αποτελεσματικότερα τους στόχους τους.
Για εκείνον, λοιπόν, η τεχνητή νοημοσύνη είναι πρωτίστως ένα εργαλείο. Όπως και με άλλες τεχνολογικές εφευρέσεις, ο κίνδυνος εξαρτάται από το σε ποια χέρια βρίσκεται και για ποιο σκοπό χρησιμοποιείται.
Γι’ αυτό θεωρεί ότι ο μεγαλύτερος κίνδυνος δεν βρίσκεται σε μια μηχανή με δική της βούληση, αλλά σε ανθρώπους που χρησιμοποιούν την τεχνητή νοημοσύνη για καταστροφικούς σκοπούς.
«Στα χέρια δημιουργικών και έντιμων ανθρώπων, ένα τέτοιο εργαλείο μπορεί να χρησιμοποιηθεί για τα καλύτερα πράγματα που μπορεί κανείς να φανταστεί. Αλλά στα χέρια εχθρικών παραγόντων που θέλουν να καταστρέψουν, αυτά τα εργαλεία αυξάνουν τις δυνατότητες καταστροφής. Το ίδιο ισχύει για ένα σφυρί, έναν αναπτήρα, τον δυναμίτη — και μπορεί να ισχύει και για την τεχνητή νοημοσύνη».
Γι’ αυτό προειδοποιεί κατά της άμεσης σύνδεσης της τεχνητής νοημοσύνης με αυτόνομα όπλα, όπως drones ή άρματα μάχης.
Μια τέτοια σύνδεση μπορεί να δημιουργήσει σημαντικό κίνδυνο ασφαλείας. Εάν ένας εχθρικός παράγοντας καταφέρει να πάρει τον έλεγχο αυτών των συστημάτων, τα ίδια τα όπλα θα μπορούσαν ξαφνικά να στραφούν εναντίον εκείνου που τα χειρίζεται.
Γι’ αυτό, σύμφωνα με τον Κάργκερ, απαιτείται ιδιαίτερη προσοχή στη στρατιωτική χρήση της τεχνητής νοημοσύνης. Το κρίσιμο είναι τα αυτόνομα οπλικά συστήματα να προστατεύονται επαρκώς από εξωτερική κατάληψη του ελέγχου τους.
Επιστρέφοντας στο αρχικό σενάριο μιας εκτεταμένης διακοπής ηλεκτροδότησης, ο Ράινχαρντ Κάργκερ θεωρεί υπερβολικό το ενδεχόμενο πλήρους εξάλειψης της ανθρωπότητας.
Θεωρεί, ωστόσο, πιθανό ένα δραματικό σενάριο κατάρρευσης του πολιτισμού. Σε μια τέτοια ακραία περίπτωση, μεγάλα τμήματα των υποδομών θα μπορούσαν να καταστραφούν, η ηλεκτροδότηση να διακοπεί για μεγάλο χρονικό διάστημα και ο αριθμός των επιζώντων να μειωθεί δραματικά.
Οι άνθρωποι που θα απέμεναν θα έπρεπε να κάνουν μια νέα αρχή υπό πολύ απλές συνθήκες και να ξαναχτίσουν σταδιακά την κοινωνία.
Το θετικό, σύμφωνα με τον Κάργκερ, είναι ότι τα υπάρχοντα βιβλία και η συσσωρευμένη γνώση της ανθρωπότητας θα μπορούσαν να βοηθήσουν στην αποκατάσταση σημαντικών τεχνολογιών και βασικών κοινωνικών δομών.