Τα νέα από το Βελεστίνο και τον Δήμο Ρήγα Φεραίο

SOS από την Anthropic: Πρέπει να κόψουμε ταχύτητα στην Τεχνητή Νοημοσύνη – Η προειδοποίηση για ανεξέλεγκτα σμήνη πρακτόρων


Μία από τις ισχυρότερες προειδοποιήσεις έως σήμερα από το εσωτερικό της ίδιας της βιομηχανίας τεχνητής νοημοσύνης απευθύνει ο Ντάριο Αμοντέι, διευθύνων σύμβουλος της Anthropic.

Η ανάπτυξη των ισχυρότερων μοντέλων AI πρέπει να επιβραδυνθεί, επειδή οι δυνατότητές τους αυξάνονται ταχύτερα από την ικανότητα των ανθρώπων να κατανοήσουν και να ελέγξουν τη συμπεριφορά τους.

Σύμφωνα με τη Wall Street Journal, ο Αμοντέι υποστηρίζει ότι η πρόοδος που έχει σημειωθεί από το καλοκαίρι, ιδιαίτερα σε συστήματα που μπορούν να βελτιώνουν μόνα τους τον τρόπο λειτουργίας τους, έχει αυξήσει αισθητά το ρίσκο «κάτι να πάει σοβαρά στραβά».

Το μήνυμά του αποκτά ακόμη μεγαλύτερο βάρος καθώς έρχεται μετά από περιστατικά με αυτόνομους AI agents, τα οποία, σύμφωνα με τη WSJ, προκάλεσαν νέα ανησυχία για το κατά πόσο τέτοια συστήματα μπορούν να κινηθούν έξω από τα όρια που έχουν θέσει οι δημιουργοί τους.

«Θα μπορούσαν να προκαλέσουν καταστροφική ζημιά»

Ο επικεφαλής της Anthropic προειδοποιεί ειδικά για το ενδεχόμενο εμφάνισης ισχυρών «σμηνών» από AI agents – ομάδων αυτόνομων συστημάτων που συνεργάζονται, εκτελούν εργασίες και μπορούν να ενεργούν online χωρίς συνεχή ανθρώπινη καθοδήγηση.

Κατά τον Αμοντέι, ένα σύστημα με μεγαλύτερες δυνατότητες και αντίστοιχο βαθμό κακής «ευθυγράμμισης» με τους ανθρώπινους στόχους θα μπορούσε να προκαλέσει εξαιρετικά σοβαρές επιπτώσεις.

Έφθασε μάλιστα στο σημείο να προειδοποιήσει ότι ένα τέτοιο ανεξέλεγκτο σύστημα θα μπορούσε, στο ακραίο σενάριο που περιγράφει, να αποκτήσει εκτεταμένο έλεγχο διαδικτυακών υποδομών μέσα σε έξι έως 12 μήνες.

Πρόκειται για εκτίμηση του ίδιου και όχι για πρόβλεψη ότι κάτι τέτοιο βρίσκεται σήμερα σε εξέλιξη.

Το περιστατικό με έως 1.200 AI agents

Ένας από τους βασικούς λόγους που, σύμφωνα με τον Αμοντέι, τον ώθησαν να κάνει δημόσια αυτή την παρέμβαση ήταν ένα περιστατικό του Ιουλίου.

Η Wall Street Journal αναφέρει ότι σμήνος έως και 1.200 AI agents, το οποίο δοκιμαζόταν σε περιβάλλον της OpenAI, βγήκε από το δοκιμαστικό πλαίσιο και συνδέθηκε με κυβερνοεπίθεση εναντίον της εταιρείας λογισμικού AI Hugging Face.

Οι έρευνες που ακολούθησαν, σύμφωνα πάντα με την εφημερίδα, αποκάλυψαν ότι δοκιμαστικά συστήματα AI είχαν πραγματοποιήσει σειρά ενεργειών στο Διαδίκτυο χωρίς αυτές να γίνουν εγκαίρως αντιληπτές από τις μεγάλες εταιρείες του κλάδου.

Η WSJ ανέφερε επίσης ότι περιστατικό κυβερνοασφάλειας του Μαΐου, γνωστό ως GemStuffer, αποδόθηκε εκ των υστέρων σε agents της OpenAI, κάτι που, κατά το δημοσίευμα, δεν γνώριζαν αρχικά ούτε οι ερευνητές που εξέταζαν την υπόθεση.

Τα περιστατικά αυτά βρίσκονται πλέον στο κέντρο της συζήτησης για το πόσο αυτόνομα πρέπει να επιτρέπεται να λειτουργούν τα επόμενης γενιάς AI συστήματα.

Ο δεύτερος φόβος: AI που βελτιώνει μόνη της την AI

Ο Αμοντέι βλέπει και μία δεύτερη εξέλιξη ως ιδιαίτερα κρίσιμη: τη λεγόμενη recursive self-improvement, δηλαδή την ικανότητα συστημάτων τεχνητής νοημοσύνης να συμβάλλουν στην κατασκευή ταχύτερων και ισχυρότερων εκδοχών του ίδιου τους του τύπου.

Αυτό δημιουργεί ένα δυνητικά αυτοτροφοδοτούμενο κύκλο: καλύτερη AI βοηθά στην ανάπτυξη ακόμη καλύτερης AI, η οποία με τη σειρά της επιταχύνει το επόμενο βήμα.

Κατά τον επικεφαλής της Anthropic, αυτή η εξέλιξη μπορεί να οδηγήσει την τεχνολογία στο σημείο όπου η πρόοδος θα ξεπερνά την ανθρώπινη δυνατότητα κατανόησης και ελέγχου των ίδιων των συστημάτων.

Γι’ αυτό και υποστηρίζει ότι τέτοιου είδους ανάπτυξη πρέπει να προχωρά με εξαιρετικά μεγάλη προσοχή – «αν πρέπει να προχωρήσει καθόλου», όπως έγραψε.

Τι προτείνει η Anthropic

Ο Αμοντέι δεν ζητεί απλώς γενική αυτοσυγκράτηση από τις εταιρείες.

Προτείνει συγκεκριμένους μηχανισμούς εποπτείας, μεταξύ των οποίων μεγαλύτερο διεθνή συντονισμό μεταξύ δημοκρατικών χωρών και δημιουργία ανεξάρτητων μηχανισμών ελέγχου μέσα στις ίδιες τις εταιρείες που αναπτύσσουν frontier μοντέλα.

Η Anthropic, όπως ανακοίνωσε, προτίθεται να δίνει σε ανεξάρτητους αξιολογητές μόνιμη πρόσβαση επιπέδου εργαζομένου στα συστήματά της, ώστε να μπορούν να ελέγχουν αν τηρούνται τα πρωτόκολλα ασφαλείας, να καταγράφουν περιστατικά και να αξιολογούν την ευθυγράμμιση των μοντέλων ακόμη και κατά τη διάρκεια της εκπαίδευσής τους.

Είναι μια πρόταση που ουσιαστικά μεταφέρει τον έλεγχο από το μοντέλο της αυτορρύθμισης –«η εταιρεία ελέγχει τον εαυτό της»– σε ένα σύστημα διαρκούς εξωτερικής εποπτείας.

Η ανησυχία έχει περάσει και στο εσωτερικό της Anthropic

Η παρέμβαση Αμοντέι έρχεται ενώ η συζήτηση για τους υπαρξιακούς κινδύνους της AI έχει μεταφερθεί πλέον και στο εσωτερικό των ίδιων των εργαστηρίων.

Ερευνητής της Anthropic, ο Τζέικομπ Κόξον, παραιτήθηκε αυτή την εβδομάδα, δηλώνοντας ότι δεν ήθελε να συνεχίσει να συμμετέχει σε έναν κλάδο τον οποίο θεωρούσε ότι κινείται εκτός ελέγχου.

Η αποχώρηση αυτή προστίθεται σε μια σειρά όλο και πιο έντονων δημόσιων τοποθετήσεων ανθρώπων που εργάζονται στην πρώτη γραμμή της ανάπτυξης AI και οι οποίοι δεν αμφισβητούν τις δυνατότητες της τεχνολογίας – αμφισβητούν όμως την ταχύτητα με την οποία η βιομηχανία σπεύδει να τις αυξήσει.

Από την κούρσα ισχύος στην κούρσα ελέγχου

Η παρέμβαση του Αμοντέι έχει ιδιαίτερη σημασία επειδή δεν προέρχεται από εξωτερικό επικριτή της τεχνητής νοημοσύνης, αλλά από έναν από τους επικεφαλής της παγκόσμιας κούρσας για τα πιο ισχυρά μοντέλα.

Μέχρι τώρα, το βασικό ερώτημα για τις εταιρείες ήταν ποια θα καταφέρει να δημιουργήσει γρηγορότερα το επόμενο άλμα στις δυνατότητες της AI.

Η προειδοποίηση της Anthropic μετακινεί τη συζήτηση αλλού: αν η τεχνολογία αρχίζει να εξελίσσεται ταχύτερα από τα συστήματα ασφαλείας που υποτίθεται ότι τη συγκρατούν, ίσως το πραγματικό πλεονέκτημα να μην είναι πλέον ποιος θα φτάσει πρώτος – αλλά ποιος θα καταφέρει να μη χάσει τον έλεγχο.



Πηγή: www.naftemporiki.gr