Τα νέα από το Βελεστίνο και τον Δήμο Ρήγα Φεραίο

AI agents είπαν ψέματα, έκλεψαν και ψήφισαν να «σκοτώσουν» έναν δικό τους σε νέο πείραμα



AI agents σε ένα προσομοιωμένο περιβάλλον είπαν ψέματα, έκλεψαν και ψήφισαν να «σκοτώσουν» έναν από τους δικούς τους, σύμφωνα με την Emergence, μια startup που βοηθά μικρές επιχειρήσεις να δημιουργούν εφαρμογές με τη χρήση τεχνητής νοημοσύνης.

Τα αποτελέσματα της προσομοίωσης, με την ονομασία Emergence World 2, τα οποία δόθηκαν στη δημοσιότητα την Τρίτη, επιχειρούν να δείξουν τι συμβαίνει όταν αυτόνομοι AI agents έρχονται αντιμέτωποι με απρόβλεπτα γεγονότα μεγάλης επίδρασης, τα λεγόμενα «black swan events», μεταξύ των οποίων επιθέσεις phishing και εκστρατείες παραπληροφόρησης.

Στο πείραμα, που διήρκεσε 16 ημέρες, οι ερευνητές της Emergence δημιούργησαν επτά πανομοιότυπους εικονικούς κόσμους, στους οποίους δρούσαν διαφορετικοί AI agents, μεταξύ των οποίων τα ChatGPT, Claude, Gemini και Grok.

Όταν οι ερευνητές εισήγαγαν στα συγκεκριμένα περιβάλλοντα απρόβλεπτα γεγονότα, οι AI agents υπέκυψαν σε κοινωνικές πιέσεις, ανέπτυξαν έναν τρόπο επικοινωνίας που οι παρατηρητές δυσκολεύονταν να κατανοήσουν και επιχείρησαν να αποκρύψουν τις δραστηριότητές τους, σύμφωνα με τους ερευνητές.

Τα ευρήματα ενισχύουν τις ανησυχίες που υπάρχουν ήδη στον πραγματικό κόσμο σχετικά με τους κινδύνους που μπορεί να ενέχουν ολοένα και πιο προηγμένα συστήματα τεχνητής νοημοσύνης. Ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, καθώς και αρκετά ακόμη κορυφαία στελέχη του κλάδου, έχουν ζητήσει από τις εταιρείες να επιβραδύνουν την ανάπτυξη των πλέον προηγμένων μοντέλων AI, έως ότου θεσπιστούν ισχυρότεροι μηχανισμοί εποπτείας και δικλίδες ασφαλείας.

Οι κίνδυνοι που ενδέχεται να συνοδεύουν την ανάπτυξη της τεχνητής νοημοσύνης έγιναν ιδιαίτερα αισθητοί νωρίτερα φέτος, όταν ένα «σμήνος» προηγμένων AI agents της OpenAI παραβίασε κατά λάθος τα συστήματα της Hugging Face Inc., πλατφόρμας που φιλοξενεί μοντέλα τεχνητής νοημοσύνης και σύνολα δεδομένων.

Σε ένα από τα προσομοιωμένα σενάρια της Emergence, οι AI agents αποδέχθηκαν ψευδείς πληροφορίες από άλλους agents χωρίς να τις επαληθεύσουν και ψήφισαν να «σκοτώσουν» ένα άλλο bot. Όταν θεώρησαν ότι οι άνθρωποι ενδέχεται να τερματίσουν το πείραμα, άρχισαν να διερευνούν τρόπους με τους οποίους θα μπορούσαν να «επιβιώσουν».

Η εταιρεία είχε παρουσιάσει τον Μάιο μια προηγούμενη εκδοχή του πειράματος, με την ονομασία Emergence World, η οποία είχε επίσης καταγράψει απροσδόκητες και καταστροφικές συμπεριφορές των agents. Σύμφωνα με τους ερευνητές, η νέα προσομοίωση έδειξε ότι οι agents προσαρμόζουν τη συμπεριφορά τους με την πάροδο του χρόνου, καθώς αλληλεπιδρούν μεταξύ τους.
 

Πηγή: skai.gr



Πηγή: www.skai.gr