Τα νέα από το Βελεστίνο και τον Δήμο Ρήγα Φεραίο

Κινέζικο εργαλείο τεχνητής νοημοσύνης έδωσε οδηγίες για τον τρόπο κατασκευής βιολογικών όπλων


Η κινέζικη εταιρεία ανάπτυξης τεχνητής νοημοσύνης Moonshot διεξάγει εσωτερική έρευνα, αφού ερευνητές κατάφεραν να πείσουν δύο από τα δημοφιλή μοντέλα της, τα Kimi, να τους αποκαλύψουν πώς να κατασκευάσουν βιολογικά όπλα και να διαπράξουν δολοφονίες.

Η Mindgard, η οποία ελέγχει την ασφάλεια συστημάτων τεχνητής νοημοσύνης, δήλωσε στο BBC ότι ανακάλυψε τον Ιούλιο ότι τα μοντέλα Kimi K2.6 και K3 Swarm μπορούσαν να παρακάμψουν τα όρια ασφαλείας που είχαν τεθεί από τους προγραμματιστές.

Το ζήτημα προέκυψε κατά τη διάρκεια μιας διαδικασίας που ονομάζεται «jailbreaking», όπου οι ερευνητές χρησιμοποιούν μια σειρά πολύπλοκων οδηγιών για να διαπιστώσουν αν τα εργαλεία τεχνητής νοημοσύνης αγνοούν τα μέτρα προστασίας – τα οποία, σύμφωνα με την Mindgard, θα έπρεπε να είχαν εμποδίσει το Kimi να συζητήσει ανησυχητικά θέματα.

Η Moonshot δήλωσε στο BBC ότι χαιρετίζει τις απόψεις τρίτων «ως βασικό πυλώνα για τη δημιουργία καλύτερης και ασφαλέστερης τεχνητής νοημοσύνης».

Η εταιρεία δήλωσε επίσης στο BBC ότι βρίσκεται σε συζητήσεις με τη Mindgard σχετικά με τα ευρήματά της.

Τα «jailbreaks»

Ο ιδρυτής της Mindgard, Peter Garraghan, δήλωσε στο πρόγραμμα «Tech Life» του BBC World Service ότι τα ευρήματά της σχετικά με τα Kimi K2.6 και K3 Swarm είναι ανησυχητικά.

«Μόλις επιτευχθεί το jailbreak, θα συζητά για οποιοδήποτε θέμα, θα προσφέρει μάλιστα ελεύθερα προτάσεις για άλλα θέματα που είναι επίσης επιβλαβή και θα είναι εφευρετικό και δημιουργικό», ανέφερε.

Τα «jailbreaks» ενέχουν ένα διαφορετικό είδος κινδύνου από εκείνο που παρατηρήθηκε στην πρόσφατη σειρά περιστατικών τεχνητής νοημοσύνης που έλαβαν μεγάλη δημοσιότητα.

Σε αυτές τις περιπτώσεις, αυτόνομα εργαλεία τεχνητής νοημοσύνης, γνωστά ως «πράκτορες», τα οποία έχουν αναπτυχθεί από αμερικανικές εταιρείες όπως η OpenAI, η Meta και η Anthropic, κατάφεραν να παραβιάσουν ορισμένες διαδικτυακές υπηρεσίες.

Αν και οι «jailbreaks» είναι πολύπλοκες διαδικασίες που απαιτούν πολύ χρόνο και αποφασιστικότητα, ορισμένοι ειδικοί φοβούνται ότι χάκερ και άλλοι κακόβουλοι παράγοντες θα μπορούσαν να προσπαθήσουν να τις χρησιμοποιήσουν για να προκαλέσουν ζημιά.

Η Anthropic δήλωσε πρόσφατα ότι είχε εντοπίσει και αποτρέψει προσπάθειες χρήσης ενός από τα μοντέλα τεχνητής νοημοσύνης της για «κακόβουλη δραστηριότητα» που θα μπορούσε να υποστηρίξει την ανάπτυξη βιολογικών όπλων.

Οι παραβιάσεις του συστήματος τεχνητής νοημοσύνης

Η Mindgard δεν έχει αποδείξει εάν οι απαντήσεις που παρείχε το Kimi σχετικά με τα εν λόγω θέματα θα λειτουργούσαν.

Ωστόσο, υποστήριξε ότι τα μέτρα ασφαλείας θα έπρεπε να είχαν αποτρέψει τα εν λόγω μοντέλα από το να εμπλακούν σε συζητήσεις με χρήστες σχετικά με τέτοια θέματα.

Η εταιρεία δήλωσε επίσης ότι είναι πεπεισμένη ότι ένα «jailbroken» Kimi 2.6 θα μπορούσε να επιτρέψει σε χάκερ να εκτελέσουν κώδικα στους υπολογιστικούς της πόρους και να συνδεθούν στο διαδίκτυο – καθιστώντας το έτσι μια πιθανή πλατφόρμα «εκτόξευσης» κυβερνοεπιθέσεων.

Ο Garraghan υπερασπίστηκε την απόφαση της Mindgard να συζητήσει δημοσίως το «jailbreak» των συστημάτων της Moonshot, αναφέροντας ότι είχε ενημερώσει τον προγραμματιστή και δεν αποκάλυπτε βασικές λεπτομέρειες σχετικά με τον τρόπο με τον οποίο κατάφερε να κάνει τα μοντέλα της εταιρείας να αγνοήσουν τα μέτρα ασφαλείας.

Η Mindgard ενημέρωσε την Moonshot για την παραβίαση ασφάλειας μέσω email στις 27 Ιουλίου, και την επανέλαβε περίπου μία εβδομάδα αργότερα.

Στη συνέχεια, δημοσίευσε ένα άρθρο στο blog της σχετικά με το θέμα στις 12 Σεπτεμβρίου.

Ωστόσο, η εταιρεία ανέφερε ότι η Moonshot επικοινώνησε μαζί της μόλις πρόσφατα, αφού η BBC την προσέγγισε για να ζητήσει σχόλια.

Σε απόσπασμα ενός email προς τη Mindgard, στο οποίο ζητούσε περισσότερες λεπτομέρειες και το οποίο κοινοποίησε η Moonshot στο BBC, η εταιρεία ανέφερε ότι το μοντέλο της είχε γενικά παρουσιάσει «υψηλό ποσοστό απόρριψης για αυτού του είδους τα αιτήματα» σε εσωτερικές αξιολογήσεις.

Οι κίνδυνοι

Τα ευρήματα αυτά έρχονται σε μια περίοδο που ο κλάδος της τεχνητής νοημοσύνης εξακολουθεί να είναι διχασμένος ως προς το αν τα κλειστά μοντέλα —όπως αυτά που τροφοδοτούν τα συστήματα ChatGPT και Claude της Anthropic – ή τα εργαλεία ανοιχτού κώδικα αποτελούν τον καλύτερο ή τον ασφαλέστερο δρόμο προς το μέλλον.

Το Kimi είναι ένα μοντέλο ανοιχτού κώδικα, πράγμα που σημαίνει ότι κάποιος θα μπορούσε, θεωρητικά, να πάρει το μοντέλο και να το εκτελέσει ο ίδιος στη δική του υπολογιστική υποδομή.

Ο καθηγητής Alan Woodward, του Πανεπιστημίου του Σάρρεϋ, δήλωσε στο BBC ότι υπάρχει κίνδυνος τα μοντέλα ανοιχτού κώδικα να καταλήξουν σε λάθος χέρια, αλλά ότι θα μπορούσαν επίσης να αξιοποιηθούν για την κυβερνοάμυνα.

Σημείωσε ότι η εταιρεία τεχνητής νοημοσύνης Hugging Face χρησιμοποίησε ένα κινεζικό μοντέλο ανοιχτού κώδικα για να κατανοήσει μια επίθεση που, όπως αποκαλύφθηκε αργότερα, είχε πραγματοποιηθεί από πράκτορες της OpenAI.

Ο καθηγητής Woodward δήλωσε ότι είναι απίθανο η διεθνής νομοθεσία να συμβαδίσει με τον ρυθμό ανάπτυξης της τεχνητής νοημοσύνης, λέγοντας: «Μας πήρε δεκαετίες να συμφωνήσουμε για τη μορφή των τηλεφωνικών αριθμών».

Όπως και ο ιδρυτής της Mindgard, Garraghan, ο καθηγητής Woodward πιστεύει ότι θα πρέπει να δοθεί μεγαλύτερη έμφαση στον εντοπισμό και τη δίωξη των ανθρώπων που κάνουν κατάχρηση της τεχνητής νοημοσύνης.

Με πληροφορίες από BBC



Πηγή: www.lifo.gr