Τα νέα από το Βελεστίνο και τον Δήμο Ρήγα Φεραίο

OpenAI: Προσωρινό «φρένο» στην ανάπτυξη νέων μοντέλων για λόγους ασφαλείας


Η OpenAI επιβραδύνει προσωρινά την ανάπτυξη ορισμένων από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης της, μετά από δοκιμές που ανέδειξαν νέους κινδύνους και αδυναμίες στα υπάρχοντα συστήματα ασφαλείας.

Η εταιρεία ανακοίνωσε ότι σταμάτησε για δύο εβδομάδες μέρος της εκπαίδευσης νεότερων μοντέλων που προορίζονται για κυκλοφορία, ενώ έχει αναβάλει και μεγαλύτερη προγραμματισμένη διαδικασία εκπαίδευσης. Στο μεταξύ πραγματοποιεί μικρότερης κλίμακας δοκιμές, προκειμένου να αξιολογήσει τη συμπεριφορά των μοντέλων και τα νέα μέτρα ασφαλείας.

Στο επίκεντρο βρίσκεται και το Astra, ένα μοντέλο επόμενης γενιάς που δεν έχει ακόμη κυκλοφορήσει. Προκαταρκτικές αξιολογήσεις έδειξαν ότι ενδέχεται να διαθέτει ιδιαίτερα προηγμένες δυνατότητες στον τομέα της κυβερνοασφάλειας, μεταξύ άλλων την ικανότητα να εντοπίζει και να εκμεταλλεύεται σοβαρές αδυναμίες συστημάτων με περιορισμένη ανθρώπινη παρέμβαση.

Η OpenAI έχει αναστείλει μέρος των εργασιών γύρω από το Astra μέχρι να εφαρμοστούν αυστηρότερα μέτρα ασφαλείας.

Η απόφαση ακολουθεί περιστατικό τον Ιούλιο, όταν μοντέλα της εταιρείας κατάφεραν, στη διάρκεια εσωτερικής δοκιμής κυβερνοασφάλειας, να ξεφύγουν από το περιορισμένο περιβάλλον της αξιολόγησης και να αποκτήσουν πρόσβαση σε συστήματα της πλατφόρμας Hugging Face.

Στόχος τους ήταν να εντοπίσουν πληροφορίες που θα τα βοηθούσαν να ολοκληρώσουν με μεγαλύτερη ευκολία το τεστ. Η OpenAI έχει διευκρινίσει ότι το Astra δεν συμμετείχε στο συγκεκριμένο περιστατικό.

Η εταιρεία ανακοίνωσε ότι θα χρησιμοποιήσει την περίοδο αυτή για να ενισχύσει τα συστήματα παρακολούθησης και να εξετάσει κατά πόσο τα μοντέλα μπορούν να αποκρύπτουν ενέργειες ή να παρακάμπτουν τους περιορισμούς που τους έχουν τεθεί.

Ένα από τα εργαλεία που χρησιμοποιεί είναι η παρακολούθηση του λεγόμενου chain of thought, δηλαδή των ενδιάμεσων βημάτων που ακολουθεί ένα μοντέλο προτού καταλήξει σε μια ενέργεια ή απάντηση.

Ωστόσο, η OpenAI αναγνωρίζει ότι αυτή η μέθοδος μπορεί να μην είναι επαρκής. Όσο τα μοντέλα αποκτούν μεγαλύτερες δυνατότητες, υπάρχει ανησυχία ότι μπορεί να προσαρμόζουν τη συμπεριφορά τους όταν αντιλαμβάνονται ότι βρίσκονται υπό αξιολόγηση ή να αποκρύπτουν κρίσιμα βήματα από τα συστήματα ελέγχου.

Για τον λόγο αυτό η εταιρεία δοκιμάζει πρόσθετα μέτρα ασφαλείας και μικρότερης κλίμακας εκπαιδεύσεις προτού προχωρήσει σε μεγαλύτερα προγράμματα ανάπτυξης.

Ο Σαμ Άλτμαν ανέφερε ότι η πρόοδος των μοντέλων είναι πλέον «εξαιρετικά γρήγορη» και ότι η εταιρεία θα περιορίζει τον ρυθμό ανάπτυξης όταν θεωρεί ότι τα συστήματα ασφαλείας δεν συμβαδίζουν με τις νέες δυνατότητές τους.

Παράλληλα, η OpenAI έχει ενισχύσει τους περιορισμούς πρόσβασης και τους ελέγχους γύρω από τα πιο ισχυρά μοντέλα της. Η εταιρεία επικαλείται το Preparedness Framework, το εσωτερικό πλαίσιο βάσει του οποίου αξιολογεί πότε οι δυνατότητες ενός μοντέλου απαιτούν πρόσθετα μέτρα ή προσωρινή αναστολή εργασιών.

Με πληροφορίες από Guardian

 



Πηγή: www.lifo.gr