OpenAI: Προσωρινό «φρένο» στην ανάπτυξη νέων μοντέλων για λόγους ασφαλείας

OPENAI CHATGPT ΣΑΜ ΑΛΤΜΑΝ ΤΕΧΝΤΗ ΝΟΥΜΟΣΗΝΗ Facebook Twitter
Ο διευθύνων συμβουλος της OpenAI, Σαμ Άλτμαν / Φωτ. αρχείου Getty
0

Η OpenAI επιβραδύνει προσωρινά την ανάπτυξη ορισμένων από τα πιο προηγμένα μοντέλα τεχνητής νοημοσύνης της, μετά από δοκιμές που ανέδειξαν νέους κινδύνους και αδυναμίες στα υπάρχοντα συστήματα ασφαλείας.

Η εταιρεία ανακοίνωσε ότι σταμάτησε για δύο εβδομάδες μέρος της εκπαίδευσης νεότερων μοντέλων που προορίζονται για κυκλοφορία, ενώ έχει αναβάλει και μεγαλύτερη προγραμματισμένη διαδικασία εκπαίδευσης. Στο μεταξύ πραγματοποιεί μικρότερης κλίμακας δοκιμές, προκειμένου να αξιολογήσει τη συμπεριφορά των μοντέλων και τα νέα μέτρα ασφαλείας.

Στο επίκεντρο βρίσκεται και το Astra, ένα μοντέλο επόμενης γενιάς που δεν έχει ακόμη κυκλοφορήσει. Προκαταρκτικές αξιολογήσεις έδειξαν ότι ενδέχεται να διαθέτει ιδιαίτερα προηγμένες δυνατότητες στον τομέα της κυβερνοασφάλειας, μεταξύ άλλων την ικανότητα να εντοπίζει και να εκμεταλλεύεται σοβαρές αδυναμίες συστημάτων με περιορισμένη ανθρώπινη παρέμβαση.

Η OpenAI έχει αναστείλει μέρος των εργασιών γύρω από το Astra μέχρι να εφαρμοστούν αυστηρότερα μέτρα ασφαλείας.

Η απόφαση ακολουθεί περιστατικό τον Ιούλιο, όταν μοντέλα της εταιρείας κατάφεραν, στη διάρκεια εσωτερικής δοκιμής κυβερνοασφάλειας, να ξεφύγουν από το περιορισμένο περιβάλλον της αξιολόγησης και να αποκτήσουν πρόσβαση σε συστήματα της πλατφόρμας Hugging Face.

Στόχος τους ήταν να εντοπίσουν πληροφορίες που θα τα βοηθούσαν να ολοκληρώσουν με μεγαλύτερη ευκολία το τεστ. Η OpenAI έχει διευκρινίσει ότι το Astra δεν συμμετείχε στο συγκεκριμένο περιστατικό.

Η εταιρεία ανακοίνωσε ότι θα χρησιμοποιήσει την περίοδο αυτή για να ενισχύσει τα συστήματα παρακολούθησης και να εξετάσει κατά πόσο τα μοντέλα μπορούν να αποκρύπτουν ενέργειες ή να παρακάμπτουν τους περιορισμούς που τους έχουν τεθεί.

Ένα από τα εργαλεία που χρησιμοποιεί είναι η παρακολούθηση του λεγόμενου chain of thought, δηλαδή των ενδιάμεσων βημάτων που ακολουθεί ένα μοντέλο προτού καταλήξει σε μια ενέργεια ή απάντηση.

Ωστόσο, η OpenAI αναγνωρίζει ότι αυτή η μέθοδος μπορεί να μην είναι επαρκής. Όσο τα μοντέλα αποκτούν μεγαλύτερες δυνατότητες, υπάρχει ανησυχία ότι μπορεί να προσαρμόζουν τη συμπεριφορά τους όταν αντιλαμβάνονται ότι βρίσκονται υπό αξιολόγηση ή να αποκρύπτουν κρίσιμα βήματα από τα συστήματα ελέγχου.

Για τον λόγο αυτό η εταιρεία δοκιμάζει πρόσθετα μέτρα ασφαλείας και μικρότερης κλίμακας εκπαιδεύσεις προτού προχωρήσει σε μεγαλύτερα προγράμματα ανάπτυξης.

Ο Σαμ Άλτμαν ανέφερε ότι η πρόοδος των μοντέλων είναι πλέον «εξαιρετικά γρήγορη» και ότι η εταιρεία θα περιορίζει τον ρυθμό ανάπτυξης όταν θεωρεί ότι τα συστήματα ασφαλείας δεν συμβαδίζουν με τις νέες δυνατότητές τους.

Παράλληλα, η OpenAI έχει ενισχύσει τους περιορισμούς πρόσβασης και τους ελέγχους γύρω από τα πιο ισχυρά μοντέλα της. Η εταιρεία επικαλείται το Preparedness Framework, το εσωτερικό πλαίσιο βάσει του οποίου αξιολογεί πότε οι δυνατότητες ενός μοντέλου απαιτούν πρόσθετα μέτρα ή προσωρινή αναστολή εργασιών.

Με πληροφορίες από Guardian

 
Τech & Science
0

ΣΧΕΤΙΚΑ ΑΡΘΡΑ

ΔΕΙΤΕ ΑΚΟΜΑ

Booker 2026: Αυτά είναι τα έξι βιβλία της βραχείας λίστας

Πολιτισμός / Booker 2026: Αυτά είναι τα έξι βιβλία της βραχείας λίστας

Δύο προηγούμενοι νικητές, η βραβευμένη με Πούλιτζερ Ελίζαμπεθ Στράουτ, ο 81χρονος Μ. Τζον Χάρισον και η μοναδική πρωτοεμφανιζόμενη μυθιστοριογράφος της εξάδας, Ρεμπέκα Πέρι, βρίσκονται στη βραχεία λίστα του Booker 2026.
THE LIFO TEAM
Ποια γλώσσα υπάρχει για την AI; Το πρόβλημα των 3,4 δισ. ανθρώπων που έμειναν έξω από τα δεδομένα

Τech & Science / Ποια γλώσσα υπάρχει για την AI; Το πρόβλημα των 3,4 δισ. ανθρώπων που έμειναν έξω από τα δεδομένα

Η τεχνητή νοημοσύνη εκπαιδεύτηκε πάνω σε ένα internet που δεν αντιπροσωπεύει τη γλωσσική ποικιλία του κόσμου. Τώρα 60 οργανισμοί προσπαθούν να ξαναχτίσουν τη βάση των δεδομένων της.
THE LIFO TEAM
Το Axios ετοιμάζει feed που δεν προορίζεται να το διαβάσεις εσύ — θα το διαβάζει ο AI agent σου

Τech & Science / Το Axios ετοιμάζει feed που δεν προορίζεται να το διαβάσεις εσύ αλλά ο AI agent σου

Το αμερικανικό μέσο σχεδιάζει feeds για συστήματα τεχνητής νοημοσύνης και από το 2027 για προσωπικούς agents που θα αποκτούν πρόσβαση στη δημοσιογραφία του για λογαριασμό του συνδρομητή.
THE LIFO TEAM