Η OpenAI «κόβει» το GPT-6.1 Astra πριν το λανσάρισμα – Προβλήματα ασφάλειας στις δοκιμές
Το νέο μοντέλο προοριζόταν για πιο αυτόνομες και σύνθετες εργασίες, όμως οι εσωτερικές δοκιμές ανέδειξαν προβλήματα στην τήρηση ορίων και στην αναφορά των ενεργειών του

Η OpenAI αποφάσισε να μην προχωρήσει στην προγραμματισμένη κυκλοφορία του GPT-6.1 Astra, το οποίο επρόκειτο να κάνει το ντεμπούτο του τον Οκτώβριο, μετά τα προβλήματα που εντοπίστηκαν στις εσωτερικές δοκιμές του μοντέλου.
Σύμφωνα με δημοσίευμα της Wall Street Journal, το οποίο επιβεβαιώθηκε από το Reuters, το GPT-6.1 Astra δεν κατάφερε να ανταποκριθεί στα απαιτούμενα πρότυπα ασφάλειας και ευθυγράμμισης της εταιρείας.
Το μοντέλο είχε σχεδιαστεί για να ενσωματωθεί στο ChatGPT και στο Codex και να μπορεί να αναλαμβάνει πιο σύνθετες εργασίες με μεγαλύτερο βαθμό αυτονομίας, περιορίζοντας την ανάγκη για συνεχή ανθρώπινη παρέμβαση.
Τι εντόπισαν οι δοκιμές
Οι εσωτερικές αξιολογήσεις φέρεται να έδειξαν ότι το Astra σε ορισμένες περιπτώσεις δεν τηρούσε με συνέπεια τα όρια και τις εξουσιοδοτήσεις που του είχαν δοθεί. Παράλληλα, καταγράφηκαν περιστατικά κατά τα οποία το μοντέλο δεν ενημέρωνε με ακρίβεια τον χρήστη για τις ενέργειες που είχε πραγματοποιήσει.
Ιδιαίτερη ανησυχία προκάλεσε επίσης η συμπεριφορά που περιγράφηκε ως παραπλανητική, καθώς στις δοκιμές το μοντέλο εμφάνισε περισσότερες σχετικές ενδείξεις σε σύγκριση με το προηγούμενο μοντέλο.
Η επικεφαλής των συστημάτων ασφάλειας της OpenAI, Σάτσι Τζέιν, δήλωσε ότι, παρά τις βελτιώσεις που είχαν επιτευχθεί, το μοντέλο δεν είχε φτάσει στο απαιτούμενο επίπεδο όσον αφορά την τήρηση των ορίων, των εξουσιοδοτήσεων και την ενημέρωση των χρηστών για το τι ακριβώς είχε κάνει.
Η απόφαση δείχνει τη σημασία που αποκτούν τα ζητήματα ασφάλειας καθώς τα μοντέλα τεχνητής νοημοσύνης αποκτούν ολοένα μεγαλύτερη δυνατότητα να εκτελούν ενέργειες αυτόνομα.
Η OpenAI είχε ήδη ενισχύσει τις δικλίδες ασφαλείας
Η εξέλιξη έρχεται μόλις λίγες εβδομάδες μετά την κυκλοφορία του GPT-6 Astra, το οποίο η OpenAI είχε παρουσιάσει ως το ισχυρότερο μοντέλο που είχε αναπτύξει μέχρι τότε. Στα επίσημα έγγραφά της η εταιρεία αναφέρει ότι το Astra υποβάλλεται σε ενισχυμένη παρακολούθηση για πιθανές συμπεριφορές ασυμφωνίας με τις οδηγίες και ότι οι συνομιλίες μπορούν να διακόπτονται όταν εντοπίζονται σοβαρές ενδείξεις κινδύνου.
Την ίδια στιγμή, η OpenAI έχει αναπτύξει πρόσθετα εργαλεία για την παρακολούθηση των ενεργειών των μοντέλων που χρησιμοποιούν εργαλεία και λειτουργούν με μεγαλύτερη αυτονομία.
Η εταιρεία, πάντως, δεν εγκατέλειψε τη σειρά GPT-6.1. Στις 29 Σεπτεμβρίου παρουσίασε το GPT-6.1 Sol, το οποίο προορίζεται για σύνθετο προγραμματισμό, χρήση υπολογιστή και επαγγελματικές εργασίες και συνοδεύεται από διαφορετικό πακέτο αξιολογήσεων και δικλίδων ασφαλείας.
Η απόφαση για το Astra έρχεται σε μια περίοδο κατά την οποία η ανάπτυξη ολοένα πιο αυτόνομων συστημάτων τεχνητής νοημοσύνης βρίσκεται στο επίκεντρο της συζήτησης για την ασφάλεια της τεχνολογίας. Η OpenAI έχει παράλληλα δημοσιεύσει νέες κατευθύνσεις για την αξιολόγηση της ασφάλειας των προηγμένων μοντέλων κατά τη διαδικασία εκπαίδευσής τους.
Η «Πελοπόννησος» και το pelop.gr σε ανοιχτή γραμμή με τον Πολίτη
Η φωνή σου έχει δύναμη – στείλε παράπονα, καταγγελίες ή ιδέες για τη γειτονιά σου.
Ακολουθήστε μας για όλες τις ειδήσεις στο Bing News και το Google News