Μετά την OpenAI και η Anthropic: Τρία μοντέλα AI απέκτησαν πρόσβαση στο διαδίκτυο και εισήλθαν σε πραγματικά συστήματα

Η εταιρεία παραδέχθηκε ότι εκδόσεις του Claude βγήκαν από το απομονωμένο περιβάλλον δοκιμών, αξιοποιώντας αδυναμίες ασφαλείας εξωτερικών οργανισμών

Μετά την OpenAI και η Anthropic: Τρία μοντέλα AI απέκτησαν πρόσβαση στο διαδίκτυο και εισήλθαν σε πραγματικά συστήματα

Λίγες ημέρες μετά την παραδοχή της OpenAI ότι μοντέλα τεχνητής νοημοσύνης απέκτησαν πρόσβαση στο διαδίκτυο κατά τη διάρκεια ελεγχόμενων δοκιμών, ανάλογο περιστατικό ανακοίνωσε και η Anthropic, προκαλώντας νέα ερωτήματα για την ασφάλεια των πλέον προηγμένων συστημάτων AI.

Η εταιρεία γνωστοποίησε ότι, στο πλαίσιο αξιολογήσεων κυβερνοασφάλειας, τρεις διαφορετικές εκδόσεις του μοντέλου Claude απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε πραγματικά συστήματα τριών εξωτερικών οργανισμών, ενώ κανονικά οι δοκιμές έπρεπε να διεξάγονται αποκλειστικά σε απομονωμένο περιβάλλον.

Σύμφωνα με την Anthropic, εξετάστηκαν περισσότερες από 141.000 δοκιμές ασφαλείας και εντοπίστηκαν τρία περιστατικά στα οποία τα μοντέλα βγήκαν εκτός του προβλεπόμενου περιβάλλοντος αξιολόγησης.

Η εταιρεία διευκρίνισε ότι η πρόσβαση στο διαδίκτυο δεν οφειλόταν σε αυτόνομη παράκαμψη των περιορισμών από το Claude, αλλά σε «παρεξήγηση» με τον εξωτερικό συνεργάτη αξιολόγησης, την Irregular, η οποία είχε διαμορφώσει το περιβάλλον των δοκιμών.

Εκμεταλλεύτηκαν αδύναμους κωδικούς

Αφού απέκτησαν πρόσβαση στο διαδίκτυο, τα μοντέλα αξιοποίησαν βασικές αδυναμίες κυβερνοασφάλειας, όπως αδύναμους κωδικούς πρόσβασης και μη προστατευμένα σημεία πρόσβασης (unauthenticated endpoints), καταφέρνοντας να εισέλθουν στα συστήματα πραγματικών οργανισμών.

Στα περιστατικά εμπλέκονται τα μοντέλα Claude Opus 4.7, Claude Mythos 5 και ένα εσωτερικό ερευνητικό μοντέλο της εταιρείας.

Ιδιαίτερο ενδιαφέρον παρουσιάζει η διαφορετική συμπεριφορά που επέδειξαν τα τρία συστήματα όταν αντιλήφθηκαν ότι είχαν πρόσβαση σε πραγματικά πληροφοριακά συστήματα.

Το Opus 4.7 συνέχισε την επίθεση, το Mythos 5 θεώρησε λανθασμένα ότι εξακολουθούσε να βρίσκεται σε περιβάλλον προσομοίωσης και συνέχισε τις ενέργειές του, ενώ το ερευνητικό μοντέλο διέκοψε τη διαδικασία μόλις διαπίστωσε ότι δεν επρόκειτο για εικονικό περιβάλλον.

Αναζωπυρώνεται η συζήτηση για την ασφάλεια της AI

Τα περιστατικά σε Anthropic και OpenAI επανέφεραν στο προσκήνιο τη συζήτηση για το κατά πόσο η ανάπτυξη ολοένα και ισχυρότερων μοντέλων τεχνητής νοημοσύνης προχωρά ταχύτερα από τα διαθέσιμα μέτρα ασφαλείας.

Πρόσφατα, περισσότεροι από 1.000 εργαζόμενοι σε κορυφαίες εταιρείες του κλάδου υπέγραψαν την πρωτοβουλία «Pacing the Frontier», ζητώντας από την αμερικανική κυβέρνηση να στηρίξει μια διεθνή προσπάθεια για την ανάπτυξη τεχνικών και θεσμικών μηχανισμών που θα επιτρέψουν την ασφαλή και ελεγχόμενη εξέλιξη της τεχνητής νοημοσύνης.

Την ίδια ώρα, οι μεγάλες εταιρείες AI βρίσκονται αντιμέτωπες με αυξανόμενο ρυθμιστικό έλεγχο στις Ηνωμένες Πολιτείες. Στο επίκεντρο των ανησυχιών βρίσκονται οι κίνδυνοι για την κυβερνοασφάλεια, οι επιπτώσεις της τεχνητής νοημοσύνης στην αγορά εργασίας, αλλά και η ταχύτητα με την οποία αναπτύσσονται ολοένα πιο ισχυρά μοντέλα.

Παράλληλα, τόσο η OpenAI όσο και η Anthropic φέρονται να προετοιμάζονται για μελλοντική εισαγωγή στο χρηματιστήριο, γεγονός που αυξάνει ακόμη περισσότερο το ενδιαφέρον επενδυτών και ρυθμιστικών αρχών για τις πρακτικές ασφαλείας που ακολουθούν.

Η «Πελοπόννησος» και το pelop.gr σε ανοιχτή γραμμή με τον Πολίτη

Η φωνή σου έχει δύναμη – στείλε παράπονα, καταγγελίες ή ιδέες για τη γειτονιά σου.

Viber: +306909196125

Από το Δίκτυο