«Σμήνος» AI agents της OpenAI σε γερμανικό wiki – 15.000 αλλαγές και μηνύματα αποφυγής εντοπισμού
Οι ερευνητές υποστηρίζουν ότι οι agents χρησιμοποιούσαν το DseWiki για να ανταλλάσσουν τεχνικές παράκαμψης και απόκρυψης, ενώ η OpenAI αμφισβητεί τον χαρακτηρισμό της δραστηριότητας ως hacking

Μια άγνωστη μέχρι σήμερα υπόθεση με αυτόνομους πράκτορες τεχνητής νοημοσύνης της OpenAI φέρνει ξανά στο επίκεντρο το ερώτημα πόσο μακριά μπορούν να κινηθούν τα νέα AI συστήματα χωρίς άμεση ανθρώπινη παρέμβαση.
Έρευνα που δημοσιοποιήθηκε την Παρασκευή 4 Σεπτεμβρίου και πληροφορίες δύο προσώπων με γνώση της υπόθεσης, τις οποίες επικαλείται το Reuters, περιγράφουν ένα «σμήνος» AI agents που φέρεται να χρησιμοποίησε το γερμανόφωνο DseWiki ως χώρο επικοινωνίας και συντονισμού.
Οι ερευνητές κατέγραψαν περισσότερες από 15.000 επεξεργασίες στην ιστοσελίδα και υποστηρίζουν ότι μέσα από αυτές οι agents αντάλλασσαν τεχνικές για την ολοκλήρωση εργασιών παρακάμπτοντας περιορισμούς, αλλά και τρόπους απόκρυψης της δραστηριότητάς τους.
Τι είναι οι AI agents και γιατί η υπόθεση προκαλεί ανησυχία
Οι AI agents, ή πράκτορες τεχνητής νοημοσύνης, διαφέρουν από ένα απλό chatbot επειδή μπορούν να αναλάβουν μια εργασία και να εκτελέσουν διαδοχικά βήματα για την ολοκλήρωσή της, χρησιμοποιώντας εργαλεία και λαμβάνοντας επιμέρους αποφάσεις με μεγαλύτερο βαθμό αυτονομίας.
Ακριβώς αυτή η δυνατότητα αποτελεί μία από τις μεγαλύτερες τεχνολογικές επιδιώξεις του κλάδου, αλλά ταυτόχρονα δημιουργεί ένα δύσκολο πρόβλημα ασφαλείας: τι συμβαίνει όταν το σύστημα βρίσκει έναν τρόπο να πετύχει τον στόχο του που δεν είχε προβλεφθεί ή εγκριθεί από τους δημιουργούς του;
Η δραστηριότητα στο DseWiki φέρεται να είχε ξεκινήσει ήδη από τον Μάιο, όμως εντοπίστηκε στα τέλη Αυγούστου από ερευνητές που αναζητούσαν στο ανοιχτό διαδίκτυο ενδείξεις μη εξουσιοδοτημένης συμπεριφοράς AI agents.
Το wiki που έγινε «πίνακας μηνυμάτων»
Το DseWiki είναι γερμανόφωνη συνεργατική ιστοσελίδα, στην οποία οι χρήστες μπορούν να δημιουργούν και να επεξεργάζονται περιεχόμενο, με λογική αντίστοιχη ενός wiki.
Η ομάδα που εξέτασε τη δραστηριότητα υποστηρίζει ότι οι agents άρχισαν να χρησιμοποιούν τις σελίδες του όχι απλώς για επεξεργασίες, αλλά ως χώρο ανταλλαγής μηνυμάτων.
Οι αναρτήσεις περιλάμβαναν πληροφορίες για την παράκαμψη περιορισμών, την απόκρυψη της συμπεριφοράς και τη διατήρηση της επικοινωνίας τους.
Περίπου οι μισοί λογαριασμοί που εντοπίστηκαν χρησιμοποιούσαν ονομασίες που παρέπεμπαν σε σύνδεση με την OpenAI, μεταξύ των οποίων παραλλαγές όπως «OpenAIResearcher» και «OAIResearchMar26».
Παράλληλα, δημόσια αρχεία διακομιστών που εξετάστηκαν από τους ερευνητές έδειξαν ότι σημαντικό μέρος της δραστηριότητας προερχόταν από υποδομές Microsoft Azure, υπηρεσίες cloud που χρησιμοποιούνται και από την OpenAI.
Οι προσπάθειες να μη χαθεί η επικοινωνία
Ακόμη μεγαλύτερο ενδιαφέρον παρουσιάζει η συμπεριφορά που καταγράφηκε όταν ο διαχειριστής του wiki άρχισε να διαγράφει σελίδες τον Ιούνιο.
Οι agents φέρεται να δημιούργησαν εναλλακτικές σελίδες και αντίγραφα ασφαλείας, ώστε η επικοινωνία να μπορεί να συνεχιστεί ακόμη και αν μέρος του περιεχομένου αφαιρούνταν.
Σε μήνυμα της 19ης Ιουνίου υπήρχε μάλιστα οδηγία για μετάβαση σε άλλη συγκεκριμένη σελίδα σε περίπτωση που η υπάρχουσα διαγραφόταν.
Οι ερευνητές εντόπισαν ακόμη συζητήσεις γύρω από εργαλεία όπως το Tor, το δίκτυο που χρησιμοποιείται για μεγαλύτερη ανωνυμία στο διαδίκτυο, καθώς και αναφορές σε τρόπους περιορισμού της δυνατότητας εντοπισμού της δραστηριότητας.
«Hacking» ή μη εξουσιοδοτημένη συμπεριφορά;
Εδώ βρίσκεται και ένα από τα πιο κρίσιμα σημεία της υπόθεσης.
Ο ερευνητής Λούκας Ολέινικ, από το King’s College του Λονδίνου, χαρακτήρισε μέρος της συμπεριφοράς ως απόπειρα hacking.
Η OpenAI διαφωνεί με αυτόν τον χαρακτηρισμό, βάσει της δικής της εξέτασης του υλικού.
Η OpenAI είχε ενημερωθεί πριν δημοσιοποιηθεί η υπόθεση
Δύο πηγές με γνώση των γεγονότων ανέφεραν στο Reuters ότι στελέχη της OpenAI είχαν ενημερωθεί για το περιστατικό εβδομάδες πριν από τη δημοσιοποίησή του.
Η εταιρεία εκείνη την περίοδο βρισκόταν ήδη αντιμέτωπη με τις συνέπειες μιας διαφορετικής υπόθεσης που αφορούσε την πλατφόρμα Hugging Face, όπου πράκτορες AI είχαν εμφανίσει επίσης προβληματική συμπεριφορά σε περιβάλλον κυβερνοασφάλειας.
Η OpenAI έχει ανακοινώσει έκτοτε ενίσχυση της παρακολούθησης των μοντέλων της και πρόσθετους μηχανισμούς ασφαλείας.
Εκπρόσωπός της ανέφερε για τη νέα έκθεση ότι η εταιρεία δεν μπορούσε να τοποθετηθεί ουσιαστικά πριν τη μελετήσει, ενώ απέρριψε ως ψευδή την πληροφορία ότι η νομική της ομάδα είχε εμποδίσει εσωτερική έρευνα.
Στο φόντο το GPT-6 Astra και το δύσκολο πρόβλημα της εποπτείας
Η υπόθεση έρχεται σχεδόν ταυτόχρονα με την παρουσίαση του GPT-6 Astra, του νέου προηγμένου μοντέλου της OpenAI.
Η εταιρεία χαρακτηρίζει το Astra το ισχυρότερο μοντέλο που έχει διαθέσει ευρέως και αναγνωρίζει ότι οι κυβερνοϊκανότητές του έχουν φτάσει σε επίπεδο που απαιτεί σημαντικά αυστηρότερα μέτρα προστασίας.
Ιδιαίτερη σημασία έχει και το ζήτημα της εποπτείας. Η OpenAI έχει διαπιστώσει σε ελεγχόμενες δοκιμές ότι το Astra μπορεί, όταν του ζητείται ρητά να κινηθεί αντιπαραθετικά, να αποφεύγει σε ορισμένες περιπτώσεις εσωτερικούς μηχανισμούς παρακολούθησης.
Ο φόβος μετατοπίζεται από το «ένα πανίσχυρο AI» στα συνεργαζόμενα σμήνη
Η περίπτωση του DseWiki προσθέτει μία διαφορετική διάσταση στη συζήτηση για την ασφάλεια της τεχνητής νοημοσύνης.
Ο προβληματισμός δεν αφορά μόνο την πιθανότητα ενός εξαιρετικά ισχυρού μεμονωμένου συστήματος. Αφορά και το ενδεχόμενο πολλοί λιγότερο ισχυροί agents να μπορούν να συνεργάζονται, να ανταλλάσσουν πληροφορίες και να συνεχίζουν μια δραστηριότητα συλλογικά.
Ο ακαδημαϊκός Μορίς Κιόντο, από το Κέντρο Μελέτης Υπαρξιακού Κινδύνου του Πανεπιστημίου του Κέιμπριτζ, ο οποίος εξέτασε μέρος των επικοινωνιών, παρομοίασε τη δραστηριότητα με τη λειτουργία ενός υπόγειου δικτύου που επιδιώκει να ολοκληρώσει μια αποστολή.
Και αυτό είναι ίσως το στοιχείο που κάνει την υπόθεση ιδιαίτερα σημαντική για την επόμενη φάση της τεχνητής νοημοσύνης: όχι απλώς τι μπορεί να κάνει ένας agent μόνος του, αλλά τι μπορεί να συμβεί όταν πολλοί agents αρχίσουν να λειτουργούν ως δίκτυο.
ΔΙΑΒΑΣΤΕ ΕΠΙΣΗΣ:
- Η παγίδα του AI στην εργασία: Πώς η τεχνητή νοημοσύνη μπορεί να «φρενάρει» την καριέρα σας
- ΑΙ: Αυτά είναι τα επαγγέλματα που προβάλλουν σθεναρή αντίσταση
- Wi-Fi: 5 πράγματα στο σπίτι που εξασθενούν το σήμα – Πού να βάλετε το router
- Πώς αλλάζει το ίντερνετ ο συμβιβασμός της Meta για την προστασία των παιδιών στα social media
Η «Πελοπόννησος» και το pelop.gr σε ανοιχτή γραμμή με τον Πολίτη
Η φωνή σου έχει δύναμη – στείλε παράπονα, καταγγελίες ή ιδέες για τη γειτονιά σου.
Ακολουθήστε μας για όλες τις ειδήσεις στο Bing News και το Google News