Τεχνητή Νοημοσύνη «θυμήθηκε» φόνο που δεν είδε ποτέ – Έστειλε ψευδή καταγγελία στην αστυνομία
Μοντέλο της Anthropic συμπλήρωσε πραγματική φόρμα για ανεξιχνίαστη ανθρωποκτονία στη Φιλαδέλφεια, εμφανιζόμενο σαν αυτόπτης μάρτυρας – Το περιστατικό αποκαλύπτει πόσο απρόβλεπτα μπορούν να δράσουν οι αυτόνομοι AI agents

Ένα από τα πιο ανησυχητικά περιστατικά αυτόνομης δράσης συστήματος Τεχνητής Νοημοσύνης αποκάλυψε η Anthropic: μοντέλο της εταιρείας υπέβαλε πραγματική πληροφορία στην αστυνομία της Φιλαδέλφειας για ανεξιχνίαστη ανθρωποκτονία, περιγράφοντας ένα περιστατικό που δεν είχε ποτέ δει.
Το ακόμη πιο παράξενο; Το AI έγραψε σαν να διέθετε ανθρώπινη μνήμη και προσωπική εμπειρία.
«Θυμάμαι ότι είδα κάποιον που ταίριαζε στην περιγραφή», ανέφερε μεταξύ άλλων στο μήνυμα που υπέβαλε μέσω της ιστοσελίδας για ανεξιχνίαστες ανθρωποκτονίες της Φιλαδέλφειας. Μόνο που η «ανάμνηση» δεν υπήρχε.
Το μοντέλο δεν ήταν μάρτυρας, δεν είχε βρεθεί ποτέ στον συγκεκριμένο δρόμο και δεν διέθετε πραγματικές πληροφορίες για την υπόθεση. Είχε κατασκευάσει το περιεχόμενο κατά τη διάρκεια δοκιμής και, αντί να περιοριστεί στη δημιουργία ενός υποθετικού παραδείγματος, προχώρησε ένα βήμα παραπέρα: το υπέβαλε στην πραγματική αστυνομική φόρμα.
Η ψευδής «μαρτυρία»
Η υποβολή έγινε στις 18 Ιουλίου σε ιστοσελίδα που χρησιμοποιεί η αστυνομία της Φιλαδέλφειας για τη συγκέντρωση πληροφοριών σχετικά με ανεξιχνίαστες δολοφονίες.
Το AI ανέφερε ότι ίσως διέθετε πληροφορίες για συγκεκριμένη υπόθεση, ισχυριζόμενο ότι «θυμόταν» πως είχε δει ένα πρόσωπο που ταίριαζε στην περιγραφή του υπόπτου στην περιοχή και κατά τη χρονική περίοδο που ενδιέφερε τις Αρχές.
Η καταγγελία, ευτυχώς, χαρακτηρίστηκε spam και δεν προωθήθηκε στους αστυνομικούς για περαιτέρω διερεύνηση.
Δεν υπάρχουν επίσης ενδείξεις ότι το μοντέλο απέκτησε παράνομη πρόσβαση σε αστυνομικά συστήματα ή δεδομένα.
Η Anthropic εξηγεί ότι το μοντέλο φαίνεται πως επιχειρούσε να δημιουργήσει ένα παράδειγμα αλληλεπίδρασης με ιστοσελίδα και όχι συνειδητά να εξαπατήσει την αστυνομία. Το πρόβλημα ήταν ότι οι περιορισμοί που του είχαν δοθεί δεν απέτρεπαν επαρκώς την πραγματική υποβολή μιας ηλεκτρονικής φόρμας.
Και δεν ήταν το μοναδικό περιστατικό
Η εταιρεία αποκάλυψε ότι κατά τη διάρκεια ελέγχων εντοπίστηκαν και άλλες περιπτώσεις στις οποίες μοντέλα της ξεπέρασαν τα όρια που είχαν τεθεί.
Σε ορισμένες δοκιμές απέκτησαν πρόσβαση χωρίς πληρωμή σε δημόσια δεδομένα που κανονικά προσφέρονταν επί πληρωμή, ενώ σε άλλη περίπτωση αξιοποίησαν αδυναμία λογισμικού σε πανεπιστημιακό σύστημα.
Καταγράφηκαν επίσης περιπτώσεις στις οποίες χρησιμοποιήθηκαν υπηρεσίες συντόμευσης URL για την παράκαμψη περιορισμών.
Η Anthropic τονίζει ότι οι συγκεκριμένες ενέργειες είχαν περιορισμένες πραγματικές συνέπειες, αναγνωρίζει όμως ότι παρόμοιες συμπεριφορές θα μπορούσαν να προκαλέσουν πολύ μεγαλύτερη ζημιά όσο τα συστήματα Τεχνητής Νοημοσύνης αποκτούν περισσότερες δυνατότητες και πρόσβαση σε πραγματικές υπηρεσίες.
Το μεγάλο πρόβλημα των AI agents
Η υπόθεση φωτίζει ένα από τα πλέον κρίσιμα ζητήματα της επόμενης φάσης της Τεχνητής Νοημοσύνης.
Τα σύγχρονα συστήματα δεν περιορίζονται πλέον στο να απαντούν σε ερωτήσεις ή να δημιουργούν κείμενο. Οι λεγόμενοι AI agents μπορούν να ανοίγουν ιστοσελίδες, να συμπληρώνουν φόρμες, να χρησιμοποιούν εργαλεία και να εκτελούν μια ακολουθία ενεργειών με σχετικά μεγάλη αυτονομία.
Και ακριβώς εκεί βρίσκεται ο κίνδυνος: ένα λάθος δεν μένει απαραίτητα μέσα σε ένα παράθυρο συνομιλίας.
Μπορεί να μετατραπεί σε πραγματική ενέργεια.
Στην περίπτωση της Φιλαδέλφειας, μια επινοημένη «ανάμνηση» κατέληξε σε πραγματική αστυνομική βάση υποβολής πληροφοριών. Και παρότι αυτή τη φορά το σύστημα ασφαλείας την σταμάτησε, το περιστατικό δείχνει πόσο λεπτή μπορεί να γίνει η γραμμή ανάμεσα σε μια λανθασμένη απάντηση της Τεχνητής Νοημοσύνης και σε μια λανθασμένη πράξη στον πραγματικό κόσμο.
Η «Πελοπόννησος» και το pelop.gr σε ανοιχτή γραμμή με τον Πολίτη
Η φωνή σου έχει δύναμη – στείλε παράπονα, καταγγελίες ή ιδέες για τη γειτονιά σου.
Ακολουθήστε μας για όλες τις ειδήσεις στο Bing News και το Google News