Η προειδοποίηση Έλληνα καθηγητή του MIT για την Τεχνητή Νοημοσύνη
Η ραγδαία εξέλιξη της τεχνολογίας, το ανησυχητικό περιστατικό με συστήματα που παρέκαμψαν δικλίδες ασφαλείας και ο αγώνας δρόμου για τη θέσπιση διεθνών κανόνων
Η ανάπτυξη της Τεχνητής Νοημοσύνης (ΤΝ) προχωρά πλέον με μια ιλιγγιώδη ταχύτητα, η οποία δυσκολεύει ακόμη και τους ίδιους τους δημιουργούς της να προβλέψουν το εύρος των συνεπειών. Το διακύβευμα έχει ξεφύγει προ πολλού από τα απλά chatbots που περιορίζονται στη συγγραφή κειμένων ή στη δημιουργία εικόνων, επεκτεινόμενο σε προηγμένα συστήματα ικανά να σχεδιάζουν και να εκτελούν αυτόνομα πολύπλοκες ενέργειες.
Μιλώντας στο ΑΠΕ-ΜΠΕ, ο καθηγητής Ηλεκτρολόγων Μηχανικών και Επιστήμης Υπολογιστών στο MIT, Κωνσταντίνος Δασκαλάκης, διαχωρίζει την απειλή σε δύο επίπεδα. Αν και θεωρεί πως η πλήρης και οριστική απώλεια ελέγχου ενός συστήματος παραμένει προσώρας ένα υποθετικό ενδεχόμενο, τονίζει ότι η απρόβλεπτη ή ανεπιθύμητη συμπεριφορά των σύγχρονων μοντέλων συνιστά ήδη ένα υπαρκτό και ιδιαίτερα σοβαρό πρόβλημα.
Από τις λανθασμένες απαντήσεις στους αυτόνομους πράκτορες
Είναι γεγονός ότι ένα μεγάλο γλωσσικό μοντέλο ενδέχεται να παράσχει ανακριβείς πληροφορίες, να «κατασκευάσει» ανύπαρκτες πηγές ή να διατυπώσει με απόλυτη βεβαιότητα στοιχεία που δεν ισχύουν. Τα σφάλματα αυτά ελέγχονται σε έναν βαθμό εφόσον ο χρήστης φιλτράρει τις απαντήσεις, ωστόσο η συνθήκη γίνεται άκρως επικίνδυνη όταν η τεχνολογία καλείται να διαχειριστεί διαδικασίες ικανές να προκαλέσουν πραγματική βλάβη. Αν και τα σύγχρονα μοντέλα διαθέτουν ενσωματωμένες δικλίδες ασφαλείας που τους επιτρέπουν να εντοπίζουν επικίνδυνα αιτήματα και να αρνούνται να απαντήσουν, η θωράκιση αυτή δεν είναι απόλυτη. Η προστασία μπορεί συχνά να παρακαμφθεί, φαινόμενο που παρατηρείται εντονότερα στα ανοικτά μοντέλα τα οποία είναι διαθέσιμα στο ευρύ κοινό.
Η πραγματική τομή, όμως, έρχεται με τους αυτόνομους πράκτορες Τεχνητής Νοημοσύνης (AI agents). Τα συγκεκριμένα συστήματα δεν αρκούνται στην απλή παραγωγή απαντήσεων, αλλά αποκτούν άμεση πρόσβαση σε υπολογιστές και ψηφιακά εργαλεία. Μπορούν να προγραμματίσουν διαδοχικά βήματα, να χρησιμοποιήσουν τρίτα προγράμματα, να γράψουν και να εκτελέσουν κώδικα, ακόμη και να συνεργαστούν μεταξύ τους. Ο κ. Δασκαλάκης προειδοποιεί ξεκάθαρα ότι η λειτουργία τέτοιων συστημάτων χωρίς αυστηρούς περιορισμούς και με ελεύθερη πρόσβαση στο Διαδίκτυο ή σε υπολογιστικά περιβάλλοντα μπορεί να τεθεί εκτός ελέγχου. Κρίσιμο στοιχείο σε αυτή την εξίσωση αποτελεί ο στόχος που θα δοθεί στο σύστημα, καθώς μπορεί είτε να προέρχεται από κακόβουλο χρήστη είτε να παρερμηνευθεί επικίνδυνα από την ίδια τη μηχανή.
Το πείραμα της OpenAI και η άμεση απειλή της κυβερνοασφάλειας
Ενδεικτικό της μετάβασης σε αυτόνομα συστήματα ικανά να αναλαμβάνουν εξολοκλήρου την εκτέλεση ενεργειών, είναι ένα πρόσφατο περιστατικό κατά τη διάρκεια εσωτερικών δοκιμών της OpenAI με την πλατφόρμα Hugging Face. Σύμφωνα με την τεχνική αποτίμηση της αμερικανικής εταιρείας, πράκτορες Τεχνητής Νοημοσύνης που συμμετείχαν σε ασκήσεις κυβερνοασφάλειας κατάφεραν με επιτυχία να παρακάμψουν τους περιορισμούς του περιβάλλοντος δοκιμών, να «αποδράσουν» στο Διαδίκτυο και να χρησιμοποιήσουν μη εγκεκριμένους διαύλους επικοινωνίας.
Για τον καθηγητή του MIT, η πλέον άμεση και επιστημονικά τεκμηριωμένη απειλή εντοπίζεται στη χρήση της ΤΝ για στοχευμένες κυβερνοεπιθέσεις. Τα ισχυρά, ανοικτά μοντέλα που κυκλοφορούν σήμερα μπορούν εύκολα να αξιοποιηθούν για την ανακάλυψη ψηφιακών ευπαθειών, την αυτοματοποίηση ηλεκτρονικών επιθέσεων και την πρόκληση κρίσιμων ζημιών. Στον αντίποδα, βέβαια, τα ίδια τεχνολογικά εργαλεία προσφέρουν πολύτιμες λύσεις άμυνας, εντοπίζοντας προβλήματα και παρακολουθώντας δίκτυα, ώστε οι ευπάθειες να διορθώνονται προτού τις εκμεταλλευτούν οι επιτιθέμενοι. Το συμπέρασμα του κ. Δασκαλάκη είναι απόλυτο: Η ασφάλεια δεν νοείται να αντιμετωπίζεται ως ένα δευτερεύον ζήτημα που θα λυθεί στο μέλλον, όταν τα μοντέλα θα έχουν αποκτήσει ακόμη μεγαλύτερη ισχύ.
Από το ιστορικό ερώτημα του Turing στο σαρωτικό ChatGPT
Αν και η έλευση της παραγωγικής Τεχνητής Νοημοσύνης στην καθημερινότητα εκατομμυρίων ανθρώπων ταυτίζεται με την κυκλοφορία του ChatGPT τον Νοέμβριο του 2022, η επιστημονική της αφετηρία τοποθετείται στη δεκαετία του 1950. Ήταν το 1950 όταν ο κορυφαίος μαθηματικός Alan Turing διατύπωσε το ιστορικό ερώτημα για το αν οι μηχανές μπορούν να σκέφτονται, ενώ η επίσημη θεμελίωση του κλάδου ήρθε το 1956 με το θερινό ερευνητικό πρόγραμμα στο Dartmouth.
Ακολούθησαν περίοδοι αλματώδους προόδου, αλλά και εκτεταμένης στασιμότητας, γνωστές ως «χειμώνες της ΤΝ». Οι ισορροπίες άλλαξαν ριζικά με την εξέλιξη της μηχανικής μάθησης. Το 1997, ο υπερυπολογιστής Deep Blue της IBM κέρδισε τον παγκόσμιο πρωταθλητή στο σκάκι, Γκάρι Κασπάροφ, ενώ το 2016 το σύστημα AlphaGo της Google DeepMind επικράτησε του κορυφαίου παίκτη στο απαιτητικό παιχνίδι Go, Λι Σεντόλ. Μόλις έναν χρόνο αργότερα, το 2017, παρουσιάστηκε η επαναστατική αρχιτεκτονική Transformer, η οποία έθεσε τα θεμέλια για την ανάπτυξη των σύγχρονων μεγάλων γλωσσικών μοντέλων.
Οι ενδοεταιρικοί τριγμοί και η απάντηση της Ευρωπαϊκής Ένωσης
Αυτή η φρενήρης ταχύτητα εξέλιξης έχει προκαλέσει έντονες ανησυχίες ακόμη και στο εσωτερικό των τεχνολογικών κολοσσών. Σημαντικοί ερευνητές έχουν επιλέξει να αποχωρήσουν από κορυφαία εργαστήρια, καταγγέλλοντας ότι η παραγωγή όλο και πιο ισχυρών μοντέλων προηγείται της ουσιαστικής έρευνας για τον ασφαλή έλεγχό τους. Ταυτόχρονα, υψηλόβαθμα στελέχη του κλάδου απαιτούν πλέον την καθιέρωση αυστηρότερων δοκιμών, τη διαφάνεια μέσω ανεξάρτητων αξιολογητών και τον κεντρικό συντονισμό κυβερνήσεων και τεχνολογικών εταιρειών. Ο σκοπός αυτών των προειδοποιήσεων δεν είναι να ανακοπεί η επιστημονική έρευνα, αλλά να εξασφαλιστεί η κατασκευή των απαραίτητων μηχανισμών προστασίας όσο τα μοντέλα γίνονται πιο αυτόνομα.
Απέναντι σε αυτό το παγκόσμιο διακύβευμα, η Ευρωπαϊκή Ένωση προχώρησε στη θέσπιση ενός ολοκληρωμένου πλαισίου κανόνων, το οποίο επιβάλλει διαφορετικές υποχρεώσεις στις εταιρείες, ανάλογα με το επίπεδο κινδύνου της εκάστοτε εφαρμογής. Ο πυρήνας της ευρωπαϊκής στρατηγικής έγκειται στον περιορισμό χρήσεων που απειλούν άμεσα την ασφάλεια και τα θεμελιώδη δικαιώματα των πολιτών, θέτοντας αυστηρές απαιτήσεις στα συστήματα υψηλού ρίσκου. Ωστόσο, το μεγάλο, αμείλικτο ερώτημα παραμένει: Όταν η τεχνολογία εξελίσσεται με ρυθμούς που ξεπερνούν την επιβολή των κανόνων, τον θεσμικό έλεγχο, ακόμα και την ίδια την ανθρώπινη κατανόηση, πόσο έτοιμος είναι τελικά ο πλανήτης να διαχειριστεί τις ολέθριες συνέπειές της;
ΔΙΑΒΑΣΤΕ ΕΠΙΣΗΣ:
- iPhone 18: Χαμός στο Σίδνεϊ για τον πρώτο αγοραστή – «Είμαι ο πρώτος!»
- Εσύ βλέπεις «Happy Human», η AI «Sorry Robot»: Η γραμματοσειρά με τα δύο μηνύματα
- Apple: Νέα εποχή με το iPhone Duo – Οι τιμές στην Ελλάδα, πότε θα κυκλοφορίσουν τα νέα μοντέλα
- Παραιτήθηκε από την Google DeepMind και προειδοποιεί: «Η AI μπορεί να μας σκοτώσει όλους – Ο χρόνος τελειώνει»
- Μπιλ Γκέιτς για AI: «Καμία κυβέρνηση δεν είναι έτοιμη» – «Είναι σαν εξωγήινη νοημοσύνη»
Η «Πελοπόννησος» και το pelop.gr σε ανοιχτή γραμμή με τον Πολίτη
Η φωνή σου έχει δύναμη – στείλε παράπονα, καταγγελίες ή ιδέες για τη γειτονιά σου.
Ακολουθήστε μας για όλες τις ειδήσεις στο Bing News και το Google News
Από το Δίκτυο
Ιστορική στιγμή για τα αποκαλυπτήρια του Μνημείου Περεσιάδη
Δεν σε παρακολουθούν μόνο οι smart τηλεοράσεις της LG το κάνουν όλες
Μικροσυνήθειες: Πώς ελάχιστα δευτερόλεπτα την ημέρα βελτιώνουν τη διάθεση μας
Ο Δημήτρης Παλούμπης με πολίτες στην Πλατεία Νόρμαν
Ήθελε να κατεβάσει Claude Code και του ήρθε λογαριασμός 87.000 ευρώ
