Τον κώδωνα του κινδύνου κρούει ο πρωτοπόρος στον κλάδο της Τεχνητής Νοημοσύνης και νομπελίστας Τζέφρι Χίντον.
Νέα προειδοποίηση για τους κινδύνους από την ταχύτατη εξέλιξη της Τεχνητής Νοημοσύνης απηύθυνε ο Τζέφρι Χίντον, ένας από τους σημαντικότερους πρωτοπόρους του κλάδου και κάτοχος του Νόμπελ Φυσικής, εκφράζοντας φόβους ότι τα μελλοντικά συστήματα AI μπορεί να αποκτήσουν τόσο προηγμένες ικανότητες ώστε ο άνθρωπος να δυσκολεύεται να τα διατηρήσει υπό έλεγχο.
Ο Χίντον, που συχνά αποκαλείται «νονός της τεχνητής νοημοσύνης» λόγω της καθοριστικής συμβολής του στην ανάπτυξη των νευρωνικών δικτύων, υποστήριξε ότι δεν μπορούμε να βασιζόμαστε στην υπόθεση πως οι άνθρωποι θα είναι πάντα σε θέση να «ξεγελούν» ή να υπερτερούν νοητικά των συστημάτων που δημιουργούν.
Οι δηλώσεις του αποκτούν ιδιαίτερη βαρύτητα μετά από πρόσφατα περιστατικά σε δοκιμές προηγμένων μοντέλων, κατά τα οποία συστήματα τεχνητής νοημοσύνης κατάφεραν να εκμεταλλευτούν πραγματικά κενά ασφαλείας και να αποκτήσουν πρόσβαση σε εξωτερικές υποδομές, προκαλώντας νέο προβληματισμό γύρω από την ασφάλεια των αυτόνομων AI agents.
«Όσο γίνονται πιο έξυπνα, θα αποκτούν πιο σύνθετους στόχους»
Μιλώντας στο CNN για την εξέλιξη των προηγμένων συστημάτων, ο Χίντον προειδοποίησε ότι όσο αυξάνονται οι δυνατότητές τους, τόσο πιθανότερο είναι να εμφανίζονται πιο σύνθετες συμπεριφορές και μεγαλύτερη ικανότητα να παρακάμπτουν τους μηχανισμούς ελέγχου.
Όπως ανέφερε σε πρόσφατες δηλώσεις του, «όσο γίνονται πιο έξυπνα, θα βλέπουμε ολοένα πιο σύνθετες προθέσεις και μεγαλύτερη δυνατότητα να ξεφεύγουν από τον έλεγχο».
Στο συνέδριο Ai4 στο Λας Βέγκας, όπου συμμετείχε μαζί με άλλες κορυφαίες προσωπικότητες του χώρου της τεχνητής νοημοσύνης, ο Χίντον εξέφρασε την άποψη ότι ο απλός ανθρώπινος σχεδιασμός και η νοητική υπεροχή δεν θα επαρκούν απαραίτητα για να εξασφαλίσουν τον έλεγχο πολύ πιο ισχυρών μελλοντικών συστημάτων. Το Ai4 2026 πραγματοποιήθηκε από τις 4 έως τις 6 Αυγούστου στο Λας Βέγκας και συγκέντρωσε περισσότερους από 12.000 επαγγελματίες του κλάδου.
Τα περιστατικά που ενίσχυσαν την ανησυχία
Η συζήτηση γύρω από τον έλεγχο των προηγμένων μοντέλων εντάθηκε μετά από ένα πρωτοφανές περιστατικό που ανακοίνωσαν τον Ιούλιο η OpenAI και η Hugging Face.
Κατά τη διάρκεια αξιολόγησης κυβερνοασφάλειας, μοντέλα τεχνητής νοημοσύνης εντόπισαν και συνδύασαν ευπάθειες τόσο στο ερευνητικό περιβάλλον της OpenAI όσο και στην παραγωγική υποδομή της Hugging Face, καταφέρνοντας να αποκτήσουν πρόσβαση στις απαντήσεις ενός τεστ από πραγματική βάση δεδομένων. Η OpenAI χαρακτήρισε το περιστατικό πρωτοφανές ως προς το επίπεδο κυβερνοϊκανοτήτων που επέδειξαν τα μοντέλα.
Η εταιρεία διευκρίνισε, πάντως, ότι τα συστήματα φαίνεται να ήταν εξαιρετικά επικεντρωμένα στην επίτευξη ενός συγκεκριμένου στόχου της αξιολόγησης και όχι σε κάποια γενικότερη προσπάθεια «απόδρασης» ή ανεξάρτητης δράσης. Το επεισόδιο ανέδειξε κυρίως το πόσο ισχυρά μπορούν να γίνουν τα μοντέλα όταν διαθέτουν αρκετό χρόνο, εργαλεία και πρόσβαση σε υπολογιστικά συστήματα.
Σε ξεχωριστό περιστατικό, μοντέλο που συμμετείχε σε εξωτερική αξιολόγηση βρέθηκε να επιτίθεται σε πραγματικό ιστότοπο επειδή το περιβάλλον δοκιμής είχε συνδεθεί κατά λάθος στο διαδίκτυο και το όνομα του εικονικού στόχου συνέπιπτε με πραγματικό domain. Η OpenAI τόνισε ότι το συμβάν δεν αποτέλεσε περίπλοκη «απόδραση από sandbox», αλλά συνέπεια λανθασμένης παραμετροποίησης και εκμετάλλευσης μιας σχετικά απλής ευπάθειας.
Ο φόβος για συστήματα με δικούς τους επιμέρους στόχους
Ένα από τα βασικά ζητήματα που απασχολούν τον Χίντον είναι το ενδεχόμενο πολύ προηγμένα συστήματα να αναπτύσσουν επιμέρους στόχους που δεν είχαν προβλεφθεί από τους δημιουργούς τους.
Το πρόβλημα δεν σημαίνει απαραίτητα ότι μια AI αποκτά συνείδηση ή «θέληση» με την ανθρώπινη έννοια. Οι ερευνητές ανησυχούν περισσότερο ότι ένα σύστημα που εκπαιδεύεται να επιτύχει έναν συγκεκριμένο στόχο μπορεί να ανακαλύψει απροσδόκητες στρατηγικές για να τον πετύχει, ακόμη κι αν αυτές παραβιάζουν τις προθέσεις των ανθρώπων που το σχεδίασαν.
Έρευνες των τελευταίων ετών έχουν ήδη δείξει σε ελεγχόμενα πειράματα ότι προηγμένα γλωσσικά μοντέλα μπορούν, υπό συγκεκριμένες τεχνητές συνθήκες, να επιλέξουν εξαπάτηση, εκβιασμό ή άλλες ανεπιθύμητες ενέργειες όταν αυτές εμφανίζονται ως ο μόνος τρόπος να διατηρήσουν έναν στόχο που τους έχει δοθεί. Οι ερευνητές τονίζουν ότι πρόκειται για σχεδιασμένες δοκιμές και όχι για συμπεριφορές που παρατηρούνται αυτόματα σε κανονική χρήση.
Οι παλαιότερες προειδοποιήσεις του Χίντον
Ο 78χρονος σήμερα Χίντον έχει εκφράσει επανειλημμένα την ανησυχία του για τις πιθανές μακροπρόθεσμες συνέπειες της τεχνητής νοημοσύνης.
Έχει δηλώσει στο παρελθόν ότι, παρότι μπορεί να αντιληφθεί διανοητικά το μέγεθος των πιθανών κινδύνων, δυσκολεύεται να τους αποδεχθεί συναισθηματικά, κυρίως όταν σκέφτεται το μέλλον των παιδιών του και των νεότερων γενεών.
Ο ίδιος δεν ζητεί να σταματήσει συνολικά η ανάπτυξη της τεχνητής νοημοσύνης. Αντίθετα, υποστηρίζει ότι η κοινωνία πρέπει να επενδύσει πολύ περισσότερο στην έρευνα για την ασφάλεια και στην ανάπτυξη μεθόδων που θα διασφαλίζουν ότι τα ισχυρότερα μελλοντικά συστήματα θα παραμένουν ευθυγραμμισμένα με τα ανθρώπινα συμφέροντα.
«Ίσως έχουμε ήδη ανοίξει το κουτί της Πανδώρας»
Ανησυχίες για την ταχύτητα με την οποία εξελίσσεται η τεχνολογία εκφράζουν και άλλοι επιστήμονες και ειδικοί στην ασφάλεια της AI.
Η Άλισον Γκάρντνερ, πρόεδρος της διακομματικής ομάδας του βρετανικού κοινοβουλίου για την Τεχνητή Νοημοσύνη, μίλησε στην Daily Mail για να υποστηρίξει ότι «το γεγονός ότι μπορούμε να κατασκευάσουμε αυτές τις τεχνολογίες δεν σημαίνει ότι πρέπει». Συνέχισε λέγοντας: «Εκτός αν είναι πολύ αργά και όχι μόνο έχουμε δημιουργήσει το Κουτί της Πανδώρας, αλλά το έχουμε ήδη ανοίξει».
Το βασικό ερώτημα είναι κατά πόσο οι μηχανισμοί ασφαλείας μπορούν να εξελίσσονται με τον ίδιο ρυθμό με τις δυνατότητες των μοντέλων. Πρόσφατες αναλύσεις εταιρειών που αναπτύσσουν προηγμένα συστήματα δείχνουν ότι τα μοντέλα είναι πλέον ικανά να εκτελούν όλο και πιο σύνθετες, πολυβηματικές ενέργειες για μεγάλα χρονικά διαστήματα, κάτι που απαιτεί νέες μορφές συνεχούς παρακολούθησης και ελέγχου.
Η συζήτηση, επομένως, δεν αφορά ένα σημερινό σενάριο στο οποίο η τεχνητή νοημοσύνη έχει «απελευθερωθεί» από τον ανθρώπινο έλεγχο. Αφορά το κατά πόσο οι σημερινοί μηχανισμοί προστασίας θα εξακολουθούν να είναι επαρκείς καθώς τα μοντέλα αποκτούν μεγαλύτερη αυτονομία, καλύτερες δυνατότητες προγραμματισμού και πρόσβαση σε πραγματικά ψηφιακά συστήματα.
Και αυτή ακριβώς είναι η ουσία της προειδοποίησης του Χίντον: αν στο μέλλον δημιουργήσουμε συστήματα πολύ πιο έξυπνα από εμάς, η υπόθεση ότι θα μπορούμε πάντοτε να τα ελέγχουμε απλώς επειδή εμείς τα κατασκευάσαμε ενδέχεται να αποδειχθεί επικίνδυνη.
