Ένα «φρένο έκτακτης ανάγκης» υπό τον έλεγχο εξουσιοδοτημένων ανθρώπων, ανεξάρτητοι μηχανισμοί εποπτείας και αυστηρότερες διαδικασίες ασφαλείας πρέπει να ενσωματώνονται στα προηγμένα συστήματα τεχνητής νοημοσύνης, σύμφωνα με τον διευθύνοντα σύμβουλο της Microsoft, Σάτια Ναντέλα. Η παρέμβασή του αναζωπυρώνει τη συζήτηση για τα όρια της τεχνολογίας και τον έλεγχο των ολοένα ισχυρότερων μοντέλων.
Τη θέσπιση ενός πλαισίου ασφαλείας που θα επιτρέπει στους ανθρώπους να παρεμβαίνουν άμεσα στη λειτουργία προηγμένων συστημάτων τεχνητής νοημοσύνης προτείνει ο Σάτια Ναντέλα. Ο πρόεδρος και διευθύνων σύμβουλος της Microsoft υποστηρίζει ότι τα μοντέλα πρέπει να διαθέτουν μηχανισμούς περιορισμού της λειτουργίας τους, ανεξάρτητους ελέγχους και ένα «φρένο έκτακτης ανάγκης», μέσω του οποίου εξουσιοδοτημένοι χειριστές θα μπορούν να διακόπτουν ή να απενεργοποιούν ένα μοντέλο ακόμη και όταν αυτό εκτελεί μια εργασία.
Σε ανάρτησή του στην πλατφόρμα X, ο Ναντέλα υπογράμμισε την ανάγκη να πλαισιωθούν τα μοντέλα που δεν λειτουργούν με απολύτως προβλέψιμο τρόπο από ένα αυστηρά σχεδιασμένο σύστημα ελέγχου. Όπως σημείωσε, απαιτούνται ανθρώπινη εποπτεία, αξιόπιστες επιχειρησιακές διαδικασίες και κοινά πρότυπα για ολόκληρο τον κλάδο, όπου οι υφιστάμενοι κανόνες δεν επαρκούν.
Ο επικεφαλής της Microsoft προτείνει, μάλιστα, τα προηγμένα μοντέλα τεχνητής νοημοσύνης, είτε είναι κλειστού κώδικα, είτε διατίθενται με ανοικτά βάρη, να αντιμετωπίζονται ως πιθανός εσωτερικός κίνδυνος για τους οργανισμούς που τα αναπτύσσουν ή τα χρησιμοποιούν. Η προσέγγιση αυτή παραπέμπει σε πρακτικές κυβερνοασφάλειας, όπου ακόμη και συστήματα που λειτουργούν εντός μιας επιχείρησης δεν θεωρούνται αυτομάτως αξιόπιστα, αλλά υπόκεινται σε διαρκή έλεγχο.
Η ασφάλεια της AI διχάζει τη Silicon Valley
Η παρέμβαση Ναντέλα έρχεται σε μια περίοδο κατά την οποία κορυφαία στελέχη και ερευνητές της τεχνολογίας εκφράζουν ανησυχίες ότι η ανάπτυξη των ισχυρότερων μοντέλων προχωρά ταχύτερα από τη δημιουργία επαρκών μηχανισμών ασφαλείας. Μεταξύ όσων έχουν τοποθετηθεί δημόσια για τους κινδύνους και την ανάγκη ισχυρότερων δικλίδων ασφαλείας περιλαμβάνονται ο συνιδρυτής της Microsoft, Μπιλ Γκέιτς, ο διευθύνων σύμβουλος της Anthropic, Ντάριο Αμοντέι, ο επικεφαλής της OpenAI, Σαμ Άλτμαν, και ο επικεφαλής της SpaceX, Έλον Μασκ.
Η συζήτηση δεν περιορίζεται πλέον στις γενικές αρχές υπεύθυνης ανάπτυξης της τεχνολογίας, αλλά επεκτείνεται στο κατά πόσο οι εταιρείες πρέπει να επιβραδύνουν την εξέλιξη των πιο προηγμένων μοντέλων τους. Τον προηγούμενο μήνα, ερευνητής της Anthropic αποχώρησε από την εταιρεία, κατηγορώντας τόσο αυτήν, όσο και την ανταγωνίστριά της OpenAI ότι διακινδυνεύουν ανθρώπινες ζωές. Την ίδια ημέρα, στέλεχος της Anthropic με αντικείμενο την ευθυγράμμιση της AI με τις ανθρώπινες αξίες και την ασφάλεια εκτίμησε ότι υπάρχει πιθανότητα άνω του 10% η τεχνολογία να οδηγήσει στην εξάλειψη της ανθρωπότητας μέσα στην επόμενη δεκαετία.
Οι εκτιμήσεις αυτές αποτυπώνουν το εύρος της διαφωνίας στον κλάδο: από όσους θεωρούν ότι απαιτούνται αυστηρότερη εποπτεία και βραδύτερος ρυθμός ανάπτυξης, έως εκείνους που δίνουν προτεραιότητα στην τεχνολογική υπεροχή και στην ταχεία αξιοποίηση των νέων δυνατοτήτων.
Η γραμμή Τραμπ και το νέο πλαίσιο εποπτείας
Στον αντίποδα των εκκλήσεων για επιβράδυνση, ο Ντόναλντ Τραμπ έχει απορρίψει επανειλημμένα τις προειδοποιήσεις για ενδεχόμενους υπαρξιακούς κινδύνους από την τεχνητή νοημοσύνη, δίνοντας έμφαση στην ανάγκη οι ΗΠΑ να διατηρήσουν το προβάδισμά τους έναντι της Κίνας. Η στάση αυτή αναδεικνύει τη σύγκρουση ανάμεσα στην επιδίωξη τεχνολογικής κυριαρχίας και στην απαίτηση για αυστηρότερες δικλίδες ασφαλείας.
Ωστόσο, η αμερικανική κυβέρνηση έχει προχωρήσει και σε πρωτοβουλίες εποπτείας του κλάδου. Πρόσφατα ανακοίνωσε τη δημιουργία της λεγόμενης “AI Force“, υπό τον διευθυντή της Εθνικής Υπηρεσίας Πληροφοριών, Τζέι Κλέιτον, με στόχο τη διευκόλυνση της ανάπτυξης της τεχνολογίας και τον εντοπισμό κακόβουλων παραγόντων. Η πρωτοβουλία δεν σηματοδοτεί κατ’ ανάγκην υιοθέτηση της πρότασης για επιβράδυνση της ανάπτυξης, αλλά δείχνει ότι η εποπτεία και η αντιμετώπιση καταχρήσεων βρίσκονται πλέον ψηλά στην αμερικανική ατζέντα.
Τα έξι επίπεδα ελέγχου που προτείνει η Microsoft
Στην ανάρτησή του, ο Ναντέλα περιέγραψε τις αρχές της «παρατηρησιμότητας» (observability), δηλαδή της δυνατότητας να παρακολουθείται και να ελέγχεται η συμπεριφορά ενός συστήματος τεχνητής νοημοσύνης. Η πρόταση περιλαμβάνει έξι βασικούς άξονες: ποικιλία μοντέλων, καταγραφή των ενεργειών τους με τρόπο κατανοητό στους ανθρώπους, συνεχή δοκιμή των συστημάτων, ανεξάρτητους μηχανισμούς ελέγχου και δυνατότητα ελέγχου των αποφάσεων, περιορισμό της λειτουργίας όταν απαιτείται και γνωστοποίηση περιστατικών ασφαλείας.
Η λογική είναι ότι η ασφάλεια δεν μπορεί να στηρίζεται αποκλειστικά στην εμπιστοσύνη προς ένα συγκεκριμένο μοντέλο ή στην εκτίμηση ότι θα συμπεριφέρεται πάντοτε όπως αναμένεται. Χρειάζεται ένα ευρύτερο τεχνικό και οργανωτικό πλαίσιο, το οποίο θα επιτρέπει την έγκαιρη αναγνώριση προβλημάτων, την παρέμβαση και την απόδοση ευθυνών όταν κάτι δεν λειτουργεί σωστά. Όπως χαρακτηριστικά έγραψε:
Το πιο αξιόπιστο σύστημα υπερνοημοσύνης δεν θα είναι εκείνο με το μοντέλο που εμπιστευόμαστε περισσότερο. Θα είναι εκείνο που μας επιτρέπει να εμπιστευόμαστε λιγότερο το μοντέλο

