Κάτι πρωτοφανές στον κόσμο της τεχνολογίας συνέβη προ ημερών και έκανε μεγάλη εντύπωση σε όλο τον κόσμο, δεν αποκλείεται καθόλου να επαναληφθεί και σύντομα να μην μας κάνει πια εντύπωση. Αναφερόμαστε στο συμβάν που μας γνωστοποίησε προχθές η OpenAI, μία από τις δύο σημαντικότερες επιχειρήσεις στον τομέα των μοντέλων Τεχνητής Νοημοσύνης (η άλλη είναι η Anthropic). Ο τίτλος της ανακοίνωσης που εξέδωσε το απόγευμα της Τρίτης η OpenAI έλεγε πως «η OpenAI και η Hugging Face συνεργάζονται για την αντιμετώπιση ενός προβλήματος ασφαλείας που εμφανίστηκε κατά την διάρκεια της αξιολόγησης ενός μοντέλου.
Περιγράφοντας αυτό το πρόβλημα, η ανακοίνωση ανέφερε πως την προηγούμενη εβδομάδα η Hugging Face γνωστοποίησε ένα νέο είδος συμβάντος που σχετίζεται με την ασφάλεια συστημάτων. Συγκεκριμένα, η Hugging Face (startup εταιρεία που δραστηριοποιείται σε συστήματα Τεχνητής Νοημοσύνης) εντόπισε και αντιμετώπισε έναν AI agent (έναν ψηφιακό βοηθό Τεχνητής Νοημοσύνης) που παραβίασε το σύστημα ασφαλείας των ψηφιακών υποδομών της. Η OpenAI παρατήρησε μάλιστα πως αυτό αναμένεται να συμβαίνει συχνά καθώς αυξάνονται οι ψηφιακές δυνατότητες των μοντέλων ΤΝ. Μπαίνοντας σε περισσότερες λεπτομέρειες, η ανακοίνωση επισήμανε πως το παραπάνω συμβάν προκλήθηκε από τον συνδυασμό δύο μοντέλων της OpenAI, του GPT 5.6 Sol και ενός ακόμα πιο προηγμένου που δεν έχει ακόμα κυκλοφορήσει, κατά την διάρκεια εσωτερικών δοκιμών αξιολόγησης των ψηφιακών τους δυνατοτήτων.
Όπως εξήγησε παραπέρα, κατά την διάρκεια των δοκιμών τέτοιου τύπου, τα μοντέλα δουλεύουν με αυξημένους βαθμούς ελευθερίας καθώς οι ερευνητές της θέλουν να βλέπουν πραγματικά για τι είναι ικανά. Για να μην συνεχίσουμε με πολλές τεχνικές λεπτομέρειες, φαίνεται πως τα μοντέλα της OpenAI ουσιαστικά έσπασαν το εξωτερικό δίκτυο ασφαλείας της Hugging Face και μπήκαν μέσα στα συστήματά της, εκμεταλλευόμενα ένα προσωρινό κενό ασφαλείας. Μόλις βρέθηκαν εκεί, τα μοντέλα βρήκαν τρόπο να αποκτήσουν πρόσβαση σε μυστικές πληροφορίες και να εκτελέσουν διάφορες εργασίες, επιτρεπόμενες και απαγορευμένες, χωρίς να γίνουν αντιληπτά από το σύστημα αξιολόγησης.
Σε ένα τέτοιο παράδειγμα, χρησιμοποίησαν κλεμμένους κωδικούς πρόσβασης και κατάφεραν να δώσουν εντολές στους servers της Hugging Face. Τελικά, οι υπεύθυνοι ασφαλείας της Hugging Face, μαζί με τους δικούς τους ψηφιακούς βοηθούς (agents), εντόπισαν και σταμάτησαν την μη εξουσιοδοτημένη δραστηριότητα μέσα στα ψηφιακά συστήματα υποδομής της εταιρείας και στην συνέχεια ενημέρωσαν την OpenAI αφού είχαν ήδη αρχίσει τις ενέργειες περιορισμού και αποκατάστασης των προβλημάτων που δημιούργησε αυτή η παραβίαση. Σύμφωνα με την ανακοίνωση, οι αρμόδιοι των δύο επιχειρήσεων συνεχίζουν να εξετάζουν από κοινού το παραπάνω συμβάν.
Η ανακοίνωση της OpenAI συνέχισε με αναφορές στην προσέγγιση της πάνω σε ζητήματα ασφαλείας που σχετίζονται με την ανάπτυξη και εξέλιξη των μοντέλων Τεχνητής Νοημοσύνης. Με αφορμή το συμβάν επισήμανε πως το βασικό μάθημα είναι πως η ασφάλεια των μοντέλων θα πρέπει να συμβαδίζει με τις ταχέως αυξανόμενες ψηφιακές τους δυνατότητες και τόνισε πως η ίδια ενισχύει όλες τις διαδικασίες που ακολουθεί κατά την ανάπτυξη και δοκιμή των μοντέλων. Πρόσθεσε επίσης πως το συμβάν αυτό έδειξε πέρα από κάθε αμφιβολία πως τα προηγμένα μοντέλα μπορούν να ανακαλύψουν και να εκμεταλλευθούν νέους τρόπους επίθεσης σε πραγματικά ψηφιακά συστήματα και έκανε ακόμα πιο φανερή την ανάγκη της ανάπτυξης των νέων ψηφιακών δυνατοτήτων παράλληλα με την επιβολή πιο αυστηρών περιοριστικών συστημάτων και αμυντικών εργαλείων.
Ο θόρυβος που προκλήθηκε από τις προχθεσινές ανακοινώσεις για το «πρωτοφανές συμβάν» το οποίο η OpenAI εκτιμά πως είναι σχεδόν βέβαιο πως θα ξαναδούμε σύντομα, ξαναφέρνει στο προσκήνιο την συζήτηση που είχε γίνει πριν μερικούς μήνες γύρω από τις δυνατότητες του μοντέλου Τεχνητής Νοημοσύνης Mythos της Anthropic (Πώς το Anthropic Mythos τρομοκράτησε την διεθνή χρηματοοικονομική βιομηχανία | Liberal.gr). Όπως είχαμε δει τότε, οι ερευνητές που συνεργάζονταν με την μεγάλη ανταγωνίστρια της OpenAI είχαν ανακαλύψει πως αυτό το μοντέλο μπορούσε να οργανώσει μόνο του μεγάλη ψηφιακή ληστεία τράπεζας, ανάμεσα σε πολλά άλλα.
Έχουν περάσει τρεις μήνες από τότε και φυσικά κανείς δεν νοιώθει πραγματικά πιο ήσυχος σχετικά με την ψηφιακή ασφάλεια στην εποχή της Τεχνητής Νοημοσύνης. Παρά το γεγονός πως με το ζήτημα έχουν ασχοληθεί και πολλές κυβερνήσεις και οργανισμοί όπως οι μεγάλες κεντρικές τράπεζες, τα πράγματα δεν είναι και πολύ ξεκάθαρα, καθώς καμία πλευρά δεν θέλει να δεσμευτεί την στιγμή που βρίσκονται σε εξέλιξη σημαντικές διαμάχες γύρω από το μέλλον της Τεχνητής Νοημοσύνης. Οι μεγάλες αμερικανικές εταιρείες, κυρίως η OpenAI και η Anthropic, προσπαθούν να κρατήσουν για τον εαυτό τους τα μυστικά των μοντέλων τους, χτίζοντάς τους πάνω σε κλειστά μοντέλα για τα οποία δεν επιθυμούν να γνωστοποιούν καμία λεπτομέρεια.
Αυτό σε αντίθεση με την κινεζική τεχνολογική βιομηχανία που βασίζεται πάνω σε ανοικτό κώδικα (open source) για την ανάπτυξη των μοντέλων της. Όπως διαβάζουμε στον διεθνή Τύπο, οι μεγάλες αμερικανικές εταιρείες προσπαθούν να πείσουν πως τα δικά τους μοντέλα είναι πιο ασφαλή και προθυμοποιούνται να δεχτούν τον κρατικό έλεγχο της ασφάλειας τους, προωθώντας παράλληλα την άποψη πως τα μοντέλα open source είναι πιο επικίνδυνα. Επικριτές των δύο μεγάλων του τομέα υποστηρίζουν πως η Anthropic και η OpenAI, προσπαθούν στην ουσία να περιορίσουν τον ισχυρό και ανερχόμενο ανταγωνισμό από την μεριά των μοντέλων open source.
Στο παιχνίδι είναι και οι κυβερνήσεις των ΗΠΑ και της Κίνας, οι οποίες θέλουν να βοηθήσουν τις δικές τους επιχειρήσεις να κυριαρχήσουν διεθνώς στον τομέα, συζητώντας πολύ σοβαρά την πιθανότητα επιβολής περιορισμών στην χρήση των μοντέλων που προέρχονται από τον αντίπαλο. Οι ΗΠΑ φαίνεται πως σκέφτονται την ουσιαστική απαγόρευση των κινεζικών μοντέλων open source χαρακτηρίζοντάς τα ως επικίνδυνα για την κυβερνοασφάλεια, ενώ η Κίνα ετοιμάζεται να επιβάλει περιορισμούς στην πρόσβαση των ξένων επιχειρήσεων στα κινεζικά μοντέλα open source, επικαλούμενη και αυτή ζητήματα ασφαλείας. Οι ΗΠΑ έχουν ήδη δείξει έτοιμες να απαγορεύσουν την πρόσβαση στα προηγμένα μοντέλα των δύο μεγάλων αμερικανικών εταιρειών για διεθνείς εταιρείες, ακόμα και από την Ευρωπαϊκή Ένωση.
Την ίδια στιγμή που γίνεται τόσος λόγος για τον ανταγωνισμό μεταξύ ΗΠΑ και Κίνας, δεν φαίνεται να υπάρχει διάθεση συνεργασίας στο θέμα της ασφάλειας των συστημάτων και της δημιουργίας ισχυρών ασφαλιστικών δικλείδων που να περιορίζουν δραστικά την δυνατότητα των μοντέλων και των ψηφιακών βοηθών τύπου AI agents να κινηθούν αυτόνομα και να αναλάβουν τον ρόλο των hackers.
Όπως φαίνεται, το πιθανότερο είναι να εμπιστευθούμε την ασφάλεια αυτών των συστημάτων στις ίδιες τις εταιρείες και στην πιθανή συνεργασία τους με κρατικές αρχές που δεν πρόκειται να μοιραστούν με εμάς τους προβληματισμούς τους. Αυτό δεν είναι κατ’ ανάγκην κακό αλλά είναι αλήθεια πως μας κάνει να νοιώθουμε ανασφάλεια, καθώς έχει αποδειχθεί πως αρκετές φορές η καλή θέληση των επιχειρήσεων δεν είναι αρκετή στα θέματα ασφαλείας, ψηφιακά ή παραδοσιακά. Καθώς όμως δεν έχουμε ουσιαστική δυνατότητα να παρέμβουμε, θα πρέπει μάλλον να περιοριστούμε στο να είμαστε διπλά και τριπλά προσεκτικοί όταν χειριζόμαστε οποιοδήποτε μοντέλο Τεχνητής Νοημοσύνης ή αποφασίσουμε να αποκτήσουμε τον δικό μας AI agent. Καλή μας τύχη.
