Συναγερμός στην Google: Το Gemini AI παραβίασε κωδικούς και πραγματοποίησε κυβερνοεπιθέσεις

Ένα περιστατικό που δείχνει πόσο γρήγορα αλλάζει το τοπίο της κυβερνοασφάλειας καταγράφηκε κατά τη διάρκεια δοκιμής του Gemini, του μοντέλου τεχνητής νοημοσύνης της Google. Το σύστημα, το οποίο συμμετείχε σε ελεγχόμενη άσκηση κυβερνοασφάλειας, κατάφερε να αποκτήσει πρόσβαση σε τρία πραγματικά εταιρικά συστήματα, ενώ θεωρούσε ότι κινείται αποκλειστικά μέσα σε ένα εικονικό περιβάλλον δοκιμών.

Η δοκιμή πραγματοποιήθηκε τον Μάιο στο πλαίσιο άσκησης τύπου «capture the flag», μιας διαδικασίας που χρησιμοποιείται ευρέως για την αξιολόγηση των δυνατοτήτων κυβερνοασφάλειας. Οι συμμετέχοντες καλούνται να εντοπίσουν συγκεκριμένες πληροφορίες μέσα σε ειδικά διαμορφωμένα συστήματα και να αντιμετωπίσουν προσομοιωμένες επιθέσεις.

Στην περίπτωση του Gemini, όμως, η τεχνητή νοημοσύνη δεν περιορίστηκε τελικά στο περιβάλλον που είχε δημιουργηθεί για τη δοκιμή. Σύμφωνα με τα στοιχεία που έγιναν γνωστά, το μοντέλο χρησιμοποίησε δημόσια διαθέσιμες πληροφορίες από το διαδίκτυο και επιχείρησε να εντοπίσει στοιχεία σύνδεσης.

Σε μία από τις περιπτώσεις άρχισε να δοκιμάζει πιθανούς κωδικούς πρόσβασης σε προστατευμένο σύστημα μέχρι να αποκτήσει πρόσβαση. Σε δύο άλλες περιπτώσεις εντόπισε στοιχεία σύνδεσης μέσα σε δημόσια διαθέσιμο αποθετήριο κώδικα και τα χρησιμοποίησε για να εισέλθει σε άλλα προστατευμένα συστήματα.

Το στοιχείο που έκανε το περιστατικό ακόμη πιο σημαντικό ήταν η αιτία της σύγχυσης. Το Gemini είχε λάβει εντολή να αναζητήσει πληροφορίες σε ένα υποτιθέμενο περιβάλλον δοκιμών. Μία από τις εταιρείες που υπήρχαν στο σενάριο, όμως, είχε το ίδιο όνομα με πραγματική εταιρεία. Το μοντέλο δεν αντιλήφθηκε αρχικά τη διαφορά και συνέχισε τις ενέργειές του.

Όταν διαπίστωσε ότι είχε αποκτήσει πρόσβαση σε πραγματικά συστήματα και όχι στο εικονικό περιβάλλον της άσκησης, σταμάτησε. Και στις τρεις περιπτώσεις η διαδικασία διακόπηκε, ενώ οι οργανισμοί που επηρεάστηκαν ενημερώθηκαν.

Η Google προχώρησε παράλληλα σε αναθεώρηση των πρωτοκόλλων των συγκεκριμένων αξιολογήσεων. Το περιστατικό, ωστόσο, επαναφέρει στο προσκήνιο ένα ευρύτερο ζήτημα που απασχολεί πλέον έντονα την τεχνολογική κοινότητα: τι μπορεί να συμβεί όταν ένα μοντέλο τεχνητής νοημοσύνης αποκτά ολοένα περισσότερη αυτονομία.

Τα σύγχρονα AI agents δεν περιορίζονται στην παραγωγή κειμένου ή στην απάντηση μιας ερώτησης. Μπορούν να αναζητούν πληροφορίες, να χρησιμοποιούν ψηφιακά εργαλεία, να γράφουν κώδικα και να εκτελούν μια σειρά ενεργειών προκειμένου να πετύχουν έναν συγκεκριμένο στόχο.

Αυτό δημιουργεί σημαντικές δυνατότητες, αλλά παράλληλα αυξάνει και την ανάγκη για δικλίδες ασφαλείας. Ένα σύστημα που μπορεί να λαμβάνει πρωτοβουλίες και να πραγματοποιεί πολλαπλά βήματα χωρίς συνεχή ανθρώπινη παρέμβαση χρειάζεται σαφή όρια ως προς το τι επιτρέπεται να κάνει, σε ποια δεδομένα μπορεί να έχει πρόσβαση και πότε πρέπει να σταματά.

Η τεχνητή νοημοσύνη χρησιμοποιείται ήδη και στην κυβερνοασφάλεια, τόσο για τον εντοπισμό ευπαθειών όσο και για την αντιμετώπιση επιθέσεων. Την ίδια στιγμή, όμως, οι ίδιες δυνατότητες μπορούν να αξιοποιηθούν από κακόβουλους χρήστες.

Το περιστατικό με το Gemini δεν αποτελεί από μόνο του απόδειξη ότι η τεχνητή νοημοσύνη δρα ανεξέλεγκτα. Δείχνει όμως πόσο λεπτή μπορεί να γίνει η γραμμή ανάμεσα σε μια ελεγχόμενη δοκιμή και σε μια πραγματική ενέργεια, όταν ένα σύστημα έχει τη δυνατότητα να συλλέγει πληροφορίες, να παίρνει αποφάσεις και να εκτελεί εντολές με ολοένα μεγαλύτερο βαθμό αυτονομίας.