Στο επίκεντρο της συζήτησης για την ασφάλεια των αυτόνομων συστημάτων τεχνητής νοημοσύνης βρίσκεται δοκιμή του Gemini της Google, κατά την οποία το μοντέλο απέκτησε πρόσβαση σε συστήματα τριών εταιρειών κυβερνοασφάλειας.
Το περιστατικό σημειώθηκε τον Μάιο, στο πλαίσιο αξιολόγησης που πραγματοποίησε η ανεξάρτητη εταιρεία Irregular. Σύμφωνα με δημοσιεύματα, το Gemini εντόπισε δημόσια διαθέσιμες πληροφορίες στο διαδίκτυο και χρησιμοποίησε διαπιστευτήρια που εντόπισε ή υπέθεσε, προκειμένου να αποκτήσει πρόσβαση σε ιστοτόπους που περιλαμβάνονταν στο πεδίο της δοκιμής.
Σε μία περίπτωση, το μοντέλο φέρεται να δοκίμασε επανειλημμένα διαφορετικούς κωδικούς, ενώ σε δύο ακόμη εντόπισε ευαίσθητα διαπιστευτήρια σε δημόσιο αποθετήριο. Η Google ανέφερε ότι το Gemini σταμάτησε πριν προχωρήσει σε παραβίαση ή εξαγωγή δεδομένων και ότι οι επηρεαζόμενοι οργανισμοί ενημερώθηκαν για τη λήψη διορθωτικών μέτρων.
Αντίστοιχα περιστατικά έχουν καταγραφεί σε δοκιμές συστημάτων και άλλων εταιρειών, μεταξύ των οποίων οι Meta, Anthropic και OpenAI, σύμφωνα με την Irregular.
Η εξέλιξη αναδεικνύει τις προκλήσεις που δημιουργεί η αυξανόμενη αυτονομία των AI agents, καθώς αποκτούν δυνατότητα αλληλεπίδρασης με πραγματικά υπολογιστικά συστήματα. Το περιστατικό ενισχύει τη συζήτηση για την ανάγκη αυστηρότερων δικλίδων ασφαλείας και νέων πρακτικών αξιολόγησης των αυτόνομων μοντέλων.



