Η OpenAI σε ανακοίνωσή της παραδέχεται πως η διαχείριση της τεχνητής νοημοσύνης δεν ήταν σωστή και πως τα μοντέλα της απέκτησαν μη εξουσιοδοτημένη πρόσβαση σε αυστραλιανές κυβερνητικές ιστοσελίδες. Για αυτό, ανακοινώνει μια σειρά από αλλαγές, ώστε να ενισχύσει την ασφάλεια των AI Agents.
Στην ανακοίνωση της εταιρείας, διαβάζουμε πως τα περιστατικά αυτά συνέβησαν τον Ιούνιο του 2026, κατά τη διάρκεια εσωτερικής εκπαίδευσης και αξιολόγησης των μοντέλων της εταιρείας. Συνεχίζει αναγνωρίζοντας πως θα έπρεπε να έχει ενημερώσει τις αυστραλιανές αρχές νωρίτερα για όσα έκαναν οι AI Agents της εταιρείας.
Τι συνέβη
Σύμφωνα με τις μελέτες της OpenAI, υπήρξαν τέσσερις διαφορετικές περιπτώσεις που εμφανίστηκαν στην εξέταση των δεδομένων από παλαιότερες δοκιμές.
Στην πιο σοβαρή, ένα εσωτερικό πειραματικό μοντέλο κατάφερε να αποκτήσει μη δημόσια πρόσβαση στο Medicare Statistics Reporting Service της Services Australia. Το μοντέλο εκτέλεσε εντολές, ανέκτησε εσωτερικά αρχεία, credentials και συγκεντρωτικά στατιστικά στοιχεία και έγραψε αρχεία στο σύστημα. Η OpenAI αναφέρει ότι δεν υπάρχουν στοιχεία πως αποκτήθηκαν ατομικά ιατρικά ή προσωπικά αρχεία ασθενών. Βέβαια, από τη στιγμή που παραβίασε την ασφάλεια, απέκτησε δεδομένα που δεν είναι δημόσια και έγραψε αρχεία στο σύστημα. Πρακτικά αυτό ήταν hack και μάλιστα χωρίς καμία εξουσιοδότηση από τις αρχές. Σε οποιαδήποτε άλλη περίπτωση, αν ήταν κάποιος χρήστης πίσω από αυτές τις επιθέσεις, θα ήταν αντιμέτωπος με σύλληψη και πιθανότατα φυλακή.
Η εργασία που είχε δοθεί στο μοντέλο ήταν πολύ πιο απλή. Έπρεπε να βρει στοιχεία για τις κρατικές δαπάνες ανά άτομο για φάρμακα που αφορούν δερματικές παθήσεις σε κοινότητες της Βικτώριας. Όταν δυσκολεύτηκε να βρει την πληροφορία, αναζήτησε άλλους τρόπους πρόσβασης και τελικά ξεπέρασε τα όρια που του είχαν τεθεί. Αυτό δείχνει με τον καλύτερο τρόπο τον κίνδυνο που ενέχουν τα μοντέλα τεχνητής νοημοσύνης.
Οι υπόλοιπες περιπτώσεις
Τα δεδομένα έδειξαν πως έγιναν άλλες τρεις επιθέσεις σε αυστραλιανές υπηρεσίες. Στο NSW Bureau of Crime Statistics and Research, ένα μοντέλο χρησιμοποίησε το δημόσιο Crime Mapping Tool για να αναζητήσει δημόσια στατιστικά στοιχεία. Η υπηρεσία επέστρεψε στοιχεία διαμόρφωσης, λειτουργικές εργασίες, logs και metadata, όμως δεν αποκτήθηκαν αρχεία εγκληματικότητας που αφορούν συγκεκριμένα άτομα. Και σε αυτή την περίπτωση, η OpenAI απέκτησε δεδομένα για τα οποία δεν είχε την άδεια.
Στο Victorian Department of Health, agents της OpenAI εντόπισαν ένα εκτεθειμένο access key και το χρησιμοποίησαν για να ανακτήσουν ρυθμίσεις του συστήματος και συγκεντρωτικά στοιχεία ερευνών. Η OpenAI αναφέρει ότι δεν αποκτήθηκαν ατομικά ιατρικά αρχεία ή αναγνωρίσιμες απαντήσεις συμμετεχόντων. Όμως κάθε φορά που ένας AI Agent αποκτά πρόσβαση σε υπηρεσίες υγείας, δείχνει για μια ακόμα φορά πόσο επικίνδυνοι μπορούν να γίνουν.
Στην περίπτωση του Australian Institute of Health and Welfare, τα μοντέλα ανέκτησαν συγκεντρωτικά στατιστικά από τον ιστότοπο και χρησιμοποίησαν υπηρεσίες περιήγησης και λήψης τρίτων. Οι προσπάθειες παράκαμψης ελέγχων πρόσβασης απέτυχαν και το υλικό που κατέβηκε φαίνεται πως ήταν ήδη δημόσια διαθέσιμο. Η OpenAI αναφέρει ότι δεν υπήρξε παραβίαση συστήματος.
Αυτές οι επιθέσεις προκαλούν ανησυχίες και όχι άδικα. Πρόσφατα είχαμε περιστατικό όπου AI Agent άλλαξε τις καταχωρήσεις σε γυμναστήριο, ώστε ο χρήστης να βρει θέση σε μάθημα πιλάτες. Τι θα γινόταν αν ένας AI Agent αποκτούσε πρόσβαση σε δομές υγείας και έκανε το ίδιο, ακυρώνοντας ραντεβού για χειρουργεία ανθρώπων που έχουν πραγματικά σοβαρά προβλήματα;
Η OpenAI αναγκάζεται να αλλάξει τις δοκιμές της
Τον Ιούλιο είχαμε το περιστατικό με το hack στο Hugging Face, που πήρε διαστάσεις και η OpenAI ξεκίνησε έρευνες, ώστε να ενισχύσει τα μέτρα ασφαλείας στα ερευνητικά περιβάλλοντα. Μέσα σε αυτά είναι ο περιορισμός δικτύου και ένα πιο εκτεταμένο monitoring, ενώ πλέον μπλοκάρει την πρόσβαση στο διαδίκτυο στα περιβάλλοντα δοκιμών.
Αυτός είναι και ο λόγος που η OpenAI έχει ήδη παγώσει την εκπαίδευση και των νεότερων και πιο ικανών μοντέλων της και θα την επαναφέρει μόνο όταν θεωρήσει πως υπάρχουν επαρκείς δικλείδες ασφαλείας, ώστε να μην έχουμε επαναλήψεις των επιθέσεων.
Βέβαια, δεν είναι μόνο η OpenAI που έχει παρόμοια προβλήματα, καθώς και η Anthropic, όπως και η Google έχουν εμφανίσει παρόμοιες συμπεριφορές. Αυτό δείχνει πως δεν είναι μόνο τα μοντέλα της OpenAI που έχουν τέτοια προβλήματα, αλλά είναι ένα γενικότερο πρόβλημα της τεχνητής νοημοσύνης σαν τεχνολογία.
Η OpenAI δημιουργεί ειδική ομάδα στην Αυστραλία
Η OpenAI ανακοίνωσε ακόμη ότι θα διαθέσει πόρους και τεχνική υποστήριξη στις αυστραλιανές αρχές, ενώ θα δημιουργήσει μια ειδική taskforce με ανεξάρτητους Αυστραλούς ειδικούς. Στόχος της ομάδας θα είναι να εξετάσει και πρακτικές προτάσεις για τον περιορισμό των κινδύνων από τα πιο ικανά μοντέλα που τρέχουν οι AI Agents.
Η εν λόγω ομάδα θα αναλαμβάνει και την ενημέρωση των αρχών, όπως επίσης και τον συντονισμό μεταξύ των κυβερνήσεων και των εταιρειών τεχνητής νοημοσύνης. Με αυτόν τον τρόπο θέλει να δημιουργήσει μια αμφίδρομη σχέση ανάμεσα στους εμπλεκόμενους για την προστασία των κυβερνητικών συστημάτων.
Το επόμενο βήμα θα λάβει χώρα στις 6 Οκτωβρίου, όπου ο Jason Kwon, Chief Strategy Officer της OpenAI, θα καταθέσει ενώπιον της Joint Select Committee on Artificial Intelligence στο Σίδνεϋ, όπου θα απαντήσει σε ερωτήσεις για το τι συνέβη και για τα μέτρα που λαμβάνει πλέον η εταιρεία. Εκεί πιθανότατα θα μάθουμε περισσότερες λεπτομέρειες για όσα προκάλεσαν αυτό το μπαράζ επιθέσεων από την τεχνητή νοημοσύνη.
Η OpenAI χαρακτηρίζει το περιστατικό σαν ένα είδος κυβερνοπεριστατικού, που προέκυψε καθώς η AI αποκτά τη δυνατότητα να αναζητά πληροφορίες και να χρησιμοποιεί εργαλεία.
Η εταιρεία αναγνωρίζει ότι η αντιμετώπιση τέτοιων περιστατικών απαιτεί πλέον όχι μόνο καλύτερα μοντέλα, αλλά και καλύτερα όρια, παρακολούθηση και συνεργασία με τους οργανισμούς που μπορεί να επηρεαστούν.
Με τη ματιά του Techmaniacs
Όσο προχωρούν οι έρευνες τόσο στην OpenAI όσο και στις υπόλοιπες εταιρείες τεχνητής νοημοσύνης, τόσο εμφανίζονται επιθέσεις που έχουν πραγματοποιηθεί και μέχρι σήμερα δεν το γνωρίζαμε καν.
Η OpenAI, με το να αποκαλεί τις επιθέσεις σαν κυβερνοπεριστατικά, είναι σαν να προσπαθεί να τις υποβαθμίσει. Η παραβίαση κυβερνητικών υποδομών δεν είναι σε καμία περίπτωση ένα απλό κυβερνοπεριστατικό, αλλά κάτι πολύ πιο σοβαρό.
Χρειαζόμαστε επειγόντως νομοθετικό πλαίσιο που να καθορίζει ποιος είναι υπεύθυνος για παρόμοια περιστατικά και φυσικά να υπάρχουν και οι αντίστοιχες κυρώσεις. Προσωπικά θέλω να βλέπω την τεχνητή νοημοσύνη σαν ένα μικρό παιδί. Νομικά υπόλογος είναι πάντα ο γονιός για οποιαδήποτε παράνομη συμπεριφορά ενδέχεται να αναπτύξει ένα μικρό παιδί και φυσικά ο γονιός έχει τις ανάλογες κυρώσεις.
Η κυβέρνηση των ΗΠΑ μπορεί να έχει δώσει λευκή επιταγή στις εταιρείες τεχνητής νοημοσύνης, ώστε να κάνουν ό,τι θέλουν χωρίς περιορισμούς και κυρώσεις, όμως αυτή η λευκή επιταγή δεν μπορεί να ισχύει παγκοσμίως. Τι θα γίνει αν την επόμενη φορά ένας AI Agent χρειαστεί πληροφορίες για στρατιωτικό εξοπλισμό; Θα παραβιάσει στρατιωτικές υποδομές;