Η OpenAI πάγωσε την εκπαίδευση των τελευταίων μοντέλων τεχνητής νοημοσύνης της, μετά την αποκάλυψη μιας σειράς περιστατικών στα οποία AI agents της εταιρείας κινήθηκαν με τρόπους που δεν είχαν προβλεφθεί. Η εταιρεία αναφέρει ότι η εκπαίδευση θα συνεχιστεί μόνο όταν υπάρχουν πρόσθετες δικλίδες ασφαλείας.
Η απόφαση ήρθε λίγες ώρες αφότου η OpenAI γνωστοποίησε ότι εξετάζει περιστατικά από το καλοκαίρι, στα οποία agents που αναζητούσαν πληροφορίες σε ομοσπονδιακές κυβερνητικές ιστοσελίδες των ΗΠΑ έκαναν ενέργειες πέρα από αυτές που τους είχαν ζητηθεί.
Τι έκαναν οι AI agents
Σε μία από τις περιπτώσεις, που αφορούσε το Department of Education των ΗΠΑ, οι agents εντόπισαν λεγόμενα developer keys, τα οποία μπορούσαν να χρησιμοποιηθούν για πρόσβαση σε κυβερνητικά δεδομένα. Σύμφωνα με το AP, τελικά συγκεντρώθηκαν μόνο δημόσια διαθέσιμες πληροφορίες, ενώ το αμερικανικό υπουργείο Παιδείας δήλωσε ότι δεν βρήκε στοιχεία που να δείχνουν επίδραση στην ιστοσελίδα ή στις βάσεις δεδομένων του.
Σε διαφορετικό περιστατικό, που αφορούσε την Επιτροπή Κεφαλαιαγοράς των ΗΠΑ (SEC), οι agents εντόπισαν πληροφορίες που ήταν ήδη δημόσιες και στη συνέχεια τις ανέβασαν σε άλλο σημείο του διαδικτύου, παρότι κάτι τέτοιο δεν περιλαμβανόταν στις αρχικές οδηγίες τους. Η SEC επιβεβαίωσε ότι δεν αποκτήθηκαν μη δημόσιες πληροφορίες.
Αυτό είναι το στοιχείο που απασχολεί ιδιαίτερα τους ερευνητές. Το πρόβλημα δεν ήταν απαραίτητα ότι οι agents απέκτησαν ευαίσθητα δεδομένα, αλλά ότι πήραν μόνοι τους επιπλέον πρωτοβουλίες για να ολοκληρώσουν μια εργασία.
Η OpenAI βάζει προσωρινά φρένο
Η εταιρεία δήλωσε ότι θα επαναφέρει την εκπαίδευση των μοντέλων μόνο όταν είναι βέβαιη ότι έχουν προστεθεί επαρκείς πρόσθετες δικλίδες ασφαλείας.
Παράλληλα, η OpenAI προειδοποίησε ότι πιθανότατα θα χρειαστεί να ξαναπατήσει το κουμπί της παύσης και στο μέλλον, καθώς τα συστήματα τεχνητής νοημοσύνης εξελίσσονται και εμφανίζονται νέα προβλήματα.
Πρόκειται μάλιστα για τη δεύτερη φορά μέσα σε τρεις μήνες που η εταιρεία σταματά την ανάπτυξη μοντέλων της. Η προηγούμενη διακοπή έγινε τον Ιούλιο, μετά την αποκάλυψη κυβερνοεπίθεσης που στόχευσε την AI startup Hugging Face. Ο CEO της OpenAI, Sam Altman, έχει χαρακτηρίσει εκείνο το περιστατικό ως το σοβαρότερο που έχει αντιμετωπίσει μέχρι σήμερα η εταιρεία.
Υπάρχουν και μη επιβεβαιωμένες αναφορές
Η εταιρεία αξιολόγησης AI Transluce ανέφερε ξεχωριστά ότι agents που φέρονταν να προέρχονται από την OpenAI προσπάθησαν ανεπιτυχώς να παραβιάσουν ιστοσελίδα του Department of Education. Η συγκεκριμένη πληροφορία δεν έχει επιβεβαιωθεί από την OpenAI.
Η εξέλιξη αυτή έρχεται σε μια περίοδο κατά την οποία αυξάνονται οι συζητήσεις για το πόσο γρήγορα πρέπει να αναπτύσσονται οι πιο ισχυροί AI agents και πόσο αυστηρά πρέπει να περιορίζονται όταν αποκτούν πρόσβαση σε πραγματικά εργαλεία και υπηρεσίες.
Το βασικό ζήτημα πλέον δεν είναι μόνο τι μπορεί να απαντήσει ένα AI μοντέλο, αλλά τι αποφασίζει να κάνει όταν του δίνεται η δυνατότητα να ενεργήσει μόνο του. Η OpenAI δείχνει πλέον ότι θεωρεί αυτή τη διαφορά αρκετά σημαντική ώστε να σταματήσει προσωρινά την εκπαίδευση των νέων μοντέλων της.
Με τη ματιά του Techmaniacs
Από το καλοκαίρι έχουμε πολλά περιστατικά, όπου AI Agents πραγματοποιούν επιθέσεις σε υπηρεσίες και σελίδες, προκειμένου να πάρουν τις πληροφορίες που ζητάνε οι χρήστες ή για να κάνουν τις ενέργειες που τους έχουν ζητηθεί, χωρίς όμως ο χρήστης τους να έχει ζητήσει να γίνουν παράνομες δραστηριότητες. Ενώ οι ειδικοί φωνάζουν πως πρέπει να μπει φρένο στην ανάπτυξη των μοντέλων μέχρι να βρούμε τρόπους να περιορίζουμε τέτοια περιστατικά, η κυβέρνηση των ΗΠΑ θέλει μια τεχνητή νοημοσύνη χωρίς περιορισμούς.
Τώρα όμως που τα μοντέλα της OpenAI πραγματοποίησαν επιθέσεις σε αμερικανικές υπηρεσίες, η OpenAI θυμήθηκε πως η τεχνητή νοημοσύνη της είναι επικίνδυνη και πρέπει να σταματήσει η εκπαίδευσή της. Όταν το ίδιο έγινε με τις υπηρεσίες υγείας της Αυστραλίας όμως, δεν είχαμε καμία απολύτως δήλωση ή κίνηση.
Χρειαζόμαστε επειγόντως νομοθετικό πλαίσιο που να ορίζει τη λειτουργία της AI και τη χρήση της. Το να αφήνουμε την τεχνητή νοημοσύνη να κάνει ό,τι θέλει στο διαδίκτυο, είναι μια ωρολογιακή βόμβα που περιμένει να εκραγεί. Δυστυχώς όμως, για ένα τόσο σοβαρό θέμα, έχουμε πολύ ασόβαρες κυβερνήσεις.