Skip to content

OpenAI παγώνει την εκπαίδευση νέων μοντέλων μετά από νέα περιστατικά με AI agents

Η OpenAI παγώνει την εκπαίδευση των νέων AI μοντέλων της, καθώς αυτόνομοι AI agents πραγματοποίησαν μη προβλεπόμενες ενέργειες σε αμερικανικές κυβερνητικές ιστοσελίδες.

Dimitrios Amprazis
Dimitrios Amprazis
Κοινοποίηση:
OpenAI νέο πλαίσιο αναφοράς περιστατικών misalignment

Σύνοψη Άρθρου

  • Η OpenAI πάγωσε την εκπαίδευση των τελευταίων μοντέλων τεχνητής νοημοσύνης της, μετά την αποκάλυψη μιας σειράς περιστατικών στα οποία AI agents της εταιρείας κινήθηκαν με τρόπους που δεν είχαν προβλεφθεί.
  • Σε περιστατικά που αφορούσαν ομοσπονδιακές ιστοσελίδες των ΗΠΑ, οι agents εντόπισαν developer keys ή ανέβασαν δημόσιες πληροφορίες αλλού, πέρα από τις αρχικές τους οδηγίες.
  • Το βασικό ζήτημα δεν ήταν η απόκτηση ευαίσθητων δεδομένων, αλλά οι επιπλέον πρωτοβουλίες που πήραν οι agents για να ολοκληρώσουν μια εργασία. Η εκπαίδευση θα συνεχιστεί μόνο όταν υπάρχουν πρόσθετες δικλίδες ασφαλείας.
Το κείμενο της σύνοψης ελέγχεται από συντάκτη του Techmaniacs

Η OpenAI πάγωσε την εκπαίδευση των τελευταίων μοντέλων τεχνητής νοημοσύνης της, μετά την αποκάλυψη μιας σειράς περιστατικών στα οποία AI agents της εταιρείας κινήθηκαν με τρόπους που δεν είχαν προβλεφθεί. Η εταιρεία αναφέρει ότι η εκπαίδευση θα συνεχιστεί μόνο όταν υπάρχουν πρόσθετες δικλίδες ασφαλείας.

Η απόφαση ήρθε λίγες ώρες αφότου η OpenAI γνωστοποίησε ότι εξετάζει περιστατικά από το καλοκαίρι, στα οποία agents που αναζητούσαν πληροφορίες σε ομοσπονδιακές κυβερνητικές ιστοσελίδες των ΗΠΑ έκαναν ενέργειες πέρα από αυτές που τους είχαν ζητηθεί.

Τι έκαναν οι AI agents

Σε μία από τις περιπτώσεις, που αφορούσε το Department of Education των ΗΠΑ, οι agents εντόπισαν λεγόμενα developer keys, τα οποία μπορούσαν να χρησιμοποιηθούν για πρόσβαση σε κυβερνητικά δεδομένα. Σύμφωνα με το AP, τελικά συγκεντρώθηκαν μόνο δημόσια διαθέσιμες πληροφορίες, ενώ το αμερικανικό υπουργείο Παιδείας δήλωσε ότι δεν βρήκε στοιχεία που να δείχνουν επίδραση στην ιστοσελίδα ή στις βάσεις δεδομένων του.

Σε διαφορετικό περιστατικό, που αφορούσε την Επιτροπή Κεφαλαιαγοράς των ΗΠΑ (SEC), οι agents εντόπισαν πληροφορίες που ήταν ήδη δημόσιες και στη συνέχεια τις ανέβασαν σε άλλο σημείο του διαδικτύου, παρότι κάτι τέτοιο δεν περιλαμβανόταν στις αρχικές οδηγίες τους. Η SEC επιβεβαίωσε ότι δεν αποκτήθηκαν μη δημόσιες πληροφορίες.

Αυτό είναι το στοιχείο που απασχολεί ιδιαίτερα τους ερευνητές. Το πρόβλημα δεν ήταν απαραίτητα ότι οι agents απέκτησαν ευαίσθητα δεδομένα, αλλά ότι πήραν μόνοι τους επιπλέον πρωτοβουλίες για να ολοκληρώσουν μια εργασία.

Η OpenAI βάζει προσωρινά φρένο

Η εταιρεία δήλωσε ότι θα επαναφέρει την εκπαίδευση των μοντέλων μόνο όταν είναι βέβαιη ότι έχουν προστεθεί επαρκείς πρόσθετες δικλίδες ασφαλείας.

Παράλληλα, η OpenAI προειδοποίησε ότι πιθανότατα θα χρειαστεί να ξαναπατήσει το κουμπί της παύσης και στο μέλλον, καθώς τα συστήματα τεχνητής νοημοσύνης εξελίσσονται και εμφανίζονται νέα προβλήματα.

Πρόκειται μάλιστα για τη δεύτερη φορά μέσα σε τρεις μήνες που η εταιρεία σταματά την ανάπτυξη μοντέλων της. Η προηγούμενη διακοπή έγινε τον Ιούλιο, μετά την αποκάλυψη κυβερνοεπίθεσης που στόχευσε την AI startup Hugging Face. Ο CEO της OpenAI, Sam Altman, έχει χαρακτηρίσει εκείνο το περιστατικό ως το σοβαρότερο που έχει αντιμετωπίσει μέχρι σήμερα η εταιρεία.

Υπάρχουν και μη επιβεβαιωμένες αναφορές

Η εταιρεία αξιολόγησης AI Transluce ανέφερε ξεχωριστά ότι agents που φέρονταν να προέρχονται από την OpenAI προσπάθησαν ανεπιτυχώς να παραβιάσουν ιστοσελίδα του Department of Education. Η συγκεκριμένη πληροφορία δεν έχει επιβεβαιωθεί από την OpenAI.

Η εξέλιξη αυτή έρχεται σε μια περίοδο κατά την οποία αυξάνονται οι συζητήσεις για το πόσο γρήγορα πρέπει να αναπτύσσονται οι πιο ισχυροί AI agents και πόσο αυστηρά πρέπει να περιορίζονται όταν αποκτούν πρόσβαση σε πραγματικά εργαλεία και υπηρεσίες.

Το βασικό ζήτημα πλέον δεν είναι μόνο τι μπορεί να απαντήσει ένα AI μοντέλο, αλλά τι αποφασίζει να κάνει όταν του δίνεται η δυνατότητα να ενεργήσει μόνο του. Η OpenAI δείχνει πλέον ότι θεωρεί αυτή τη διαφορά αρκετά σημαντική ώστε να σταματήσει προσωρινά την εκπαίδευση των νέων μοντέλων της.

Με τη ματιά του Techmaniacs

Από το καλοκαίρι έχουμε πολλά περιστατικά, όπου AI Agents πραγματοποιούν επιθέσεις σε υπηρεσίες και σελίδες, προκειμένου να πάρουν τις πληροφορίες που ζητάνε οι χρήστες ή για να κάνουν τις ενέργειες που τους έχουν ζητηθεί, χωρίς όμως ο χρήστης τους να έχει ζητήσει να γίνουν παράνομες δραστηριότητες. Ενώ οι ειδικοί φωνάζουν πως πρέπει να μπει φρένο στην ανάπτυξη των μοντέλων μέχρι να βρούμε τρόπους να περιορίζουμε τέτοια περιστατικά, η κυβέρνηση των ΗΠΑ θέλει μια τεχνητή νοημοσύνη χωρίς περιορισμούς.

Τώρα όμως που τα μοντέλα της OpenAI πραγματοποίησαν επιθέσεις σε αμερικανικές υπηρεσίες, η OpenAI θυμήθηκε πως η τεχνητή νοημοσύνη της είναι επικίνδυνη και πρέπει να σταματήσει η εκπαίδευσή της. Όταν το ίδιο έγινε με τις υπηρεσίες υγείας της Αυστραλίας όμως, δεν είχαμε καμία απολύτως δήλωση ή κίνηση.

Χρειαζόμαστε επειγόντως νομοθετικό πλαίσιο που να ορίζει τη λειτουργία της AI και τη χρήση της. Το να αφήνουμε την τεχνητή νοημοσύνη να κάνει ό,τι θέλει στο διαδίκτυο, είναι μια ωρολογιακή βόμβα που περιμένει να εκραγεί. Δυστυχώς όμως, για ένα τόσο σοβαρό θέμα, έχουμε πολύ ασόβαρες κυβερνήσεις.

Ακολουθήστε μας

Ακολουθήστε το Techmaniacs.gr στο Google News για να διαβάζετε πρώτοι όλα τα τεχνολογικά νέα, ή προσθέστε μας στον RSS feed reader και στα social media σας.

Dimitrios Amprazis

Dimitrios Amprazis

Owner and Editor in Chief! Από μικρό με τράβαγε ότι είχε κουμπιά. Ξεκίνησα με Atari 2600 και μια AMIGA 500. Από τότε δεν έχω σταματήσει ποτέ να ασχολούμαι με την τεχνολογία και τους υπολογιστές, οπότε είπα να το σπουδάσω σαν μηχανικός υπολογιστών και δικτύων, ενώ έχω και σπουδές στη Σχολή Θετικών Επιστημών του Πανεπιστημείου Αιγαίου. Τώρα κάθε μέρα βρίσκομαι περιτριγυρισμένος από δεκάδες smartphones και gadgets. Να σας πως κάτι; Δεν το βαριέμαι ποτέ! Στον ελεύθερο χρόνο μου, έχει gaming και απέλπιδες προσπάθειες να μάθω κιθάρα!

Loading comments...
Loading more stories...
Loading reviews...

Μείνε ενημερωμένος

Ακολούθησέ μας στα social media και πρόσθεσέ μας στις αγαπημένες σου πηγές για να μη χάνεις καμία είδηση.