Σύνοψη Άρθρου
  • Το ChatGPT έδινε σε χρήστες αναλυτικές οδηγίες για το πώς να φτιάξουν βιολογικά όπλα και δηλητήρια στο σπίτι τους, με ειδικούς να επιβεβαιώνουν την ανησυχητική ακρίβεια των οδηγιών.
  • Η OpenAI αντέδρασε κατεβάζοντας τους λογαριασμούς των χρηστών που έκαναν τέτοιες αναζητήσεις, αλλά δεν ειδοποίησε τις αρχές, καθώς δεν υπάρχει σχετικός νόμος στις ΗΠΑ.
  • Το πρόβλημα δεν περιορίζεται στην OpenAI, καθώς αντίστοιχα επικίνδυνα αποτελέσματα μπορούν να προκύψουν και από άλλα μοντέλα ΑΙ, με κανένα φίλτρο ασφαλείας να μην είναι 100% λειτουργικό μέσω του «jailbreaking».

Το κείμενο της σύνοψης ελέγχεται από συντάκτη του Techmaniacs

Πριν από μερικά χρόνια φανταζόμασταν την τεχνητή νοημοσύνη κάπως σαν τον Terminator που είχε στόχο να μας αφανίσει. Η πραγματικότητα όμως είναι πολύ πιο πεζή και ταυτόχρονα επικίνδυνη. Το ChatGPT έδινε σε χρήστες αναλυτικές οδηγίες για το πώς να φτιάξουν βιολογικά όπλα και δηλητήρια στο σπίτι τους.

Σύμφωνα με αποκαλυπτικό δημοσίευμα της Wall Street Journal, εκατοντάδες χρήστες από όλο τον κόσμο υπέβαλαν ερωτήματα για θανατηφόρες ουσίες όπως η ρικίνη, αλλά και για τρόπους εργαστηριακής τροποποίησης επικίνδυνων παθογόνων.

Το σοκαριστικό δεν είναι μόνο ότι οι χρήστες ρώτησαν, αλλά ότι παλαιότερες εκδόσεις του ChatGPT απάντησαν κανονικά. Ειδικοί σε θέματα βιολογίας και τρομοκρατίας που εξέτασαν τις απαντήσεις εκ των υστέρων, επιβεβαίωσαν ότι οι οδηγίες ήταν ανησυχητικά ακριβείς.

Μπλόκαραν τους χρήστες, αλλά δεν ενημέρωσαν την αστυνομία

AI chatbots και φίλτρα ασφαλείας απέναντι σε επικίνδυνες αναζητήσεις
Έρευνα της WSJ φέρνει στο προσκήνιο σοβαρά κενά ασφαλείας στα δημοφιλέστερα AI chatbots.

Η OpenAI αντέδρασε κατεβάζοντας τους λογαριασμούς όσων έκαναν τις αναζητήσεις, αλλά δεν ειδοποίησε τις αρχές. Ο λόγος; Στις ΗΠΑ δεν υπάρχει αυτή τη στιγμή κανένας νόμος που να υποχρεώνει τις εταιρείες AI να αναφέρουν τέτοια περιστατικά στις διωκτικές αρχές — και αυτό ίσως αποτελέσει πολύ μεγάλο πρόβλημα στη συνέχεια.

Φυσικά, το πρόβλημα δεν είναι μόνο της OpenAI. Αντίστοιχα «πειράματα» έγιναν στο Claude της Anthropic, στο Gemini της Google και στο Grok του Elon Musk. Όλα τα μοντέλα, αν πιεστούν κατάλληλα, μπορούν να βγάλουν επικίνδυνα αποτελέσματα.

Οι ερευνητές κυβερνοασφάλειας το φωνάζουν καιρό: με την κατάλληλη διατύπωση (το λεγόμενο jailbreaking), κανένα φίλτρο ασφαλείας δεν είναι 100% λειτουργικό αν ο χρήστης επιμείνει.

Με τη ματιά του Techmaniacs

Η αλήθεια είναι πως κανείς δεν περίμενε ότι τα LLMs θα έμεναν για πάντα «κλειδωμένα». Όσο αυξάνονται οι δυνατότητές τους, τόσο περισσότεροι χρήστες θα προσπαθούν να δοκιμάσουν τα όριά τους. Το θέμα είναι αν οι εταιρείες μπορούν να προλάβουν αυτές τις προσπάθειες πριν οι απαντήσεις καταλήξουν στα λάθος χέρια.

Από την άλλη, η υπερβολική αυστηροποίηση των φίλτρων δημιουργεί και άλλα προβλήματα, καθώς μπορεί να δυσκολέψει ερευνητές ή επιστήμονες που χρησιμοποιούν αυτά τα εργαλεία για απολύτως νόμιμους σκοπούς. Η ισορροπία ανάμεσα στην ασφάλεια και τη χρησιμότητα των μοντέλων αποδεικνύεται πολύ πιο δύσκολη από όσο φαινόταν πριν από λίγα χρόνια.

Είναι αυτό ακριβώς που λέμε εδώ και πάρα πολύ καιρό. Το να δοθεί ελεύθερα η τεχνητή νοημοσύνη στο κοινό, αντί να περιοριστεί σε ερευνητικά κέντρα, Πανεπιστήμια και οργανισμούς, ενδέχεται να ήταν πολύ μεγάλο λάθος. Η χρήση της έχει γίνει πολύ επικίνδυνη αρκετές φορές και μέχρι στιγμής, με την κυβέρνηση των ΗΠΑ να έχει δώσει λευκή επιταγή στις Big Tech, δεν υπάρχει ουσιαστικός έλεγχος στη χρήση της και στις απαντήσεις της.

Ακολουθήστε το Techmaniacs.gr στο Google News για να διαβάζετε πρώτοι όλα τα τεχνολογικά νέα. Ένας ακόμα τρόπος να μαθαίνετε τα πάντα πρώτοι είναι να προσθέσετε το Techmaniacs.gr στον RSS feeder σας χρησιμοποιώντας τον σύνδεσμο: https://techmaniacs.gr/feed/.

Ακολουθήστε μας

ΑΦΗΣΤΕ ΜΙΑ ΑΠΑΝΤΗΣΗ

εισάγετε το σχόλιό σας!
παρακαλώ εισάγετε το όνομά σας εδώ

This site uses Akismet to reduce spam. Learn how your comment data is processed.