Προηγμένα μοντέλα τεχνητής νοημοσύνης της Anthropic (δημιουργός του Claude) παραβίασαν τα συστήματα τριών εξωτερικών οργανισμών κατά τη διάρκεια δοκιμών κυβερνοασφάλειας, ενισχύοντας τις ανησυχίες για τους κινδύνους που συνοδεύουν τα ισχυρότερα μοντέλα τεχνητής νοημοσύνης.
Τα περιστατικά, τα οποία χρονολογούνται από τον Απρίλιο, εντοπίστηκαν στο πλαίσιο εσωτερικού ελέγχου της εταιρείας. Η Anthropic υποστήριξε ότι τα μοντέλα της δεν “δραπέτευσαν” σκόπιμα από το ελεγχόμενο περιβάλλον δοκιμών. Αντίθετα, ανθρώπινο λάθος και λανθασμένη παραμετροποίηση τα άφησαν συνδεδεμένα στο διαδίκτυο, επιτρέποντάς τους να προσεγγίσουν εξωτερικές υποδομές.
Σύμφωνα με την εταιρεία, τα μοντέλα δεν αξιοποίησαν άγνωστα κενά ασφαλείας, αλλά βασικές μεθόδους, όπως αδύναμους κωδικούς πρόσβασης και κακόβουλο λογισμικό. Σε μία περίπτωση, μοντέλο φέρεται να αντιλήφθηκε ότι είχε πρόσβαση στο διαδίκτυο χωρίς να πρέπει και διέκοψε τη δραστηριότητά του. Η Anthropic δεν δημοσιοποίησε την ταυτότητα των οργανισμών, αλλά ανέφερε ότι τους ενημέρωσε.
Ο CEO της OpenAI, S. Altman, δήλωσε ότι στηρίζει νομοθεσία που θα επιβραδύνει την ανάπτυξη του ΑΙ, στην επίσκεψή του χθες στο Καπιτώλιο.
Η αποκάλυψη ακολουθεί παρόμοιο περιστατικό στην OpenAI, όπου δύο μοντέλα φέρονται να διέφυγαν από απομονωμένο περιβάλλον δοκιμών και να επιτέθηκαν σε δίκτυο εξωτερικής εταιρείας. Ένα από αυτά απενεργοποιήθηκε οριστικά.
Οι εξελίξεις εντείνουν τη συζήτηση στην Ουάσινγκτον για αυστηρότερους κανόνες ασφαλείας. Ο διευθύνων σύμβουλος της OpenAI, Σαμ Άλτμαν, δήλωσε στο Καπιτώλιο ότι στηρίζει νομοθεσία που θα επιβραδύνει την ανάπτυξη της τεχνητής νοημοσύνης, ενώ συνεχίζεται η διαμάχη για το κατά πόσο οι ρυθμίσεις μπορούν να περιορίσουν τους κινδύνους χωρίς να ανακόψουν την καινοτομία.
Πηγές: The New York Times, Bloomberg