Η εταιρεία Anthropic προχωρά σε αναστολή της πρόσβασης στα πρόσφατα μοντέλα τεχνητής νοημοσύνης της, τα Fable 5 και Mythos 5, ακολουθώντας σχετική οδηγία που εκδόθηκε για λόγους εθνικής ασφάλειας.

Η πρόσβαση σε προγενέστερα μοντέλα, όπως το Claude Opus 4.8, παραμένει ανεπηρέαστη. Η κυβερνητική εντολή επέβαλε στην Anthropic την απαγόρευση χρήσης των εν λόγω μοντέλων από αλλοδαπούς, τόσο εντός όσο και εκτός των Ηνωμένων Πολιτειών. Η εταιρεία τεχνητής νοημοσύνης δήλωσε ότι, κατόπιν αυτής της εντολής, δεν της απέμεινε άλλη επιλογή από το να επεκτείνει την απαγόρευση σε όλους τους χρήστες. Η Anthropic ανέφερε ότι η κυβέρνηση δεν παρείχε σαφείς διευκρινίσεις για τον ακριβή λόγο της οδηγίας, ωστόσο η εταιρεία εκτιμά ότι αυτή ενδέχεται να συνδέεται με μια πιθανή μέθοδο «jailbreaking» του μοντέλου 5.
Ο όρος «jailbreaking» αναφέρεται σε μια τεχνική που εφαρμόζεται για την παραπλάνηση μοντέλων τεχνητής νοημοσύνης, με σκοπό την εκτέλεση λειτουργιών για τις οποίες δεν έχουν αρχικά προγραμματιστεί. Παραδείγματα περιλαμβάνουν την παροχή οδηγιών για την κατασκευή εκρηκτικών μηχανισμών.
Το μοντέλο Mythos 5, το οποίο παρουσιάστηκε τον Απρίλιο υπό την κωδική ονομασία Project Glasswing, διαθέτει προηγμένες δυνατότητες αλληλεπίδρασης με διάφορα συστήματα, συμπεριλαμβανομένων προϊόντων όπως ο Firefox και ενδεχομένως το macOS. Λόγω ανησυχιών σχετικά με τις δυνητικά επιθετικές του δυνατότητες, σε περίπτωση που χρησιμοποιηθεί από κακόβουλους χρήστες, η Anthropic έχει ήδη περιορίσει την πρόσβαση στο Mythos 5 σε επιλεγμένους συνεργάτες που εδρεύουν στις Ηνωμένες Πολιτείες. Το Fable 5, το οποίο ήταν προσβάσιμο στο ευρύ κοινό, βασίζεται στην ίδια θεμελιώδη τεχνολογία με το Mythos, αλλά ενσωματώνει μηχανισμούς προστασίας για τομείς υψηλού κινδύνου, όπως η κυβερνοασφάλεια και η βιολογία.
Η Anthropic διευκρίνισε ότι η μέθοδος «jailbreak» είναι «περιορισμένη» και «μη καθολική», προσθέτοντας ότι έχει λάβει μόνο προφορικές ενδείξεις για την ύπαρξή της. Σύμφωνα με την επίσημη ανακοίνωση της εταιρείας, η συγκεκριμένη τεχνική περιλαμβάνει την εισαγωγή κώδικα στο μοντέλο και την υποβολή αιτήματος για τον έλεγχο αυτού του κώδικα για πιθανά σφάλματα.
Η Anthropic συμφώνησε με την αρχή ότι η κυβέρνηση οφείλει «να έχει τη δυνατότητα να εμποδίζει μη ασφαλείς εφαρμογές» μοντέλων τεχνητής νοημοσύνης. Ωστόσο, η εταιρεία δήλωσε ότι «διαφωνεί με το ότι η ανακάλυψη ενός περιορισμένου πιθανού jailbreak θα πρέπει να αποτελεί λόγο ανάκλησης ενός εμπορικού μοντέλου που έχει εφαρμοστεί σε εκατοντάδες εκατομμύρια ανθρώπους».
Δεν είναι η πρώτη φορά που η Anthropic βρίσκεται σε σοβαρή διαφωνία με την κυβέρνηση των Ηνωμένων Πολιτειών. Τον Μάιο, η εταιρεία χαρακτηρίστηκε ως κίνδυνος για την αλυσίδα εφοδιασμού, γεγονός που προκάλεσε την έναρξη νομικών ενεργειών. Παράλληλα, ο Πρόεδρος των ΗΠΑ, Ντόναλντ Τραμπ, σε ανάρτησή του στα μέσα κοινωνικής δικτύωσης τον ίδιο μήνα, αναφέρθηκε στην εταιρεία ως «αριστερούς τρελούς».
Επιπλέον, η Microsoft απαγόρευσε στο προσωπικό της να χρησιμοποιεί το Claude Fable 5 νωρίτερα αυτή την εβδομάδα, επικαλούμενη ανησυρίες που σχετίζονται με την πολιτική διατήρησης δεδομένων του μοντέλου.
Πηγή:gr.pcmag