Το πρόσφατο, πρωτοφανές περιστατικό σηματοδοτεί την τελευταία σημαντική ένταση στις σχέσεις μεταξύ της εταιρείας Anthropic και της κυβέρνησης Τραμπ. Ενώ η εταιρεία δηλώνει ότι η εντολή την καλούσε να αναστείλει την πρόσβαση σε «οποιονδήποτε ξένο υπήκοο, είτε εντός είτε εκτός των Ηνωμένων Πολιτειών, συμπεριλαμβανομένων των ξένων υπηκόων εργαζομένων της Anthropic», προχώρησε στην πλήρη αφαίρεση της πρόσβασης για όλους τους πελάτες της, με σκοπό τη διασφάλιση της απόλυτης συμμόρφωσης με τις απαιτήσεις.
Νωρίτερα εντός του τρέχοντος έτους, το Υπουργείο Άμυνας της κυβέρνησης Τραμπ είχε χαρακτηρίσει την Anthropic ως «κίνδυνο για την αλυσίδα εφοδιασμού». Αυτός ο χαρακτηρισμός προέκυψε αφότου η εταιρεία, δημιουργός του μοντέλου Claude, επιχείρησε να θέσει σαφείς περιορισμούς σχετικά με τον τρόπο χρήσης της τεχνολογίας της από τον στρατό των ΗΠΑ. Ο συγκεκριμένος χαρακτηρισμός είχε ως αποτέλεσμα την ουσιαστική απαγόρευση χρήσης της τεχνολογίας της Anthropic από κυβερνητικούς φορείς και αναδόχους. Η Anthropic είχε απαντήσει στην κυβέρνηση σχετικά με το ζήτημα.
Την Τρίτη, η Anthropic προχώρησε στη δημόσια κυκλοφορία του Claude Fable 5, μιας έκδοσης του μοντέλου τεχνητής νοημοσύνης Mythos της εταιρείας. Αυτή η έκδοση ενσωματώνει ειδικές διασφαλίσεις που αποτρέπουν την απάντηση σε ερωτήσεις σχετικές με την κυβερνοασφάλεια, τη βιολογία και τη χημεία. Πριν από τη δημόσια διάθεση, την οποία η Anthropic δήλωσε ότι είχε πραγματοποιήσει σε συνεργασία με την κυβέρνηση των ΗΠΑ, το μοντέλο τεχνητής νοημοσύνης Mythos Preview είχε κυκλοφορήσει σε περιορισμένη κλίμακα τον Απρίλιο. Ο πρωταρχικός στόχος αυτής της κίνησης ήταν να παρασχεθεί στις εταιρείες και τους οργανισμούς η δυνατότητα να αξιοποιήσουν τις ισχυρές δυνατότητες κυβερνοασφάλειας του μοντέλου για τη βελτίωση των αμυντικών τους συστημάτων, καθώς και να μετριαστούν οι ανησυχίες ότι η τεχνολογία θα μπορούσε να χρησιμοποιηθεί ως εργαλείο για επιθέσεις hacking.
Σε ανάρτηση ιστολογίου που δημοσιεύτηκε την Παρασκευή, η Anthropic ανέφερε ότι έλαβε επιστολή από την κυβέρνηση των ΗΠΑ στις 5:21 μ.μ. ώρα Ανατολικής Ακτής. «The letter did not provide specific details of its national security concern,» έγραψε η Anthropic.
«Our understanding is that the government believes it has become aware of a method of bypassing, or ‘jailbreaking’ Fable 5,» προσέθεσε η εταιρεία. «We reviewed a demonstration of this specific technique being used to identify a small number of previously known, minor vulnerabilities. These vulnerabilities all appear relatively simple, and we have found that other publicly-available models are able to discover them as well without requiring a bypass.»
Έχετε κάποια πληροφορία;
Είστε νυν ή πρώην εργαζόμενος της Anthropic που επιθυμεί να μιλήσει για τις τρέχουσες εξελίξεις; Θα θέλαμε να επικοινωνήσετε μαζί μας. Χρησιμοποιώντας ένα τηλέφωνο ή υπολογιστή που δεν σχετίζεται με την εργασία, επικοινωνήστε με τον δημοσιογράφο με ασφάλεια μέσω Signal στο mzeff.88.
Στην ανάρτηση του ιστολογίου της, η εταιρεία υποστήριξε ότι έχει εφαρμόσει ισχυρές διασφαλίσεις με σκοπό τη μείωση της πιθανότητας κακής χρήσης του Claude Fable 5. Η Anthropic ισχυρίστηκε επίσης ότι η μέθοδος jailbreak που εντόπισε η κυβέρνηση των ΗΠΑ για το Claude Fable 5 ήταν περιορισμένης εμβέλειας και δεν θα καθιστούσε έναν επιτιθέμενο ουσιαστικά πιο επικίνδυνο από ό,τι θα ήταν με τη χρήση ενός άλλου μοντέλου τεχνητής νοημοσύνης, διατηρώντας έτσι ένα συγκρίσιμο επίπεδο κινδύνου.
«To date, the government has only given us verbal evidence of a potential narrow, non-universal jailbreak, which essentially consists of asking the model to read a specific codebase and fix any software flaws,» η εταιρεία ανέφερε στην ανάρτηση του ιστολογίου της. «Our understanding is that one potential jailbreak was shared with the government.»
Εκπρόσωποι του Λευκού Οίκου και του Υπουργείου Εμπορίου των ΗΠΑ δεν ανταποκρίθηκαν άμεσα στο αίτημα του WIRED για σχολιασμό.
Ο Διευθύνων Σύμβουλος της Anthropic, Ντάριο Αμόντεϊ (Dario Amodei), δήλωσε σε δοκίμιο πολιτικής νωρίτερα αυτή την εβδομάδα ότι ο ίδιος και η εταιρεία υποστηρίζουν μια δίκαιη, δομημένη και διαφανή κυβερνητική διαδικασία που θα απέτρεπε την κυκλοφορία μη ασφαλών μοντέλων τεχνητής νοημοσύνης. Στην ανάρτηση του ιστολογίου της εταιρείας την Παρασκευή, η Anthropic υποστήριξε ότι «this action does not adhere to those principles.»