Η Anthropic δημοσίευσε ένα εκτενές δοκίμιο και δύο πλαίσια πολιτικής. Η εταιρεία ζητά τη διενέργεια δεσμευτικών ελέγχων σε μοντέλα αιχμής και περιγράφει την τεχνητή νοημοσύνη (AI) ως ένα στρατηγικό όπλο που χρησιμοποιείται από κράτη.
Ο Διευθύνων Σύμβουλος της Anthropic, Dario Amodei, δημοσίευσε ένα δοκίμιο με τίτλο “Policy on the AI Exponential.”. Παράλληλα, η εταιρεία παρουσίασε δύο έγγραφα: ένα πλαίσιο για τη ρύθμιση της τεχνητής νοημοσύνης αιχμής και ένα πλαίσιο για την αντιμετώπιση των απωλειών θέσεων εργασίας, το οποίο η Anthropic δηλώνει ότι είναι έτοιμη να υποστηρίξει με σημαντική χρηματοδότηση.
Η αρχική διάγνωση του Amodei αφορά ένα πρόβλημα ταχύτητας, το οποίο απεικονίζει με μια δευτερεύουσα πλοκή από το “Lord of the Rings.”. Δύο χόμπιτ προσπαθούν να παρακινήσουν το δενδρόμορφο πλάσμα Δεντρογένη να υπερασπιστεί το δάσος του ενάντια σε έναν στρατό που το κόβει ενεργά. Το δίλημμα: ο Δεντρογένης είναι σοφός αλλά τόσο αργός που χρειάζεται μια ολόκληρη μέρα μόνο για να χαιρετήσει ένα άλλο δέντρο, καθιστώντας σχεδόν αδύνατο να δράσει εγκαίρως.
Στην ερμηνεία του Amodei, το αργό δενδρόμορφο πλάσμα συμβολίζει το πολιτικό σύστημα. Τα επείγοντα χόμπιτ αντιπροσωπεύουν εκείνους που, όπως η Anthropic, έχουν κρούσει τον κώδωνα του κινδύνου νωρίς. Ο επερχόμενος στρατός είναι η απειλή που προκαλείται από την ταχεία πρόοδο της τεχνητής νοημοσύνης. Επικαλούμενος τους νόμους κλιμάκωσης, ο Amodei υποστηρίζει ότι οι δυνατότητες των μοντέλων αυξάνονται εκθετικά με την αύξηση της υπολογιστικής ισχύος. Εντός ενός έως δύο ετών, αναφέρει, θα μπορούσαμε να δούμε αυτό που αποκαλεί “Powerful AI,” ή “a country of geniuses in a data center.”.
Γιατί η Anthropic δηλώνει ότι η παλαιά της προσέγγιση δεν είναι πλέον αποτελεσματική
Μέχρι σήμερα, η Anthropic είχε προωθήσει κυρίως απαιτήσεις διαφάνειας, καθώς οι κίνδυνοι δεν ήταν επαρκώς σαφείς για ακριβή ρύθμιση, σύμφωνα με τον κ. Amodei. Η εταιρεία υποστήριξε νομοσχέδια διαφάνειας όπως το SB 53 στην Καλιφόρνια, το RAISE στη Νέα Υόρκη και το SB 315 στο Ιλινόις.
Αυτό δεν είναι πλέον αρκετό, γράφει ο Amodei. Ως απόδειξη, αναφέρει την εμπειρία με το “Claude Mythos Preview,”, το οποίο διατάραξε το παγκόσμιο τοπίο της κυβερνοασφάλειας και έδειξε ότι τα μοντέλα αιχμής ενέχουν πραγματικούς κινδύνους για τον χρηματοπιστωτικό τομέα, τις κρίσιμες υποδομές και την εθνική ασφάλεια. Ο Amodei αναμένει ότι βιολογικοί κίνδυνοι και σοβαροί κίνδυνοι αυτονομίας θα μπορούσαν να ακολουθήσουν σύντομα.
Τώρα ζητά υποχρεωτικές δοκιμές σε τομείς κινδύνου: κυβερνοασφάλεια, βιολογικά όπλα, απώλεια ελέγχου επί των συστημάτων τεχνητής νοημοσύνης και αυτοματοποιημένη έρευνα και ανάπτυξη (R&D) που θα μπορούσε να επιταχύνει αυτούς τους κινδύνους. Μια κυβερνητική υπηρεσία θα πρέπει να έχει τη δυνατότητα να μπλοκάρει ή να αποσύρει μοντέλα που ενέχουν απαράδεκτο κίνδυνο. Ο Amodei αναφέρει την Ομοσπονδιακή Υπηρεσία Πολιτικής Αεροπορίας (FAA) ως πρότυπο: όπως ακριβώς τα αεροσκάφη, έτσι και τα μοντέλα τεχνητής νοημοσύνης θα πρέπει να περνούν τεχνικούς ελέγχους πριν διατεθούν στην αγορά.
Έλεγχοι από τρίτους, κανόνες γνωστοποίησης και η εξουσία αποκλεισμού
Το Πλαίσιο Προηγμένης Τεχνητής Νοημοσύνης (Advanced AI Framework) μετατρέπει την έκκληση του Amodei για δεσμευτική ρύθμιση σε μια λεπτομερή πρόταση. Η Anthropic δηλώνει ότι απευθύνεται κυρίως στην ομοσπονδιακή κυβέρνηση των ΗΠΑ, αν και οι αρχές του θα πρέπει να εφαρμόζονται ευρύτερα. Το πλαίσιο αποτελείται από δύο μέρη: υποχρεώσεις για τους δημιουργούς των πιο ικανών μοντέλων και επενδύσεις στην ικανότητα της κοινωνίας να αντέχει σε βιολογικές και κυβερνοεπιθέσεις.
Αντί να καλύπτουν ολόκληρο τον κλάδο, οι κανόνες στοχεύουν την κορυφή. Θα εφαρμόζονταν μόνο σε προγραμματιστές που εκπαιδεύουν μοντέλα με περισσότερα από 10^25 FLOP και οι οποίοι είτε παράγουν έσοδα άνω των 500 εκατομμυρίων δολαρίων από την τεχνητή νοημοσύνη είτε δαπανούν περισσότερα από 1 δισεκατομμύριο δολάρια ετησίως για έρευνα στην τεχνητή νοημοσύνη. Η Anthropic υποστηρίζει ότι αυτά τα όρια εστιάζουν στις υποχρεώσεις όπου τα μοντέλα είναι αρκετά ικανά ώστε να ενέχουν καταστροφικούς κινδύνους.
Η εταιρεία προτείνει επίσης την αναθεώρηση των κριτηρίων τουλάχιστον μία φορά το χρόνο και τελικά τη μετάβαση από τα όρια ακατέργαστης υπολογιστικής ισχύος σε όρια βασισμένα στις δυνατότητες, καθώς η υπολογιστική ισχύς που απαιτείται για επικίνδυνα μοντέλα πιθανότατα θα μειωθεί με την πάροδο του χρόνου.
Για αυτούς τους προγραμματιστές, το πλαίσιο καθορίζει εκτενείς απαιτήσεις γνωστοποίησης. Θα πρέπει να δημοσιεύουν ένα πλαίσιο ασφάλειας, να παρέχουν κάρτες συστήματος για μοντέλα υψηλού κινδύνου, να δημοσιεύουν μια έκθεση κινδύνου τουλάχιστον κάθε έξι μήνες και να αναφέρουν σοβαρά περιστατικά ασφαλείας στην αρμόδια αρχή εντός 15 ημερών. Εντός έξι μηνών από την έναρξη ισχύος των κανόνων, θα πρέπει επίσης να προσλάβουν τουλάχιστον έναν ανεξάρτητο αξιολογητή χωρίς οικονομικούς δεσμούς με αυτούς. Για να αποτραπεί το “evaluator shopping,”, όπου οι εταιρείες επιλέγουν τον πιο επιεική ελεγκτή, η Anthropic προτείνει ένα σύστημα αξιολόγησης και ανάθεσης για τους αξιολογητές.
Το πλαίσιο περιλαμβάνει επίσης απαιτήσεις ασφαλείας για τα βάρη των μοντέλων και τις υποδομές, αστικές κυρώσεις για ψευδείς δηλώσεις, προστασία για τους πληροφοριοδότες και την εξουσία αποκλεισμού επικίνδυνων μοντέλων. Στο ζήτημα της ομοσπονδιακής εξουσίας, η Anthropic υποστηρίζει ότι το Κογκρέσο θα πρέπει να υπερισχύει του κρατικού δικαίου μόνο εάν δημιουργεί ένα ομοσπονδιακό καθεστώς που είναι τουλάχιστον εξίσου αυστηρό.
Προετοιμασία της κοινωνίας, όχι μόνο των προγραμματιστών
Το δεύτερο μέρος του πλαισίου ασχολείται με την κοινωνική ανθεκτικότητα, ειδικότερα με τον τρόπο άμυνας έναντι απειλών που θα μπορούσε να επιταχύνει η προηγμένη τεχνητή νοημοσύνη. Για τους βιολογικούς κινδύνους, η Anthropic συνιστά μια πολυεπίπεδη προσέγγιση: πρόληψη (εκσυγχρονισμένα πρότυπα βιοασφάλειας και έλεγχος παρόχων σύνθεσης γονιδίων), ανίχνευση (συστήματα έγκαιρης προειδοποίησης και ιατροδικαστική απόδοση επιθέσεων) και ετοιμότητα (προστατευτικός εξοπλισμός, ενισχυμένα συστήματα κτιρίων και αντίμετρα επιταχυνόμενα από την τεχνητή νοημοσύνη).
Στον τομέα της κυβερνοασφάλειας, όπου η τεχνητή νοημοσύνη μεταβάλλει ήδη την οικονομία των επιθέσεων σύμφωνα με την Anthropic, οι προτάσεις περιλαμβάνουν την ασφάλιση λογισμικού ανοιχτού κώδικα και παλαιού τύπου, την υποστήριξη φορέων κρίσιμων υποδομών με ανεπαρκείς πόρους και τη χρήση της τεχνητής νοημοσύνης για την επιδιόρθωση τρωτών σημείων σε μεγαλύτερη κλίμακα. Όσον αφορά την απώλεια ελέγχου και την αυτοματοποιημένη έρευνα και ανάπτυξη, η Anthropic παραδέχεται ότι η ατζέντα της για την ανθεκτικότητα είναι πολύ λιγότερο ανεπτυγμένη. Η εταιρεία επισημαίνει μόνο μια γενική κατεύθυνση: την ικανότητα ανίχνευσης και απενεργοποίησης συστημάτων τεχνητής νοημοσύνης που έχουν εκτραπεί.
Ένα πολυεπίπεδο σχέδιο για μαζικές απώλειες θέσεων εργασίας
Το οικονομικό πλαίσιο κλιμακώνει τα μέτρα του ανάλογα με τη σοβαρότητα της διαταραχής στην αγορά εργασίας, χρησιμοποιώντας το ποσοστό ανεργίας ως έναυσμα. Στο πρώτο επίπεδο (περίπου 5 τοις εκατό), η Anthropic προτείνει καθολικούς κεφαλαιακούς λογαριασμούς που δημιουργούνται κατά τη γέννηση, ασφάλιση μισθών, μεταρρύθμιση των επαγγελματικών αδειών και επιδοτήσεις κατάρτισης. Το δεύτερο επίπεδο (περίπου 10 τοις εκατό) επεκτείνει την ασφάλιση ανεργίας και τη βοήθεια για βασικές ανάγκες.
Το τρίτο επίπεδο, όπου η ανεργία υπερβαίνει τα ιστορικά υψηλά, αντιμετωπίζει νέες πηγές φορολόγησης και εργαλεία αναδιανομής, όπως το καθολικό βασικό εισόδημα, τα κρατικά επενδυτικά κεφάλαια τεχνητής νοημοσύνης ή οι υψηλότεροι φόροι κεφαλαιουχικών κερδών. Η Anthropic δηλώνει ότι είναι πρόθυμη να πληρώσει το “fair share” εάν οι εταιρείες τεχνητής νοημοσύνης παράγουν μετασχηματιστικά κέρδη.
Από τη Μέση Γη στη λογική του Ψυχρού Πολέμου
Στο δοκίμιό του, ο Amodei προσθέτει περαιτέρω προτάσεις. Προειδοποιεί ότι ρυθμιστικές αρχές όπως ο FDA και ο EMA θα μπορούσαν να υπερφορτωθούν από την επιταχυνόμενη από την τεχνητή νοημοσύνη έρευνα. Όσον αφορά τις πολιτικές ελευθερίες, ζητά κανόνες λογοδοσίας για τα αυτόνομα όπλα, απαγόρευση της εγχώριας χρήσης τους και κλείσιμο του κενού των μεσιτών δεδομένων στη μαζική παρακολούθηση. Στα γεωπολιτικά, προωθεί έναν δημοκρατικό συνασπισμό που θα μοιράζεται τις αλυσίδες εφοδιασμού, αρνούμενος παράλληλα την πρόσβαση στους αντιπάλους, μαζί με αυστηρότερους ελέγχους εξαγωγών τσιπ.
Η κοσμοθεωρία που παρουσιάζεται εδώ είναι εντυπωσιακή. Ο Amodei δεν αντιμετωπίζει την τεχνητή νοημοσύνη ως καταναλωτική τεχνολογία. Την κατατάσσει στην ίδια κατηγορία με τα πυρηνικά όπλα, ως κάτι που αναδιαμορφώνει ολόκληρο το γεωπολιτικό πεδίο. Η εικονοπλασία του είναι ωμή: ένα έθνος με τεχνητή νοημοσύνη που αντιμετωπίζει ένα χωρίς αυτήν θα ήταν σαν μια δύναμη Πεζοναυτών εναντίον μεσαιωνικών ξιφομάχων. Λαμβάνει υπόψη πλήρως αυτόνομους στρατούς drones.
Το κράτος εμφανίζεται τόσο ως νόμιμος προστάτης όσο και ως δυνητικός μηχανισμός για τυραννία που τροφοδοτείται από την τεχνητή νοημοσύνη. Ο Amodei πλαισιώνει τη συνεργασία κυρίως ως μια συμμαχία ομοϊδεατών δημοκρατιών, οι οποίες απομονώνονται από τις απολυταρχίες μέσω αλυσίδων εφοδιασμού και ελέγχων εξαγωγών. Πρόκειται για λογική Ψυχρού Πολέμου ενδεδυμένη με τεχνητή νοημοσύνη, η οποία ταιριάζει απόλυτα με τη μεταφορά του Δεντρογένη.
Αντικρούει τον ισχυρισμό ότι η βιομηχανία της τεχνητής νοημοσύνης αντιμετωπίζει απλώς ένα πρόβλημα δημοσίων σχέσεων. Η δημόσια ανησυχία είναι δικαιολογημένη, γράφει, και η διαφάνεια σχετικά με τους πραγματικούς κινδύνους αποτελεί δημοκρατική λογοδοσία που λειτουργεί όπως πρέπει.
Η Anthropic κατέθεσε ένα προσχέδιο για αρχική δημόσια προσφορά (IPO) στην Επιτροπή Κεφαλαιαγοράς (SEC) στις αρχές Ιουνίου και αυτή την εβδομάδα κυκλοφόρησε το Claude Fable 5, το πρώτο δημόσιο μοντέλο της κατηγορίας Mythos.