AI in practice 2 λεπτά ανάγνωσης

Claude Mythos επιλύει το πρόβλημα Erdős της OpenAI για την απόσταση μονάδας

Claude Mythos επιλύει το πρόβλημα Erdős της OpenAI για την απόσταση μονάδας
Claude Mythos επιλύει το πρόβλημα Erdős της OpenAI για την απόσταση μονάδας (Source: the-decoder.com)

Σύμφωνα με δηλώσεις εργαζομένων της Anthropic, το σύστημα Claude Mythos είναι σε θέση να επιλύσει επίσης το “AI math milestone.” της OpenAI. Η OpenAI είχε πρόσφατα διαψεύσει την εικασία Erdős για την απόσταση μονάδας, ένα άλυτο πρόβλημα στην συνδυαστική γεωμετρία από το 1946. Ο μηχανικός της Anthropic, Sholto Douglas, ανέφερε στην πλατφόρμα X ότι το Mythos το επιλύει με ένα “cute, simple proof,”, γεγονός που υποδηλώνει “serious overhang” στις μαθηματικές ανακαλύψεις που καθοδηγούνται από την τεχνητή νοημοσύνη.

Claude Mythos επιλύει το πρόβλημα Erdős της OpenAI για την απόσταση μονάδας
Claude Mythos επιλύει το πρόβλημα Erdős της OpenAI για την απόσταση μονάδας (Source: the-decoder.com)

Η ομάδα που εργάστηκε σε αυτό το έργο χρησιμοποίησε ένα δοκιμαστικό σύστημα, το οποίο δημιουργήθηκε μετά την επίλυση του προβλήματος Erdős #1196 από τεχνητή νοημοσύνη. Σε αυτό το σύστημα, μεμονωμένες περιπτώσεις του Claude Code, έχοντας πρόσβαση στο Mythos, λαμβάνουν το πρόβλημα, αναπτύσσουν πιθανές διαδρομές επίλυσης, και στη συνέχεια μία περίπτωση συνοψίζει και διανέμει αυτές τις διαδρομές σε περαιτέρω περιπτώσεις που εργάζονται ανεξάρτητα. Το Mythos ακολούθησε συχνά μια διαφορετική προσέγγιση από το μοντέλο της OpenAI. Ο μαθηματικός Daniel Litt χαρακτήρισε το αποτέλεσμα “a bit worse” από αυτό της OpenAI, ωστόσο αναφέρεται ότι το Mythos εντόπισε και την λύση της OpenAI. Η Anthropic δημοσίευσε μια έκδοση της απόδειξης, η οποία είχε προετοιμαστεί στις 4.7.

Επίσης, η Google DeepMind ανακοίνωσε πρόσφατα ότι ένα σύστημα υποβοηθούμενο από τεχνητή νοημοσύνη επέλυσε εννέα προβλήματα Erdős. Ωστόσο, η προσέγγισή της βασίζεται στην επίσημη γλώσσα απόδειξης Lean, γεγονός που θεωρείται λιγότερο εντυπωσιακό από την οπτική γωνία ενός «καθαρού» υποστηρικτή των μεγάλων γλωσσικών μοντέλων (LLM). Παρόλα αυτά, το Claude Code αποτελεί επίσης ένα πρακτορικό πλαίσιο (agentic harness) και όχι ένα αμιγές LLM.

Source: Douglas via X | Levent via X