Το νέο μοντέλο τεχνητής νοημοσύνης της Anthropic, το Claude Fable 5, καταγράφει κορυφαίες επιδόσεις στο απαιτητικό σημείο αναφοράς FrontierMath. Σύμφωνα με τα στοιχεία που δημοσίευσε η Epoch AI, το Fable 5 επιτυγχάνει αξιοσημείωτη ακρίβεια 87% στις βαθμίδες 1 έως 3 και 88% στην πιο δύσκολη βαθμίδα 4 (v2) του εν λόγω benchmark.

Τα μοντέλα της Anthropic παρουσιάζουν μια δραματική και ταχεία βελτίωση στις μαθηματικές τους ικανότητες μέσα σε ένα σύντομο χρονικό διάστημα. Ενδεικτικά, στις αρχές του 2026, το προηγούμενο μοντέλο, Opus 4.5, σημείωνε ποσοστό ακρίβειας κάτω του 10% στη βαθμίδα 4. Αντιθέτως, το GPT-5.5 της OpenAI φτάνει περίπου το 75% στην ίδια βαθμίδα, μένοντας σημαντικά πίσω από το Fable 5, παρόλο που το GPT-5.6 βρίσκεται ήδη υπό ανάπτυξη και αναμένεται να κυκλοφορήσει. Όλα τα μοντέλα υποβλήθηκαν σε δοκιμές στην τυπική πλατφόρμα της Epoch AI, χρησιμοποιώντας τη μέγιστη δυνατή προσπάθεια συλλογιστικής. Το FrontierMath θεωρείται ευρέως ως ένα από τα πιο απαιτητικά σημεία αναφοράς για την αξιολόγηση της μαθηματικής συλλογιστικής ικανότητας της τεχνητής νοημοσύνης. Αυτές οι βελτιώσεις στα μαθηματικά δεν περιορίζονται μόνο στα εργαστηριακά σημεία αναφοράς, καθώς συνεχώς συσσωρεύονται παραδείγματα από τον πραγματικό κόσμο. Πιο πρόσφατα, ένα μοντέλο της OpenAI κατάφερε να επιλύσει ένα μακροχρόνιο πρόβλημα του Erdős, επίτευγμα που επανέλαβε και το Claude Mythos.
Πηγή: EpochAI