AI research 1 λεπτό ανάγνωσης

Microsoft Research: Το Lens επιτυγχάνει απόδοση με 3,8 δισ. παραμέτρους μέσω λεπτομερών λεζαντών

Microsoft Research: Το Lens επιτυγχάνει απόδοση με 3,8 δισ. παραμέτρους μέσω λεπτομερών λεζαντών
Microsoft Research: Το Lens επιτυγχάνει απόδοση με 3,8 δισ. παραμέτρους μέσω λεπτομερών λεζαντών (Source: the-decoder.com)
Microsoft Research: Το Lens επιτυγχάνει απόδοση με 3,8 δισ. παραμέτρους μέσω λεπτομερών λεζαντών

Microsoft Research: Το Lens επιτυγχάνει απόδοση με 3,8 δισ. παραμέτρους μέσω λεπτομερών λεζαντών (Source: the-decoder.com)

Η Microsoft Research παρουσιάζει το Lens, ένα μοντέλο μετατροπής κειμένου σε εικόνα, το οποίο διαθέτει μόλις 3,8 δισεκατομμύρια παραμέτρους. Το συγκεκριμένο μοντέλο ανταγωνίζεται επιτυχώς πολύ μεγαλύτερα ανταγωνιστικά μοντέλα σε δοκιμές αναφοράς, με ένα κλάσμα του κόστους εκπαίδευσης. Το βασικό στοιχείο της επιτυχίας του είναι η χρήση 800 εκατομμυρίων λεπτομερών λεζαντών εικόνων, οι οποίες δημιουργήθηκαν -4.1, σε αντίθεση με τις ασαφείς περιγραφές alt-text του διαδικτύου. Ο κώδικας και τα βάρη του μοντέλου διατίθενται ανοιχτά υπό άδεια ανοιχτού κώδικα.

Πηγή: The Decoder.