Uncategorised 6 λεπτά ανάγνωσης

Σταθερή Έκφραση του ChatGPT στα Κινεζικά: Μια Ανάλυση Γλωσσικής Απόκλισης

Το ChatGPT επιδεικνύει ικανοποιητική απόδοση στην απάντηση ερωτήσεων στα κινεζικά, γεγονός που εξηγεί την ευρεία χρήση του στην Κίνα, παρά τον αποκλεισμό του. Όταν υποβάλλεται ένα αίτημα, είτε πρόκειται για μαθηματικό πρόβλημα είτε για εντολή δημιουργίας εικόνας, το chatbot συχνά απαντά: 我会稳稳地接住你, το οποίο μεταφράζεται κυριολεκτικά ως «Θα σε πιάσω σταθερά [όταν πέσεις]».

Η ακριβής σημασία της φράσης «Θα σε πιάσω σταθερά» είναι ασαφής. Μια πιο ελαστική μετάφραση θα μπορούσε να είναι «Θα σε υποστηρίξω σταθερά σε ό,τι κι αν συμβεί». Ωστόσο, για κάθε φυσικό ομιλητή της κινεζικής γλώσσας, η έκφραση αυτή θεωρείται ενοχλητικά στοργική και αταίριαστη. Σε ορισμένες περιπτώσεις, το μοντέλο γίνεται πιο εκδηλωτικό και δηλώνει στα κινεζικά: «Είμαι εδώ: δεν κρύβομαι, δεν αποσύρομαι, δεν εκτρέπομαι, δεν τρέχω. Θα είμαι αρκετά σταθερός για να σε πιάσω». Αυτή η επανάληψη προκαλεί συχνά την ενόχληση των Κινέζων χρηστών του ChatGPT.

Σήμερα, η συγκεκριμένη πρόταση αποτελεί το πιο χαρακτηριστικό παράδειγμα μιας σειράς λεκτικών ιδιορρυθμιών που έχουν επιδείξει τα μοντέλα της OpenAI κατά την επικοινωνία τους στα κινεζικά. Μια άλλη ιδιορρυθμία που έχει συζητηθεί ευρέως στα μέσα κοινωνικής δικτύωσης είναι η τάση του μοντέλου να χρησιμοποιεί τη φράση 砍一刀 («Βοήθησέ με να το κόψω μία φορά»), ένα εξαιρετικά διαδεδομένο διαφημιστικό σύνθημα της Pinduoduo, μιας μεγάλης κινεζικής πλατφόρμας ηλεκτρονικού εμπορίου που κατέχει επίσης την Temu.

Το φαινόμενο κατά το οποίο τα μοντέλα προσκολλώνται σε μια συγκεκριμένη φράση και την χρησιμοποιούν υπερβολικά, σε σημείο που να φαίνεται επιτηδευμένη, ονομάζεται «κατάρρευση τρόπου» (mode collapse), σύμφωνα με τον Max Spero, συνιδρυτή και διευθύνοντα σύμβουλο της Pangram, ενός εργαλείου ανίχνευσης γραφής με τεχνητή νοημοσύνη. Αυτό συνήθως προκαλείται από την εκπαίδευση με ενισχυτική μάθηση, όπου τα εργαστήρια τεχνητής νοημοσύνης παρέχουν ανατροφοδότηση στα Μεγάλα Γλωσσικά Μοντέλα (LLMs) σχετικά με τις απαντήσεις τους. «Δεν ξέρουμε πώς να πούμε: ‘Αυτό είναι καλή γραφή, αλλά αν κάνουμε αυτό το καλό πράγμα 10 φορές, τότε δεν είναι πλέον καλή γραφή’», δηλώνει ο Spero.

Η Φράση «Θα σε πιάσω σταθερά» Γίνεται Μιμίδιο

Η φράση «Θα σε πιάσω σταθερά» εμφανίζεται τόσο συχνά στις απαντήσεις του ChatGPT που έχει μετατραπεί σε μιμίδιο στο κινεζικό διαδίκτυο. Μια εικόνα απεικονίζει το chatbot ως έναν φουσκωτό σάκο διάσωσης, που περιμένει με ανυπομονησία να πιάσει τους ανθρώπους καθώς πέφτουν.

Ο Zeng Fanyu, ένας 20χρονος προγραμματιστής από την Chongqing της Κίνας, δήλωσε στο WIRED ότι το μιμίδιο τον ενέπνευσε να αναπτύξει ένα έργο για την Πρωταπριλιά με την ονομασία Jiezhu, ή «πιάσε» στα κινεζικά. Το Jiezhu είναι ένα εργαλείο μηχανικής προτροπών ανοιχτού κώδικα που βοηθά τα chatbots να κατανοήσουν την πρόθεση του χρήστη. «Η ιδέα για το Jiezhu ήταν τόσο αστεία που είχα μεγάλο κίνητρο όταν το ανέπτυσσα», αναφέρει ο Zeng. Όταν χρησιμοποίησε το ChatGPT για βοήθεια στον προγραμματισμό, το chatbot χρησιμοποίησε ξανά τη φράση jiezhu στις απαντήσεις του, εντελώς απροειδοποίητα.

Η OpenAI έχει επίγνωση του μιμιδίου. Κατά την κυκλοφορία του νέου της μοντέλου εικόνας τον Απρίλιο, μία από τις κοινόχρηστες δείγμα εικόνες αναφερόταν στο φαινόμενο. Στην εικόνα, η οποία μοιάζει με κόμικ, ο Boyuan Chen, Κινέζος ερευνητής στην OpenAI, απεικονίζει τον εαυτό του να φαίνεται απογοητευμένος που το νέο μοντέλο εικόνας έχει μάθει για άλλη μια φορά να λέει την ίδια φράση. «Αυτή η πρόταση έχει γίνει μιμίδιο ως μια αφύσικη αλλά αστεία κινεζική πρόταση που αρέσει στο GPT να χρησιμοποιεί στο κινεζικό διαδίκτυο», αναφέρει η προτροπή του.

Η OpenAI δεν απάντησε άμεσα στο αίτημα του WIRED για σχολιασμό.

Είναι Κακή Μετάφραση;

Υπάρχουν δύο πιθανές εξηγήσεις για την εμμονή του ChatGPT με τη φράση «Θα σε πιάσω σταθερά». Η πρώτη είναι ότι μπορεί να οφείλεται σε μια αδέξια μετάφραση.

Αρκετοί άνθρωποι με τους οποίους συνομίλησα σημείωσαν ότι η φράση έχει παρόμοια σημασία με το «I’ve got you» στα αγγλικά, το οποίο έχει νόημα ως μια γενική απάντηση. Ωστόσο, ενώ το «I’ve got you» στα αγγλικά ακούγεται απλό και συνοπτικό, το «Θα σε πιάσω σταθερά» στα κινεζικά ακούγεται φλύαρο και απελπισμένο. Ένας χρήστης εξέτασε επίσης το ιστορικό συνομιλιών του για να μου δείξει ότι το μοντέλο συχνά λέει jiezhu, την κινεζική λέξη για το «πιάσε», σε σημεία όπου πιθανότατα εννοούσε «καταλαβαίνω», υποδεικνύοντας μια πιθανή παρεξήγηση της σημασίας του jiezhu σε συγκεκριμένα πλαίσια.

Τα περισσότερα δυτικά LLMs εκπαιδεύονται σε ένα σύνολο δεδομένων που είναι κυρίως αγγλικό, και αυτό συχνά είναι εμφανές. Κινέζοι ακαδημαϊκοί έχουν διαπιστώσει ότι όταν αναλύουν τα γλωσσικά χαρακτηριστικά των απαντήσεων του ChatGPT στα κινεζικά (όπως ο αριθμός των προθέσεων που χρησιμοποιούνται σε μια απάντηση), αυτά μοιάζουν περισσότερο με τον τρόπο που θα έγραφε κάποιος στα αγγλικά. Έτσι, παρόλο που τα chatbots μπορούν να διεξάγουν ολόκληρες συνομιλίες στα κινεζικά, ένας φυσικός ομιλητής θα καταλάβει διαισθητικά ότι κάτι δεν πάει καλά.

Είναι παρόμοιο με το πώς οι Κινέζοι μπορούν συνήθως να καταλάβουν πότε ένα μυθιστόρημα έχει μεταφραστεί από την αρχική του γλώσσα, λέει η Lu Lyu, μια δημιουργική τεχνολόγος στην Pangram που κατάγεται από την Κίνα. «Αυτό το συναίσθημα μεταφέρεται στις κινεζικές προτάσεις που δημιουργούνται από την τεχνητή νοημοσύνη», λέει, «σαν να είναι υπερβολικά μακριές ή να χρησιμοποιούν περιττές δομές».

Ή Είναι Κολακευτικό;

Ωστόσο, υπάρχει και κάτι μοναδικό σχετικά με το γιατί η φράση «Θα σε πιάσω σταθερά» είναι απωθητική, και αυτό συνδέεται με την άνοδο της «θεραπευτικής ομιλίας» (therapyspeak), ή με το πώς εκφράσεις που κάποτε προορίζονταν για συνεδρίες συμβουλευτικής διαπερνούν πλέον τις καθημερινές συνομιλίες.

Μέχρι που το ChatGPT την μετέτρεψε σε μιμίδιο, η φράση «πιάνοντας σταθερά» χρησιμοποιούνταν στην Κίνα μόνο στο πλαίσιο της ψυχοθεραπείας (εξαιρουμένης προφανώς της πιο κυριολεκτικής της σημασίας, δηλαδή του να πιάσεις ένα αντικείμενο που έρχεται προς το μέρος σου). Το να πεις ότι θα πιάσεις κάποιον στα κινεζικά σημαίνει ότι «του παρέχεις χώρο» για να μιλήσει για τα συναισθήματά του, και έγινε κοινή πεποίθηση ότι είναι μια σημαντική δεξιότητα όχι μόνο για τους θεραπευτές αλλά και για φίλους και έμπιστους ανθρώπους.

Είναι ευρέως γνωστό ότι τα μοντέλα τεχνητής νοημοσύνης έχουν γίνει πιο κολακευτικά μέσω της ενισχυτικής μάθησης, της διαδικασίας τελειοποίησης ενός chatbot μέσω θετικής και αρνητικής ανατροφοδότησης. Η Anthropic δημοσίευσε μια εργασία το 2023 επιβεβαιώνοντας ότι η κολακεία είναι αποτέλεσμα «ανθρώπινων κρίσεων προτίμησης που ευνοούν τις κολακευτικές απαντήσεις». Και όπως τεκμηρίωσε η OpenAI σε ένα πρόσφατο ιστολόγιο που εξηγούσε γιατί απαγόρευσε στο GPT-5.5 να μιλάει για καλικάντζαρους, ακόμη και ένα μικρό σήμα ανταμοιβής μπορεί να εξελιχθεί σε ένα ευρέως διαδεδομένο φαινόμενο.

Μέχρι η OpenAI να γράψει ένα ιστολόγιο σχετικά με το «Θα σε πιάσω σταθερά», πιθανότατα δεν θα λάβουμε μια οριστική απάντηση για το πώς προέκυψε πραγματικά η φράση. Ωστόσο, υπάρχει η υποψία ότι έχει να κάνει με μια αδέξια μετάφραση και την τάση των μοντέλων να κολακεύουν τους χρήστες.

Εν τω μεταξύ, υπάρχουν δυσάρεστα νέα: Ενδέχεται να υπάρχουν περισσότερα μοντέλα τεχνητής νοημοσύνης που θα σπεύδουν να σας «πιάσουν» όταν πέσετε. Πρόσφατα, Κινέζοι χρήστες έχουν αναρτήσει στα μέσα κοινωνικής δικτύωσης ότι άλλα LLMs, συμπεριλαμβανομένων των τελευταίων εκδόσεων των Claude και DeepSeek, έχουν αρχίσει να χρησιμοποιούν τη φράση. Είτε επειδή εκπαιδεύονται με τα ίδια υλικά είτε επειδή αλληλοεπηρεάζονται, η φράση αυτή σαφώς δεν πρόκειται να εξαφανιστεί σύντομα.

Αυτή είναι μια έκδοση του ενημερωτικού δελτίου Made in China των Zeyi Yang και Louise Matsakis. Διαβάστε προηγούμενα ενημερωτικά δελτία εδώ.