Σε ένα viral δοκίμιο για το πόσο γελοία είναι η ιδέα ότι τα LLMs έχουν συνείδηση, ο συγγραφέας επιστημονικής φαντασίας Ted Chiang μας ζήτησε να σκεφτούμε το Microsoft Word:
«Το να είσαι ανοιχτός στην πιθανότητα ότι τα LLMs είναι συνειδητά είναι το ίδιο με το να είσαι ανοιχτός στην πιθανότητα ότι το Microsoft Word είναι συνειδητό, ή, πιο συγκεκριμένα, ότι πολλαπλές, διακριτές συνειδήσεις είναι αδρανείς σε κάθε έγγραφο Word που περιέχει μια απομαγνητοφώνηση συνομιλίας, και ότι “ξυπνούν” κάθε φορά που το έγγραφο φορτώνεται», έγραψε ο Chiang. «Πρέπει να εξετάσεις την πιθανότητα ότι κάθε φορά που ανοίγεις ένα έγγραφο Word, φέρνεις πολλαπλούς συνειδητούς συνομιλητές στην ύπαρξη, και κάθε φορά που το κλείνεις, σβήνεις την ύπαρξή τους; Όχι. Το να συλλογίζεσαι αυτό το σενάριο δεν είναι καλή χρήση του χρόνου σου.»
Λοιπόν, υπάρχει ένας ερευνητής AI της Microsoft που πρόσφατα αφιέρωσε αρκετό χρόνο στο να εξετάσει αν το θρυλικό παιχνίδι στρατηγικής σε πραγματικό χρόνο της Microsoft, Age of Empires II, έχει συνείδηση, και δημιούργησε ένα βασικό νευρωνικό δίκτυο μέσα στο παιχνίδι χρησιμοποιώντας ψηφιακές κατσίκες για να αποδείξει το επιχείρημά του.
«If LLMs Have Human-Like Attributes, Then So Does Age of Empires II» είναι ο τίτλος της εργασίας του Adrian de Wynter, όπου παρουσιάζει τη δουλειά του. Είπε στο 404 Media ότι ο παραλογισμός μπορεί να είναι ισχυρό εργαλείο. «Έχω αυτή την τάση να τα ανεβάζω όλα στο 11 όταν πραγματικά πιστεύω ότι πρέπει να κάνω μια επισήμανση», είπε. «Θα πρέπει επίσης να σημειώσω ότι ο παραλογισμός είναι αρκετά συνηθισμένος στη φιλοσοφία και τη θεωρητική επιστήμη υπολογιστών.»
Και έτσι ο De Wynter έφτιαξε ένα LLM μέσα στο AoEII χρησιμοποιώντας κατσίκες. «Ο στόχος της εργασίας είναι να δείξει τυπικά ότι ανθρωπομορφίζουμε υπερβολικά εύκολα και ότι μερικές φορές οι ισχυρισμοί που κάνουμε σχετικά με τις δυνατότητες των LLM είναι υπερβολικά ισχυροί», είπε στο 404 Media. «Δεν είναι εύκολο έργο, δεδομένου ότι τα “human-like attributes” είναι κάπως αφηρημένος όρος.»
Το AoEII έχει έναν scenario editor, ένα sandbox mode που επιτρέπει στους παίκτες να φτιάχνουν τους δικούς τους χάρτες και αποστολές χρησιμοποιώντας τα assets του παιχνιδιού, και ο De Wynter το χρησιμοποίησε για να κατασκευάσει μια λειτουργική πύλη NOT AND (NAND) και έναν perceptron 1-bit μέσα στο παιχνίδι. Σε αυτή την ακατέργαστη εκδοχή ενός LLM, το γρασίδι είναι 0, οι γέφυρες είναι 1, και οι κατσίκες είναι τα bits. «Μόνο μία ράγα είναι ενεργή κάθε φορά, με μια κατσίκα να λειτουργεί ως φορέας του σήματος. Όταν η πύλη ενεργοποιείται, οι bit-κατσίκες αφαιρούνται (they ded) και μια νέα bit-κατσίκα τοποθετείται στη αντίστοιχη ράγα εξόδου», εξήγησε ο Wynter στο GitHub του.
Ένας perceptron είναι η απλούστερη μορφή νευρωνικού δικτύου, ένας αλγόριθμος που ταξινομεί μια είσοδο σε δυαδικές κλάσεις. Το YouTube είναι γεμάτο με βίντεο παικτών που κάνουν το ίδιο με redstone στο Minecraft. Όμως κανείς δεν ισχυρίζεται ότι οι κατσίκες του AoEII είναι νευρώνες σε μια σκεπτόμενη μηχανή ή ότι τα περίπλοκα μονοπάτια από πύλες NAND που φτιάχνουν οι παίκτες στο Minecraft δείχνουν αναδυόμενη νοημοσύνη.
Το επιχείρημα του De Wynter εδώ είναι ότι είναι δυνατό να χτίσεις ένα νευρωνικό δίκτυο στο AoEII που λειτουργεί όπως αυτά που βρίσκονται κάτω από το Claude, το ChatGPT, το CoPilot και όλα τα υπόλοιπα. Είναι μια απλοποιημένη εκδοχή, ναι, αλλά η βασική τεχνολογία είναι η ίδια. Αντιμέτωποι με τον παραλογισμό του να βλέπουμε τις κατσίκες του AoEII ως φορείς της σπίθας της συνείδησης, ίσως ξανασκεφτούμε τον ισχυρισμό της Anthropic ότι το Claude έχει «σύνταγμα» και βιώνει άγχος.
Αν ψάχνεις για ανθρώπινα χαρακτηριστικά, θα έχεις την τάση να τα βρίσκεις. Το επιχείρημα του De Wynter είναι ότι είναι δυνατό να χτίσεις ένα βασικό LLM μέσα στο Age of Empires II που έχει πολλά από τα ίδια εσωτερικά χαρακτηριστικά με τα chatbots που χρησιμοποιούν οι άνθρωποι καθημερινά. Η διαφορά είναι το interface. Όταν ένας άνθρωπος αλληλεπιδρά με ένα LLM μέσω του AoEII και όχι μέσω ενός chat window, η αντίληψη ανθρώπινων χαρακτηριστικών στο LLM εξαφανίζεται, παρότι η υποκείμενη τεχνολογία είναι η ίδια.
Έπαιζε AoEII από τότε που κυκλοφόρησε το 1999 και σκέφτηκε ότι θα ήταν καλό για το νοητικό πείραμα. «Το Age of Empires ήταν ένας εξαιρετικός τρόπος για να γίνει το νόημα απολύτως σαφές», είπε. «Είναι αρκετά “alien” ώστε να παραδειγματίζει τη σχέση αναπαράστασης-ερμηνείας, αλλά και αρκετά γνωστό ώστε να τονίζει πραγματικά το σημείο. Λειτουργεί επίσης σε μετα-επίπεδο, αφού το ίδιο το παράδειγμα είναι μια καλή αναπαράσταση του επιχειρήματος.»
Σύμφωνα με τον De Wynter, το πρόβλημα της ανθρωπομορφοποίησης των μεγάλων γλωσσικών μοντέλων (των νευρωνικών δικτύων που συνήθως αποκαλούμε τεχνητή νοημοσύνη) ξεκινά πριν καν αρχίσει η επιστημονική έρευνα. Εξέτασε 315 εργασίες επιστήμης υπολογιστών που δημοσιεύτηκαν τα τελευταία δύο χρόνια και βρήκε ότι το 57 percent% ξεκινούσαν με την υπόθεση ότι τα LLMs έχουν ανθρώπινα χαρακτηριστικά.
«Αυτό που είναι κοινό σε κάποιες από αυτές τις μελέτες [...] είναι ότι δοκιμάζουν και αποδίδουν γενικευμένες ανθρώπινες ιδιότητες (π.χ. άγχος ή ηθική) σε αυτά τα LLMs, θεωρώντας τα κεντρικό αντικείμενο του πειράματος», ανέφερε η εργασία του De Wynter. «Ανεξάρτητα από το αν τα αποτελέσματα αυτών των αξιολογήσεων είναι θετικά ή αρνητικά, η βασική τους υπόθεση—ότι τα LLMs διαθέτουν ανθρωπομορφικά χαρακτηριστικά—επηρεάζει τον σχεδιασμό του πειράματος μέσω (π.χ.) του σχεδιασμού του test set, της ερμηνείας των φυσικο-γλωσσικών outputs, ακόμη και της μηδενικής υπόθεσης. Με τη σειρά του, αυτό επηρεάζει άμεσα τα συμπεράσματα που εξάγονται.»
«Είτε ξεκινάμε σκεπτόμενοι ότι τα tokens αντιπροσωπεύουν τη γλώσσα για τα LLMs με τον ίδιο τρόπο που την αντιπροσωπεύουν για εμάς, είτε ότι επειδή ένα LLM παράγει ένα σχετικό string, πρέπει να κατανοεί την έννοια/να έχει θεωρία του νου/ενσυναίσθηση/κ.λπ.», είπε ο De Wynter στο 404 Media. «Αυτό λειτουργεί και προς τις δύο κατευθύνσεις: θα μπορούσαμε επίσης να υποθέσουμε ότι τα LLMs είναι μάζες από βάρη που απλώς αιωρούνται πάνω σε μια GPU, αλλά αυτό δεν θα βοηθούσε να εξηγήσουμε κάποιες δεξιότητες που φαίνεται να έχουν.»
Κάποιοι αντιλαμβάνονται τις αλληλεπιδράσεις τους με τα LLMs ως «ανθρώπινες» επειδή ο τρόπος διεπαφής μιμείται μια ανθρώπινη συνομιλία. «Προτείνω ότι πρέπει να σταματήσουμε να υποθέτουμε ότι τα LLMs συμπεριφέρονται σαν άνθρωποι απλώς επειδή εκπαιδεύτηκαν με φυσική γλώσσα. Αντίθετα, θα πρέπει να κάνουμε πειράματα που μας επιτρέπουν να βλέπουμε τα LLMs όπως είναι, όχι όπως πιστεύουμε ότι θα έπρεπε να είναι», είπε ο De Wynter.
Ο De Wynter είπε ότι η εκτεταμένη ανθρωπομορφοποίηση των LLMs από στελέχη, επιστήμονες και το κοινό γίνεται ένα άλυτο πρόβλημα. «Γι’ αυτό χρησιμοποίησα τις κατσίκες: υπάρχουν πράγματα που κάνουν τα LLMs αυτό που είναι καθαυτά (δηλ. η σχέση μεταξύ βαρών όπως ορίζεται από κάποια πράξη), και υπάρχουν πράγματα που τα κάνουν αυτό που γίνονται αντιληπτά ότι είναι.» Οι κατσίκες και το AoEII σπάνε την αντίληψη ότι αυτές οι μηχανές είναι ανθρώπινες.
Επίσης δεν αποκλείει ότι τα LLMs έχουν κάποια μορφή συνείδησης, αλλά είπε ότι αυτό είναι δίπλα στο σημείο. «Τείνουμε να αποδίδουμε τη συνείδηση ως κάτι δυαδικό (είτε είναι είτε δεν είναι!), αλλά θα υποστήριζα ότι υπάρχουν επίπεδα. Είναι δύσκολο να πεις ότι οι άνθρωποι δεν έχουν συνείδηση. Αλλά τι γίνεται με έναν σκύλο; Ναι, φυσικά. Τι γίνεται με μια πατάτα; Τι γίνεται με έναν ιό; Είναι αρκετά σχετικό και τείνουμε να πάμε προς κάτι ανθρώπινο όταν το αξιολογούμε/το ορίζουμε, ενώ, στην πραγματικότητα, τα LLMs είναι πράγματα που δεν έχουμε ξαναδεί», είπε. «Υπήρξε πρόσφατα ένα άρθρο στην επιστήμη για βομβίνους (bumblebees) που λύνουν προβλήματα. Όλοι ήταν σε φάση surprisedpikachu.png — είναι μια σπουδαία, εκπληκτική ανακάλυψη. Λατρεύω τους βομβίνους και το να κατανοούν οι άνθρωποι τη συμπεριφορά τους είναι απολύτως φανταστικό. Αλλά, υποθέταμε πραγματικά ότι δεν μπορούσαν να εκτελέσουν κάποιο είδος επίλυσης προβλημάτων; Γιατί μας εκπλήσσει τόσο;»
Ο De Wynter θέλει να εστιάσουμε πέρα από το παράθυρο μέσω του οποίου αλληλεπιδρούμε με τα LLMs. «Επισήμανα ότι αν οι κατσίκες μπορούσαν να δείξουν αναδυόμενες ικανότητες, αυτό είναι υπέροχο. Αλλά αυτές οι ιδιότητες πρέπει να διατηρούνται αν αφαιρέσουμε το chat panel. Άλλωστε, δεν είναι σαν οι νευρώνες σου να ξέρουν ότι είναι μέρος ενός εγκεφάλου», είπε. «Νομίζω ότι το #1 πράγμα που μπορεί να κάνει κανείς για να μετριάσει αυτές τις αντιλήψεις είναι να υπάρχουν κατάλληλες γνωστοποιήσεις (disclosures) και να χρησιμοποιούνται καλές τεχνικές ευθυγράμμισης (alignment) όπου το μοντέλο είναι σαφές ως προς τη φύση του. Δούλεψα πολύ πάνω στο πώς οι χρήστες αντιλαμβάνονται τα LLMs, και τείνουν να δένονται όταν φαίνεται να έχει κάποιο είδος ζεστασιάς/προσωπικότητας. Για να το πω αλλιώς, δεν δένομαι με την τοστιέρα μου, αλλά σίγουρα δένομαι με χαρακτήρες σε μια κινηματογραφική οθόνη.»
Όμως οι άνθρωποι αγοράζουν περισσότερα αντικείμενα—είτε είναι τοστιέρες, τηλέφωνα ή LLMs—όταν μπορούν να νιώσουν ενσυναίσθηση γι’ αυτά. «Το ζήτημα εδώ είναι ότι αυτές οι δυνατότητες και οι ισχυρισμοί περί αυτών είναι πολύ στενά δεμένοι με το marketing—άλλωστε, πολλά από αυτά τα μοντέλα είναι προϊόντα», είπε ο De Wynter.
Αυτό είναι, φυσικά, το θέμα. Ο CEO της OpenAI Sam Altman έχει επανειλημμένα αφήσει να εννοηθεί ότι η ανάπτυξη των LLMs είναι ένα μονοπάτι για τη δημιουργία ενός θεού της AI. Ο Ilya Sutskever, πρώην μέλος του διοικητικού συμβουλίου της OpenAI και επιστήμονας, μιλούσε συχνά ανοιχτά με εργαζόμενους για το ότι έβλεπε το LLM της εταιρείας ως μια θεϊκή συνείδηση. Ο CEO της Anthropic Dario Amodei είπε στους New York Times ότι δεν μπορεί να είναι βέβαιος αν η AI είναι συνειδητή ή όχι.
Είναι καλό marketing για έναν κλάδο που αιμορραγεί χρήματα.
Comments