Inspirowany podziałem, jaki wyrósł w XX wieku między produkcją masową a rękodziełem, czy mechaniką kwantową i klasyczną, widzę w przyszłości możliwość rozwoju dwóch różnych sposobów używania języka - różniących się między sobą na poziomie głębszym niż poszczególne systemy języków naturalnych. Ograniczenia niesione przez język są tematem rozważań filozoficznych już od czasów antycznych. Do tego, w ostatnich latach, w związku z globalizacją, demokratyzacją, wzrostem roli Internetu i rozwojem sztucznej inteligencji, ujawniają się ogromne zagrożenia płynące z używania języka w niezmienionej formie. Mimo rewolucyjnych zmian w prawie każdej dziedzinie życia i nauki, podstawowe mechanizmy działania języka pozostawały od wieków niezmienne. Te zjawiska, również w kontekście testu Turinga, nasuwają wniosek, że językowa rewolucja może być potrzebna, jeśli nie nieunikniona. Esej w dużym stopniu zainspirowany jest dwoma cytatami Ludwiga Wittgensteina – jednym o granicach języka będących granicami świata, drugim o niedorzeczności jego propozycji.
The limits of my language are the limits of my world.
To, że każdy kolejny opanowany język pozwala nam myśleć w sposób szerszy i dokładniejszy nie podlega według mnie żadnej wątpliwości. Pierwszym z powodów jest znajomość nowych wyrazów i konceptów, konstrukcji pozwalających nam w bardziej precyzyjny sposób formułować myśli. Po poznaniu rzeczowników hon'ne i tatemae, oraz japońskiego systemu honoryfikatywności w inny sposób będziemy patrzeć na Japończyków – a może i wszystkich otaczających nas ludzi. Drugim jest dostęp do dużo większej ilości informacji – mogąc przeczytać artykuły o danym wydarzeniu w Le Monde, The Spectator i Mainichi nabierzemy szerszego spojrzenia na sprawę, niż osoba ograniczona jedynie do polskich mediów, która o pewnych sprawach w ogóle się nie dowie. Po trzecie, wraz ze wzrostem naszych kompetencji językowych wzrasta nasza umiejętność rozumienia tekstu – na egzaminach językowych niższego szczebla sprawdzana jest znajomość występujących słów, i rozumienie konstrukcji zdań. Na tych sprawdzających umiejętności na wyższym poziomie często trzeba wykazać się także rozumieniem tego, co nie zostało powiedziane wprost – kontekstu i intencji autora. Dzięki takim kompetencjom z każdego tekstu wyciągamy więcej. A zwłaszcza w dzisiejszym świecie, gdzie jesteśmy atakowani tekstem z każdej strony, umiejętność bardzo głębokiego rozumienia języka to skarb nie do przecenienia. Opanowując kolejne języki mamy więc więcej informacji, lepiej je rozumiemy i efektywniej przetwarzamy – a to wszystko w czasach nazywanych "Information Age". Oczywiście, dostępny nam świat staje się dzięki językom niemalże dosłownie większy – możemy polecieć dalej, porozumieć się, przeżyć więcej. W zamieszczonym wyżej cytacie bardziej istotny zdaje się jednak inny problem.
There is indeed the inexpressible. This shows itself; it is the mystical.
Język idealny, taki, który byłby w stanie wyrazić w dokładny sposób wszystko, co myślimy, to bardzo stare marzenie. Według Jakobsona, języki naturalne różnią się od siebie nie tym, co mogą wyrazić, a tym co muszą. Nie należy upatrywać więc idealnego systemu w jednym z języków narodowych. Według Wittgensteina, język nie potrafi wyrazić tego co poza światem – i tam również znajduje się sens świata. W związku z tym, całą filozofię nazywa krytyką języka. Podobny pogląd wyrażony jest w "Manifeście posthumanistycznym" Roberta Pepperella, który twierdzi, że większość debat filozoficznych to problemy językowe biorące się z trzech błędnych założeń: że język jest konsekwentny, że, ponieważ istnieje dane słowo, musi istnieć "rzecz", którą ono reprezentuje oraz, że te reprezentowane rzeczy powinny być konsekwentne same w sobie. O zasłonie ukrywającej przed nami prawdziwy, idealny świat mówił już Platon przy okazji alegorii jaskini. Być może znane aktualnie systemy języków naturalnych i niezbędny etap transformacji myśli w zdania to "źli ludzie", rzucający nam na ścianę mylące cienie. Sokrates unikał podobno zapisywania swoich myśli, twierdząc, że może to wypaczyć ich sens.
W związku z problemem opisania tego, czego język nie potrafi ująć, skupię się na miejscach, gdzie komunikacja językowa zawodzi najbardziej. Istotne jest tutaj, że znaczenie nie jest niesione przez język (rola kontekstu), a negocjowane przez odbiorcę w kontekście ich kultury oraz, że w rzeczywistości, "realny świat" jest w znacznym stopniu konstruowany przez ludzi podświadomie na podstawie zwyczajów językowych danej grupy. Taki obraz "realnego świata" będzie więc dla innych kłamstwem. Zdaje się, że tak długo jak znaczenie będzie negocjowalne w ramach kręgu kulturowego, a ludzie naciskać będą na prawdy obiektywne, tak długo efektem ubocznym języka będzie kłamstwo i nieporozumienie. Niedoskonałość komunikacji językowej w takiej formie w jakiej ją znamy wyraża doskonale spostrzeżenie jednego z bohaterów "Dżumy":
Zdawał sobie wówczas sprawę, że jego rozmówca i on nie mówią o tym samym. On bowiem wypowiadał się z głębi długich dni rozmyślań i cierpień i obraz, jaki chciał przekazać, wypalał się wolno w ogniu oczekiwania i namiętności. Drugi natomiast wyobrażał sobie konwencjonalne uczucie, tuzinkowe cierpienie, seryjną melancholię. Życzliwa czy wroga, odpowiedź zawsze była niewłaściwa i trzeba było wyrzec się rozmów.
Słowa takie jak miłość, strach, szczęście, są tak rozmyte znaczeniowo, używane nawet przez jedną osobę do opisania tak różnych od siebie stanów, że ciężko uwierzyć, że to jedne z ważniejszych słów dla naszego przetrwania jako gatunku. Oczywiście, od wieków podejmowane są próby sprecyzowania uczuć – miłość platoniczna, euforia, angielskie dread. Ciężko jednak wyzbyć się strachu, że z czasem i te słowa zostaną przez poezję, hiperbole, kłamstwa i żądze manipulacji rozmyte i spłycone. Czy nie prościej byłoby móc po prostu "pokazać" rozmówcy nasze uczucie? Problem ten widać zwłaszcza w dzisiejszym świecie – spolaryzowanym, zdającym się cały czas stać na skraju przepaści, i takim, w którym każda iskra konfliktu może skończyć się nuklearną zagładą.
W Internecie nietrudno trafić na dyskusje wyznawców lewicy z wyznawcami prawicy, ograniczające się do wyzywania się nawzajem, przyjmowania tych ekstremalnie rozmytych znaczeniowo słów jako podstawowych elementów swojej tożsamości, dyskusji gdzie nikt nie ma czasu ani chęci na definiowanie, szukanie meritum, czy kompromisu. Sam wyznaję być może dość idealistyczny pogląd, że spora część elit rządzących, i ludzi w ogóle, naprawdę chce, aby ich współobywatele byli szczęśliwi – ale mają na to bardzo różne plany. Na co dzień nie mogę się jednak opędzić od narracji, że jedna grupa społeczna chce zniszczyć inną – że na moje życie czyhają imigranci, partia rządząca, opozycja, ludzie o określonym kolorze skóry czy wyznawcy danej religii. Przede wszystkim mam ludzi, którym udało się dojść do jakiejś władzy, za bardzo pragmatycznych, i ciężko mi uwierzyć, że będą poświęcać swój czas i zasoby, aby mi było gorzej. Wolę wierzyć, że chcieliby po prostu być szczęśliwi – razem ze mną. Jak jednak mają to przekazać innym, mając do dyspozycji słowa, które każdy może interpretować po swojemu? Do tego dochodzi praktykowane przez media regularne, systemowe zmienianie znaczeń terminów używanych w dyskursie politycznym. Język stał się – dla elit, mediów, ale także "konsumentów", użytkowników Internetu – polem bitwy. Czy w świecie z językiem idealnym, lub bezpośrednim przekazem stanów umysłowych, mielibyśmy większe szanse na pokój – i przetrwanie? Być może to w strukturach głębokich lub tym, co mistyczne Wittgensteina kryją się ludzkie cechy wspólne które pozwoliłyby nam zrozumieć, że ostatecznie więcej nas łączy, niż dzieli. W tym kontekście również granice stawiane przez język mogą oddzielać nas od innego świata – tego z Imagine Johna Lennona. W ostatnich latach mogliśmy zaobserwować nowe, dużo groźniejsze zjawisko.
Metropolis sits on the water's edge and waits for its predator to arrive.
"Teoria martwego Internetu" to skrzyżowanie internetowego folkloru z solipsyzmem. Zakłada, że znaczna większość rzekomo tworzonych przez człowieka internetowych treści jest w rzeczywistości generowana przez sieci sztucznej inteligencji i specjalne programy ("boty"). Powstała w odpowiedzi na zmiany które przeszły społeczności internetowe w ciągu ostatnich lat w wyniku popularyzacji i monopolizacji mediów społecznościowych. Fani teorii często podkreślają uczucie, że w porównaniu do wcześniejszego żywego, kolorowego, zróżnicowanego Internetu, ten obecny zdaje się być jak wielki balon "pusty" i "sterylny" – jesteśmy atakowani ogromnymi ilościami treści, są one jednak do siebie bardzo podobne i pozbawione człowieczeństwa. Ma to być dowodem na przejęcie go przez udające użytkowników programy tworzące i udostępniające masowo treści – w dużej mierze dla siebie nawzajem - w celu promowania produktów i idei.
Póki co, teoria martwego Internetu zdaje się być tylko mało znaną ciekawostką, wynikiem poczucia nostalgii i zmieniającej się kultury. Ale spory wpływ botów na kształt obecnego społeczeństwa (a więc i język) nie ulega wątpliwości. Raport badaczy z Computational Propaganda Project przy Uniwersytecie w Oksfordzie opisuje działania firmy rzekomo odpowiedzialnej za stworzenie sieci setek tysięcy fałszywych kont, które używane były w polskiej polityce i przy kampaniach wyborczych. Według raportu, w rosyjskojęzycznej części Twittera około 45% aktywności pochodzi z wysoce zautomatyzowanych kont. Wspomina on też o sieci 500 botów użytych w trakcie wyborów w USA w 2016 roku, rzekomo odpowiedzialnej za 2 miliony tweetów, w tym 400 000 na temat Donalda Trumpa i ogromnej roli jaką odgrywają tam tego rodzaju programy - ponad 60% Amerykanów polega na mediach społecznościowych, jeśli chodzi o dyskusje polityczne. Potencjał botów dodatkowo podkreśliły ostatnie wydarzenia na amerykańskiej giełdzie, tzw. "Afera GameStop", w trakcie której były rzekomo wykorzystywane do zachęcania użytkowników forów internetowych do "pompowania" konkretnych akcji. To sugeruje, że wpływ sztucznej inteligencji na społeczeństwo staje się obiektem zainteresowania kolejnych, bardzo wpływowych grup.
To oczywiście nie potwierdza teorii martwego Internetu – ale zdecydowanie może ją napędzić. Miłośnicy Internetowego folkloru i badacze zgadzają się co do tego, że amerykańskie wybory prezydenckie w 2016 roku były przełomowym punktem, jeśli chodzi o wygląd Internetowych społeczności. Mówi się o "Internecie post-2016", to wtedy po raz pierwszy media społecznościowe pokazały swój potencjał w kształtowaniu sytuacji geopolitycznej świata a w niektórych zakątkach Internetu coraz głośniej zaczęto mówić o tzw. "meme magic" – zmienianiu rzeczywistości za pomocą szybko rozprzestrzeniających się, humorystycznych grafik. Możliwości botów, jeśli chodzi o kształtowanie społeczeństwa również w Polsce ciężko przecenić, biorąc pod uwagę rolę, jaką odegrały media społecznościowe na przykład w kontekście Strajków Kobiet, pandemii Covid-19, czy odbywających się w trakcie lockdownu wyborów prezydenckich z kampaniami w dużej mierze ograniczonymi do Internetu. Ich celem może być nie tyle przekonanie innych, co polaryzacja społeczeństwa, np. w celu destabilizacji innego państwa lub zwrócenia uwagi społecznej na określone sprawy; media nie mówią nam co należy myśleć, ale o czym należy myśleć. Dodajmy do tego fakt, że media społecznościowe, używające utrzymywanych w tajemnicy algorytmów, aby "dopasować" treści do preferencji konkretnego użytkownika można porównać nie do otwartej przestrzeni, ale do sieci zamkniętych pokoi – pokoi, z których nie możemy uciec, a często nie zdajemy sobie nawet sprawy, że jesteśmy w nich zamknięci.
W procesie walki ze spamem opracowane zostały efektywne metody walczenia z komunikatami powielanymi masowo w niezmienionej formie – dzięki rozwojowi technologii sztucznej inteligencji, systemy oparte na sieciach neuronowych uczą się jednak coraz lepiej symulować ludzki język. Jak przewidział w 1950 roku Alan Turing, ludzkości udało się nauczyć komputer jak nas oszukać. Na przykładzie niejasnej działalności botów widzimy doskonale jak kontrola nad światem powoli wyślizguje nam się z rąk. Sztuczna inteligencja nie zabiła jeszcze Internetu – ale bardzo go zmieniła i upolityczniła, a hordy sztucznych użytkowników, nawzajem się radykalizujące, podejmujące decyzje o tym co kupić i co promować na podstawie jedynie postów innych botów to nie tak odległa wizja. W 2019 roku Facebook usuwał co kwartał średnio prawie 2 miliardy fałszywych kont. Nie przypadkiem skupiam się tutaj na wydarzeniach ostatnich kilku lat - jeśli wierzyć, że język czeka w najbliższym czasie rewolucja, to bezpośrednio poprzedzające ją okoliczności będą miały największy wpływ na jej przebieg. Swoje armie botów wysyłają w Internet kolejne grupy widzące tam coraz większy interes, to z kolei zmniejsza zaufanie i daje możliwość oskarżenia każdego o bycie "botem" i szybkiej dehumanizacji tych, którzy prezentują inne poglądy. Gdy w ciemności chcemy odnaleźć drugiego człowieka posłużymy się językiem, pytając jest tu ktoś? Być może możliwy jest język w którym na takie pytanie, tak jak kiedyś, twierdząco może odpowiedzieć jedynie inny człowiek.
Używanie języka w niezmienionej formie niesie też inne, bardziej odległe zagrożenia. Tak zwana semiotyka nuklearna (nuclear semiotics) zajmuje się problemem ostrzeżenia żyjących tysiące lat w przyszłości ludzi przed niebezpieczeństwem związanym z miejscami składowania odpadów nuklearnych. Przecież zabezpieczenia, groźne konstrukcje czy komunikaty językowe nie powstrzymały współczesnych badaczy przed wtargnięciem do egipskich grobowców. Trudno wyjść poza ramy naszego konkretnego – kulturowego – rozumienia znaków i stworzyć komunikat, który skutecznie zniechęci ludzi dalekiej przyszłości do wykopywania nadal promieniotwórczego uranu – nawet proste komiksy mogą być odczytywane w różnych kierunkach, dając kompletnie odmienne komunikaty, a groźnie wyglądająca dla nas czaszka może stać się w przyszłości symbolem życia czy wiedzy. Bardziej abstrakcyjną wersją tego samego problemu jest wyzwanie komunikacji z ewentualnymi istotami pozaziemskimi – ludzkość próbowała już wysyłać w kosmos różnego rodzaju komunikaty, nie wiemy jednak, czy udałoby nam się przekazać innej cywilizacji nawet sam fakt, że myślimy. Przedarcie się przez granice języka staje się więc już nie tylko marzeniem filozofa, a coraz bardziej koniecznością związaną z postępem technologicznym.
Język paradoksalnie jest dużym utrapieniem również dla językoznawców. Eco porównuje badanie języka za pomocą języka do splecenia dwóch dłoni w tak zawiły sposób, że po dotknięciu jednego z palców, ciężko jest powiedzieć do której należy dłoni. Lingwistyka formalna oferuje matematyczne metody badania języka – matematyka to nadal jednak nieidealny język i nie rozwiązuje chociażby wielu problemów niechcianej polisemii. Nie odpowiada też na pytanie o to, co dokładnie, na przykład w kontekście filozoficznym, powinniśmy w języku badać. Chodzi o pułapkę, którą Wittgenstein opisuje jako "dokładne badanie kształtu figury szachowej, żeby lepiej zrozumieć zasady gry w szachy". Porównuje też niedokładność językowych metod badania świata do prób naprawy pajęczej sieci za pomocą palców. Przypomina to inne porównanie, używane do opisu zasady nieoznaczoności Heisenberga – że badanie dokładnego zachowania elektronów jest jak próba dokładnego opisania wystawy porcelany za pomocą rzucania dookoła piłką do koszykówki i sprawdzania, jak się odbije.
Rewolucyjne odkrycia związane z mechaniką kwantową dały nam możliwość opisu zachowań nawet najmniejszych cząstek, zmieniły sposób patrzenia na świat i umożliwiły wynalezienie lasera, systemu GPS, czy tranzystorów. XX wiek przyniósł zmiany w najbardziej podstawowych paradygmatach fizyki – czy możemy spodziewać się podobnej rewolucji w użyciu języka? W 1952 roku Lewis Mumford porównuje stopień skomplikowania symbolicznej struktury języka do stopnia skomplikowania współczesnej mu fabryki. Od tamtej pory ludzkość skonstruowała Wielki Zderzacz Hadronów, czy Międzynarodową Stację Kosmiczną – nieporównywalnie bardziej wyszukane niż fabryka samochodów z lat 50. XX wieku. Podstawowe mechanizmy działania języka pozostają jednak dalej takie same. W XX wieku miał wprawdzie miejsce tzw. "zwrot lingwistyczny" – nie wpłynął on jednak na to, jak korzystamy z języka na co dzień, raczej jeszcze bardziej podkreślił jego ograniczenia. Wraz z rosnącą świadomością niedoskonałości języka rośnie potrzeba prawdziwego przełomu. Być może tocząca się w Internecie językowa zimna wojna botów i ludzi, opisywana przez Chomsky'ego medialna wojna o znaczenia terminów politycznych, postęp w innych dziedzinach i nowe możliwości przetwarzania języka naturalnego przyniosą nam w najbliższym czasie rewolucję na miarę tej kwantowej.
My propositions are elucidatory in this way: he who understands me finally recognizes them as senseless, when he has climbed out through them, on them, over them.
Pociąg do nieznanego zdaje się być jedną z niezbywalnych cech człowieka. Widać to między innymi w angielskim przysłowiu the grass is always greener on the other side, czy tak ważnym w naszej kulturze motywie zakazanego owocu. Widząc mur, zastanawiamy się co za nim stoi – a przy rozmowie o kształcie czy rozmiarze Wszechświata, nie możemy pozbyć się pytania – co w takim razie jest dalej? Wydaje mi się, że cytat, o którym jest ten esej – granice mojego języka są granicami mojego świata – to swoista gra Wittgensteina na tej ludzkiej cesze, zaproszenie czytelnika, człowieka, filozofa do zadania tego bardzo ludzkiego pytania – co więc jest dalej? W końcu nie może on się wypowiedzieć wprost o tym, czego język nie potrafi ująć. Wittgenstein nazywa swoje propozycje drabiną. Jeśli miałbym pociągnąć tę metaforę dalej, widzę człowieka zamkniętego w domu, który wspinając się na drabinę dostrzega okno na świat – ten idealny, mistyczny, wymykający się ramom języka. Okno jest jednak kompletnie zakurzone i na początku nic przez nie nie widać. Dopiero dzięki ostatnim postępom w dziedzinach lingwistyki, cybernetyki, neurolingwistyki, neurotechnologii i kognitywistyki udaje się to okno trochę przetrzeć i rzucić okiem na to co leży za nim – to, czego przez tysiąclecia człowiek mógł się jedynie domyślać. Jako swoją próbę odrzucenia drabiny i skupienia się na świecie poza granicami języka spróbuję opisać pokrótce trzy sposoby, w jakie może udałoby się tego świata dotknąć i jakie mogą być tego efekty.
Praktyczne pomysły na naruszenie granic języka przynosi technologia. Gdy Sapir pisał, że umysłu ludzkiego nie da się obserwować wprost, nie da się go mierzyć, fotografować, nagrywać na taśmę, cybernetyka nie była jeszcze tak zaawansowana. O ile dalej nie możemy obserwować wprost umysłu, o tyle mózg już tak. Amerykańska DARPA (Agencja Zaawansowanych Projektów Badawczych w Obszarze Obronności) fundowała między innymi projekt NIA (Neurotechnology for Intelligence Analysts), mający na celu szybsze wykrywanie zagrożeń widocznych na kamerach. Operator, w specjalnym, badającym fale mózgowe hełmie, obserwuje bardzo szybko zmieniające się obrazy. Jednocześnie, elektroencefalograf monitoruje jego mózg w poszukiwaniu fali P300 – sygnału tworzonego przez mózg w przypadku zaobserwowania czegoś ważnego. Fala ta pojawia się już 300 milisekund po ukazaniu się bodźca. Dzięki współpracy komputera i ludzkiego mózgu system jest w stanie znacznie dokładniej i szybciej wykrywać istotne zdarzenia na polu bitwy.
Ten proces zdaje się pomijać etap transformacji myśli na język naturalny. Czy wspomniana fala P300 to już znak? Jeśli określona aktywność mózgu jest tu signifiant a fakt, że dzieje się coś ważnego signifié, to wpływ kręgu kulturowego jest tu znikomy, jeśli nie żaden. Samo tempo zachodzących tu procesów – mózg operatora przetwarza 10 obrazów na sekundę – każe myśleć, że nie ma tu czasu na język, że całość odbywa się podświadomie. Samo to, że, gdy pominiemy język, ludzki mózg ma zdolność przetwarzania informacji z taką prędkością, i to dokładniej niż komputer, a także to, jak efektywny jest system wykorzystujący współpracę podświadomości i komputera, każe dostrzegać w takich działaniach spory potencjał. Dotykamy tu uniwersaliów językowych – fala P300 jest wykrywana u badanych niezależnie od języka. Mimo, że od czasu jej opisania znaleziono dla niej bardzo wiele zastosowań, jej znaczenie pozostaje dość nieokreślone – jedynie, że umysł badanego wykrył jakąś anomalię. Jeśli traktować fale mózgowe wywoływane przez różne rodzaje zdarzeń jako ich znaki (index u Peirce'a), być może P300 jest pierwszą literą w bardzo rozbudowanym alfabecie aktywności mózgu. Neurofizjologia zna obecnie o wiele więcej takich markerów, oraz znacznie skuteczniejsze sposoby ich badania. Widzę tu pierwsze kroki do wspomnianej już wcześniej możliwości "pokazywania" innym swoich uczuć z mniejszą szansą na ich błędną interpretację – jeśli opanowalibyśmy możliwość bezstratnego zapisu stanu umysłowego, a następnie odtworzenia go w mózgu innej osoby. Jednocześnie, jak pokazują efekty projektu NIA, działanie na takich znakach jak P300 jest znacznie szybsze niż komunikacja w języku naturalnym, do tego w teorii dokładniejsze i bliższe strukturom głębokim, a więc i temu, co mistyczne. Być może, opracowanie pełnego "alfabetu" takich fal – modeli aktywności mózgu odpowiedzialnych za różne rodzaje strachu, szczęścia, miłości – skłoniłoby Wittgensteina do stwierdzenia, że już nie granice języka, ale granice umysłu są granicami jego świata. A to już niesamowity postęp i, zdawałoby się, o wiele większy świat. Ostatnie lata przyniosły ogromne postępy w kwestii interfejsów mózg-komputer. Możliwe jest już m.in. pisanie znaków w myślach i przetwarzanie zebranych podczas tego przez encefalograf danych na zdania. Mówi się, że kto czyta książki, żyje podwójnie. Nauka zna dziś możliwości przesyłania nawet terabajtów danych na sekundę – jak bogate życie moglibyśmy mieć z możliwością "przeczytania" książki, wraz z jej opracowaniami, w mgnieniu oka? Zaoszczędzony czas moglibyśmy poświęcić na dokładne zastanowienie się nad jej przesłaniem, nie wspominając już o możliwości zaznajomienia się z wszystkimi dostępnymi dziełami filozoficznymi świata – i to w jedno popołudnie.
W ostatnich latach miał też miejsce inny przełom, wspomniane już przy okazji botów oparte o sieci neuronowe i "głębokie uczenie" (deep learning) modele generujące tekst. W 2019 roku OpenAI wydało GPT-2 (Generative Pre-trained Transformer 2), posiadający 1,5 miliarda parametrów system syntezujący następny obiekt w sekwencji (następne słowo w zdaniu). Potrafi on pisać teksty, streszczenia i odpowiadać na pytania. Początkowo GPT-2 nie był dostępny dla każdego – twórcy powoływali się na zbyt duże zagrożenia z nim związane, na przykład w kwestii dezinformacji. Rok później opracowany został jego następca, GPT-3 – ponad stukrotnie potężniejszy, radzący sobie doskonale z wieloma pytaniami przy których mylił się poprzedni model. Kod źródłowy GPT-3 nie został udostępniony, można jednak zapoznać się z jego możliwościami poprzez program AI Dungeon, gdzie używany jest do generowania niekończącej się tekstowej przygody z udziałem użytkownika, na wzór gier wyobraźni typu Dungeons & Dragons.
Geometryczny wzrost tempa rozwoju tej technologii powoduje, że wiele jej aspektów pozostaje dalej niejasnych – nie ma jednoznacznej odpowiedzi na pytanie, czy GPT-3 zdaje test Turinga, jakie mogą być skutki jej rozpowszechnienia, ani jak ją kontrolować. Wiele osób zastanawia się nad ograniczeniami takich modeli – czy są one w stanie pisać literaturę piękną, zaskakiwać, zmuszać do refleksji? W mojej osobistej opinii po krótkim zaznajomieniu się z możliwościami GPT-3 oraz GPT-2 odpowiedź na wszystkie te trzy pytania brzmi tak. Zwłaszcza poezja (nierymowana) zdaje się być ich zaskakująco mocną stroną ze względu na mnogość interpretacji nawet pozornie pozbawionego sensu komunikatu. Jest tu ogromny potencjał na dalsze badania w sferach etyki, literaturoznawstwa, przekładoznawstwa, psychologii i wielu innych. Być może dzięki takim modelom, które w trakcie swojego językowego "treningu" mają kontakt z większą ilością tekstu niż jakikolwiek człowiek, będziemy w stanie odpowiedzieć na niektóre z bardzo podstawowych pytań o istotę kreatywności czy estetyki. W jaki sposób mogą one przyspieszyć językową ewolucję?
Po pierwsze, są do niej doskonałym motywatorem. Z jednej strony nieumiejętność rozróżnienia tekstu pisanego przez człowieka od generowanego komputerowo niesie, jak udowadniają działania botów, ogromne zagrożenie dla pokoju, a więc i ludzkości jako gatunku. Jeśli człowiek nie chce stracić swojej pozycji na świecie, musi sprawić, żeby maszyny na nowo zaczęły przegrywać "grę w udawanie". Z drugiej strony, takie modele dają lingwistom ogrom nowych możliwości – praktycznie nieograniczone ilości tekstu do badania, nowy rodzaj dynamicznie zmieniającego się korpusu, wgląd w mechanizmy przetwarzania tekstu. A, przynajmniej z pozoru, wspomniane modele języka naturalnego mają z ludzkim mózgiem wiele wspólnego:
- Uczą się języka na podstawie "wrodzonych" podstaw a następnie kontaktu z językiem w dużych ilościach.
- Działają dzięki małym elektronicznym jednostkom przesyłającym sygnały elektryczne (w obu przypadkach nazywane są one neuronami).
- Szczegóły procesów zachodzących między wprowadzeniem nowej informacji a generowaniem języka pozostają (w przypadku języka) i stają się coraz bardziej (w przypadku sieci neuronowej) niejasne.
Twórcy GPT-3 przyznają, że jedną ze słabości systemu jest to, że ciężko interpretować jego decyzje w kwestii dobierania kolejnych słów. Model zapoznaje się z gigantycznymi ilościami tekstu, a o jego działaniu decydują setki miliardów parametrów – ciężko więc opisać, co dokładnie dzieje się w środku. Pod tym względem sieci neuronowe zaczynają być podobną "enigmą" co ludzki umysł. Również to przewidział 70 lat temu Alan Turing: An important feature of a learning machine is that its teacher will often be very largely ignorant of quite what is going on inside. Ludzki mózg jednak był tajemnicą od momentu, gdy zaczęliśmy go badać – ewolucja maszyny jest natomiast bardzo dobrze udokumentowana, od stosunkowo prostego "Manchester Mark I" po momentami aż przerażający GPT-3.
Te podobieństwa, wraz z ilością i specyfiką materiału naukowego dostarczanego przez modele przetwarzania języka naturalnego, każą wierzyć, że dzięki nim uda się lepiej poznać człowieka, jego mózg i język. Pojawia się ryzyko, że zamiast badać człowieka, będziemy badać program, a nawet drobna różnica w ich mechanizmach działania może prowadzić do znacznie różnych wyników. Być może takie podejście da nam jednak możliwość sformułowania przydatnych (nawet jeśli nieidealnych) teorii naukowych. O innym zagrożeniu płynącym z relacji człowiek-maszyna wspomina Lewis Mumford, pisząc, że "uczłowieczenie maszyny może mieć paradoksalny skutek w umaszynowieniu człowieka". Widzę tu kolejną motywację dla człowieka do językowej rewolucji – chęć udowodnienia naszej wyższości nad komputerem. Kompleks jaki mogą wzbudzić możliwości GPT-3 widać w słowach jednego z użytkowników Twittera: We aren't pulling the mask off the machine to reveal a genius wizard, we're pulling the mask off each other to reveal the bar is low.
Inny sposób na nagięcie językowych ram prezentuje pismo asemiczne – inspirowane pismem ręcznym zjawisko z pogranicza literatury i sztuki polegające na układaniu tekstów ze znaków, które przypominają litery, ale jednak literami nie są – to hobby popularne między innymi wśród twórców języków sztucznych i pasjonatów kaligrafii. Tworzone dzieła wyglądają jak wycinki systemów pisma, budzą u "czytelnika" skojarzenia, nie mają jednak żadnego z góry określonego znaczenia. Istniejące m.in. w piśmie chińskim piktogramy (np. znak przypominający drzewo – 木) i ideogramy (góra 上 i dół 下) każą wierzyć, że niektóre znaki da się rozumieć bez uprzedniej nauki, czy to, tak, jak w przypadku piktogramów, przez ich podobieństwo do tego, co Peirce nazywa przedmiotem (object), czy przez połączenie skojarzeń w przypadku ideogramów. Tego rodzaju znaki w triadycznym podziale Peirce'a zdają się być bardziej symbolami niż ikonami, a przez to bliższe temu, co mają reprezentować. Czy w takim razie mógłby zaistnieć system pisma oparty jedynie na zrozumiałych dla większości połączeniach między znakiem a przedmiotem, system, którego znaczenie byłoby mniej uzależnione od kręgu kulturowego odbiorcy a przez to mniej negocjowalne? Idealnie, byłby to system pisma rozumiany przez każdego, zdolny do przekazywania nawet abstrakcyjnych idei ludziom z kompletnie innego czasu i miejsca. Ideogramy i piktogramy stanowią jednak jedynie małą część chińskiego systemu, doskonalonego od wielu tysięcy lat. Ciężko też uwierzyć, aby twórca takiego systemu był zdolny oderwać się od swojego kręgu kulturowego. Tutaj widzę możliwość dla pisma asemicznego – być może taki system, tak jak wiele rzeczy, które wcześniej były nie do pomyślenia, da się wynaleźć "przez przypadek"? Może któregoś dnia powstanie asemiczne dzieło, które – mimo pozornego braku słów – będzie przekazywać tę samą ideę mieszkańcom każdego kontynentu, w każdym wieku. Na jego podstawie można by stworzyć następnie system pisma, a potem język idealny – taki, o którym wspominają również Russell i Wittgenstein.
Przyznaję, że wynalezienie idealnego języka "przypadkiem" jest mało prawdopodobne. Nie da się jednak ukryć, że pismo asemiczne narusza granice języka, takiego jak zazwyczaj go rozumiemy. Na internetowych forach poświęconych temu zjawisku, oprócz dzieł własnych pasjonaci dzielą się też "znaleziskami" – wzorami na korze brzozy, skrzydłach ćmy, czy specyficznie ułożonymi liśćmi. Niektóre z nich faktycznie wyglądają na zdania, wiersze czy słowa, z własnymi systemami interpunkcji i rytmem. Można z tego wysunąć bardzo optymistyczny wniosek – świat wysyła nam komunikaty i pisze zdania na każdym dostępnym materiale. Być może te zdania są faktycznie asemantyczne, a być może po prostu nie potrafimy ich jeszcze zrozumieć. Ta piękna idea "czytania" świata nie jest nowa – według niektórych tradycji, Bóg komunikował się z Adamem za pomocą błyskawic i grzmotu, a pierwotna Tora napisana została czarnymi płomieniami na białym ogniu. Niektórzy językoznawcy postulują idee, że język pozwala nam poszerzyć nasze horyzonty – że to dzięki niemu osoba, która widziała w życiu tylko jednego słonia jest w stanie mówić o stadach słoni. O czym moglibyśmy więc mówić, gdyby naszym alfabetem był cały świat? Czy w dalekiej przyszłości ludzkość będzie mogła komunikować gniew za pomocą piorunów, smutek za pomocą deszczu, miłość za pomocą gwiazd? To idea o wiele bardziej odległa niż sieci neuronowe czy Neuralink – ale wyjątkowo inspirująca.
Znalezisko pisma asemicznego: brudnica mniszka (Lymantria monacha). Zdjęcie: Kurt Kulac, CC BY-SA 3.0, Wikimedia Commons
To inspiracje, którymi kieruję się przy rozmyślaniach o przyszłości języka. Prawdopodobnie zmiany nie dotkną wszystkich – tak jak fizyka nadal nie pogodziła mechaniki klasycznej i kwantowej, a w czasach masowej produkcji nadal jest miejsce na rękodzieło. Celem języka jest komunikacja, podobnie jak celem chodzenia przemieszczanie się. Wyobraźmy sobie dwójkę dzieci, które nauczyły się chodzić; jedno z nich zacznie uczyć się biegać, a drugie tańczyć. Możliwość podobnej dychotomii widzę w przyszłości języka – z jednej strony język-bieg, szybki i dokładny, bardziej podobny do języka maszyn, umożliwiający przetwarzanie ogromnych ilości danych, z drugiej ten "ludzki" – język-taniec, głęboki, odróżniający człowieka od robota. Przewidzenie dokładnych różnic między nimi zostawia ogromne pole na dalsze badania. Moją tezą jest, że różnice te będą ogromne, głębsze niż między poszczególnymi językami naturalnymi, oraz że najpierw zaobserwujemy je w społecznościach internetowych – już teraz widać ogromne różnice między użyciem języka na Twitterze, ograniczającym posty do 280 znaków i w dużej mierze opanowanym przez boty, a na forach dyskusyjnych kładących nacisk na długie, oryginalne posty. Na pierwszy rzut oka to najpopularniejsze portale zdają się w dużej mierze kształtować społeczeństwo. W wielu przypadkach okazuje się jednak, że rozpowszechniane na największych portalach społecznościowych idee mają swój początek na kilku stosunkowo małych i skrytych forach. Tak było chociażby ze słowem "julka", czy bardzo popularną grafiką smutnej zielonej żaby. Ten trend prawdopodobnie zyska na sile – mała liczba kreatywnych, głębokich społeczności będzie tworzyć treści, które następnie napędzane i delikatnie edytowane przez boty trafiać będą do głównego nurtu. Powiązane jest to bezpośrednio z ludzką zdolnością do kreatywnego używania symboli, cechą, na której opierałby się wspomniany język-taniec, a odrzucał język-bieg. Sama dychotomia może być bardzo efektywnym napędem ewolucji języka, a mieszanie się tych dwóch sposobów komunikacji może pozwolić nam na znalezienie wymarzonego idealnego sposobu porozumiewania się – tak, jak teoria łącząca założenia mechaniki klasycznej, opartej na pewnikach i kwantowej, opartej na prawdopodobieństwach pozwoli sformułować "teorię wszystkiego".
Podobną rolę jak cytat o granicach języka – zaproszenie do rozważań wychodzących poza poprzednie schematy myślenia – odegrał dla mnie ostatnio termin transhumanizm, czyli wiara w to, że homo sapiens nie jest ostatecznym stadium rozwoju człowieka, a następne etapy ewolucji będziemy mogli, w dużo bardziej kontrolowany sposób, osiągać dzięki technologii. Jednym z elementów tej ewolucji jest dla mnie właśnie obalenie granic języka. Tak jak, według transhumanistów, rozwój człowieka jako gatunku stanie się dzięki technologii jasno ukierunkowany i przestanie polegać na losowych mutacjach i doborze naturalnym, tak być może język również wejdzie w etap ewolucji bardziej kontrolowanej, a nie opartej na niejasnych neologizmach, rozmywaniu znaczeniowo pojęć i upowszechnianiu się konkretnych metafor. Nie chodzi mi tu o skrajną odmianę preskryptywizmu czy instytucje kontrolujące język w rodzaju Akademii Francuskiej, ale raczej skok ewolucyjny – odnalezienie systemu, który pozwoli nam komunikować się bez nieporozumień, mówić o tym, co poza światem, przekazywać między umysłami dane z prędkością, którą możemy zaobserwować dziś w komputerach. Nauka zna dziś sposoby na przekazywanie terabajtów danych w ciągu sekundy. Być może osiągnięcie takich efektów wymaga pozbycia się spowalniającego wpływu języka naturalnego w ogóle. Chomsky twierdzi, że język jest cechą wyróżniającą gatunek ludzki spośród zwierząt. Jednocześnie Elon Musk, któremu już udało się zmienić nasz świat na wielu płaszczyznach, obiecuje uczynić język zbędnym w przeciągu kilkunastu lat. Ciężko nie zauważyć, że wraz z postępem technologicznym zbliżamy się coraz bardziej do granic języka. Być może obalenie ich pozwoliłoby nam stać się czymś więcej – i zbudować nowy, wspanialszy świat.
Napisane w lutym 2021 roku. Opublikowane w oryginalnej formie.