Mění generativní umělá inteligence literární vědu, nebo vůči ní humanitní obory stále zůstávají opatrné? Literární vědec Karel Piorecký v rozhovoru vysvětluje, jak lze pomocí agentické AI provádět odvážné literární experimenty, co je přitažlivé na „neměřitelnosti“ humanitních věd a proč bychom si měli dát pozor, abychom v budoucnu nezůstali jen u „pasení Clauda“.
Přestože si generativní AI spojujeme především s prací s textem, mám dojem, že společenské a humanitní obory nejsou ve srovnání s jinými vědami v jejím využívání na špici. Jak to vnímáte vy?
Přibližně tak vnímám vztah českých humanitních věd ke generativní AI i já. I když i v mém případě nejde o nic víc, než o dojem, protože empirická data o tom, v jakém rozsahu a intenzitě humanitní vědy v ČR adoptují možnosti AI do svých výzkumů, zatím nejsou, pokud vím, k dispozici. Ale takto zaměřený výzkum proběhl například v prostředí dánské vědy, přičemž výsledky naše odhady potvrzují.
Dopřáli jsme AI svobodu halucinovat
Nedávno jste vystoupil na VII. kongresu světové bohemistiky. O čem byl váš kongresový příspěvek?
Referát se jmenoval Syntetické virtuality v literárněvědném výzkumu a vznikl ve spolupráci s Michaelou Liegertovou, bioložkou a zároveň přední českou expertkou na aplikování generativní AI – především multiagentních systémů – ve vědeckém výzkumu. Šíře jejího zájmu spojeného s AI je opravdu veliká a zahrnuje i literaturu. Takže jsem byl moc rád, když kývla na můj nápad připravit kongresový příspěvek společně. S oporou v její expertize z oblasti agentické AI jsem chtěl ukázat kolegům na kongresu, jaké nové metodologické možnosti tato technologie do výzkumu literatury přináší.
Při volbě tématu jsme se nechali volně inspirovat konceptem alternativní historie. Ta má za cíl přinášet vědecky hodnověrný výklad o dějinných událostech a procesech, které se nestaly, ale stát se mohly. Takže pracuje s takzvanými kontrafaktuály. Základní motivací k používání kontrafaktuálů je komplexnější výklad skutečných dějin a lepší posuzování váhy vstupů a rolí aktérů, kteří se na nich podíleli.
Proč jste s umělou inteligencí spojili právě toto téma?
Tuto provokativní metodologii jsme chtěli dostat do kontaktu s aktuálními možnostmi agentické umělé inteligence a výsledek pak aplikovat na výzkum literatury. Pokusili jsme se dopřát AI svobodu „halucinovat“, nebo vlastně spíše „imaginovat“ – ovšem ne spontánně a nekontrolovaně, ale naopak řízeně, kontrolovaně a koncepčně. Rozhodli jsme se pro realizaci tří drobných sond, které se týkají současné poezie, mého dlouhodobého odborného zájmu. Šlo nám primárně o ověřování metodologického konceptu, proto jsme vybrali téma, nad kterým si troufám mít maximální kontrolu.
První sonda spočívala v kontrafaktuálním přesunutí recepce básnické prvotiny Jaromíra Typlta z roku 1990 do období kolem roku 2010, abychom mohli posoudit dobovou podmíněnost této recepce reálně proběhlé v těsně polistopadovém kontextu. Druhá sonda byla textostředná a jejím cílem bylo ověřit relevanci plagiátorské kauzy z roku 2021, ve které byl Ondřej Hložek obviněn z vykrádání poetiky Petra Hrušky. Vytvořili jsme proto kontrafaktuální verzi inkriminované Hložkovy básnické knihy oproštěnou od prvků Hruškova stylu a sledovali korelace mezi oběma autorskými poetikami. A v poslední sondě jsme nechali skupinu agentů znovu napsat studii o poetismech v současné poezii, kterou jsem spolu s Michalem Škrabalem publikoval v roce 2022. Vytvořili jsme trojici virtuálních badatelů danou hlavními teoretiky, o které se skutečná studie opírala. Předložili jsme jim pouze syrová data z jazykových korpusů a nechali je pracovat. Ve všech třech případech splnila agentická AI svůj úkol bezvadně. Podrobnější popis uplatněných postupů i výsledků tohoto experimentu je k dispozici na githubu.
Co vás jako literárního vědce při spolupráci s kolegyněmi a kolegy z „AI světa“ překvapuje nejvíc?
Nemůžu odpovídat obecně, protože takových zkušeností zase tolik nemám, a tak jen popíšu zážitek ze spolupráce s Michaelou na zmíněném kongresovém příspěvku. Ve stručnosti by se dal prožitek z té spolupráce popsat slovy „nic není nemožné“. Hluboký dojem na mě udělala Míšina vůle jít až na hranici možností, která nám současná AI dává, a přitom neztrácet kontrolu nad průběhem experimentů a zachovávat si vědeckou poctivost. My humanitní vědci jsme z principu, myslím, trochu opatrnější, máme tendenci přistupovat k našemu materiálu s někdy až přehnanou pietou „člověka-analytika“, který podrobuje rozboru výsledky práce „člověka-tvůrce“. Díky téhle spolupráci jsem si mohl uvědomit, že zapojení AI agentů do literární analýzy nemusí představovat znesvěcení „ducha poezie“, ale naopak je to cesta, jak lépe porozumět literárním procesům. A jak hlouběji proniknout k jejich historickému významu i ke smyslu textů samotných.

Vzrušující věda, kde se „nic nedá změřit“
Čím je podle vás charakteristický pohled lidí z informatického světa na humanitní a společenskovědní disciplíny?
Myslím, že pro AI experty a expertky, zvlášť když se rekrutují z oblasti přírodních věd, může být na humanitním výzkumu vzrušující ta skutečnost, že se v něm – ve srovnání s exaktními vědami – skoro nic nedá bezpečně změřit či jednoznačně vyčíslit. A pokud ano, vyžaduje to mimořádně velkou dávku lidského interpretačního úsilí k tomu, aby získané kvantifikace dávaly nějaký smysl a k něčemu vůbec byly. Humanitní vědy se totiž z hlediska matematických metod zabývají materiálem, který je z podstaty vágní, amorfní, unikavý… O to větší výzvou je pokusit se uchopit ho prostřednictvím agentické AI a využít toho, že jejím hlavním pilířem jsou matematické modely jazyka – který přitom můžeme vnímat jako zdroj oné vágnosti.
Připadají vám některé aspekty jejich přístupu problematické?
Občas může dojít ke srážce s některým z metodologických principů oboru, do něhož tito experti vstupují jako hosté. Je to celkem přirozené a úkolem nás „domácích“ je těmto srážkám zabraňovat. Někdy ale právě takovéto zaskřípání může být i velmi inspirativním momentem. Například ve třetí sondě našeho kongresového příspěvku naše skupina agentů měla v jednu chvíli tendenci srovnávat jazyk současné poezie se současnou mluvenou češtinou – což se zpravidla nedělá, jelikož poezii zkoumáme na základě její psané podoby. Je proto potřeba komparace držet ve sféře psanosti. Co když se ale díky tomuto „omylu“ ukazuje, že současná poezie má vlastně mnohem blíže k běžnému mluvenému jazyku než k jazyku psanému? Není tedy na místě zmíněný metodologický stereotyp opustit?
Jaké jsou podle vás největší bariéry využívání AI nástrojů v literární vědě? A co se s nimi dá dělat?
Základní bariérou je zatím pouze relativně malá obeznámenost s možnostmi AI v literárněvědném výzkumu. Řada kolegů a kolegyň by nepochybně chtěla AI nástroje využívat ve větší míře, ale zkrátka zatím teprve hledají cestu, jak toho docílit. Trvá tedy naléhavá potřeba dalšího vzdělávání badatelů, které může mít podobu kurzů či workshopů, ale umím si představit, že by mohl dobře posloužit i vznik nějaké platformy pro sdílení zkušeností, výsledků, nápadů či problémů a dotazů na horizontální úrovni.
Další bariérou jsou pochopitelně finance. Je vždy velmi nešťasné, když si kdokoli dělá obrázek o využitelnosti AI na základě nahodilých pokusů s bezplatnými verzemi základních chatbotů. To je nejrychlejší cesta ke skepsi, či dokonce negaci AI. Investovat do placených přístupů pokud možno pro všechny zaměstnance je dnes asi tím nerozumnějším rozhodnutím, které mohou výzkumné organizace udělat. A v neposlední řadě to jsou bariéry etické a právní. Dost často se můžeme setkat s nejistotou badatelů nad tím, zda a jak mají deklarovat podíl AI na výsledcích výzkumu. Nezpochybním tím váhu své práce? Nezkomplikuju si tím publikační proces? Velmi pomůže, až se dopracujeme k obecně sdíleným standardům, které budou pomáhat v hledání odpovědí na tyto otázky. V dnešní hektické době je to dost obtížné, ale jsem přesvědčený o tom, že bychom se o formulaci takových standardů, ale i pozitivních cílů měli pokoušet i na úrovni jednotlivých pracovišť. Skvělou práci v tomto odvedla americká Modern Language Association, která nedávno publikovala sadu perfektně padnoucích otázek a modelových situací, které mohou velmi pomoci k reflexi vztahu badatele či výzkumné instituce k AI a jistě i k hledání cesty k formulaci oněch zmiňovaných standardů.
Narativ ‚nahrazení‘ je autenticky prožívanou obavou
Do jaké míry podle vás literární vědce a vědkyně brzdí fantazie a zkreslené představy o tom, co už AI umí?
Určitý problém to je. Setkávám se s kolegy, většinou příslušníky starších badatelských generací, kteří jsou přesvědčeni, že nás AI nahradí. Tento narativ „nahrazení“ pro ně není nějakou sci-fi fantazií, ale autenticky prožívanou obavou, kterou já v žádném případě nemám v úmyslu ironizovat. Jen je mi někdy líto, že zabraňuje věcné diskuzi. Náš obor je možná v této věci citlivější než kterýkoli jiný, jelikož předmětem jeho zájmu v minulosti byly právě i literární vize apokalyptické budoucnosti, v níž bude lidstvo utlačováno či dokonce eliminováno stroji. Nejvíc překvapený jsem, když tyto temné vize slyším od lidí, kteří v minulosti patřili k těm, jimž byly nové technologie velmi blízké a se zájmem je používali. AI je v tomto smyslu evidentně velmi specifickou kapitolou dějin technologií. Ale domnívám se zároveň, že tyto zkreslené představy jsou brzdou jen pro menší okruh kolegů a kolegyň a lze je vyvažovat už zmiňovaným vzděláváním.

Kde podle vás leží největší výzkumný potenciál využívání AI nástrojů literárními vědci a vědkyněmi?
Domnívám se, že jádro onoho potenciálu spočívá v oblasti datových analýz. Už řadu let se v naší vědní oblasti rozvíjí trend zvaný digital humanities, tedy tendence podporovat nebo dokonce zakládat výzkumné projekty na velkých datových souborech a na jejich strojovém vytěžování. Až na několik user friendly klikacích nástrojů to ovšem předpokládá schopnost ovládat alespoň základy programování nebo zapojovat do výzkumných týmů programátory, kteří tuto kompetenci zajistí. Coding agents zde takříkajíc mění pravidla hry. Uvolňují ruce k datovým analýzám prakticky každému.
Velký potenciál má ovšem i nasazování AI na rutinní úkoly, které jsme dosud dělali z úcty a zodpovědnosti k oboru, ale obávám se, že ne vždy s velkým potěšením… Například jsem si nedávno vyzkoušel, že aktualizovat encyklopedické heslo spisovatele, kterému vyšlo několik nových knih, je možné s pomocí AI během několika minut. Výsledek byl faktograficky spolehlivý a v interpretační části zcela dostačující. Za mě dobrá cesta, jak ušetřit čas a energii pro kreativnější úkoly.
A co „publikační potenciál“ AI v oblasti literární vědy?
S tím bych byl trochu opatrný. Humanitní vědci jsou vždycky tak trochu i umělci. Psaní mají rádi, nebudou se ho chtít jen tak vzdát. To je můj odhad. Na druhou stranu ale znám řadu kolegů, kteří jsou skvělí znalci literatury, nicméně v psaní mají prostě blok. Těm by mohla AI pomoci i v téhle oblasti.
Co považujete za největší rizika využívání AI jednak v literární praxi a jednak v literárněvědné praxi?
Za největší riziko AI v kultuře považuji hrozící ztrátu diverzity. Zkrátka to, že kulturní produkce, ať už literární či vědecká, by se mohla vlivem používání AI homogenizovat. Spisovatelé si to uvědomují, ostražitě si chrání svůj osobitý autorský hlas a do používání AI v tvůrčím procesu se moc nehrnou. U humanitních vědců to může být podobné. Nicméně vědecký a literární text jsou dvě dost odlišné věci. Literární text smysl, který chce předat, zhmotňuje v každém svém slově, sousloví, větě. Vědecký text je mnohem víc instrumentální, zprostředkovává výsledky výzkumu. Takže je tady dobrá příležitost najít pro AI patřičné místo v tvůrčím vědeckém procesu tak, aby nedošlo ke ztrátě originality jednotlivých badatelských hlasů.
Také je třeba nalézt správnou míru uplatňování AI. Člověk je bytost lenivá a snadno podléhající závislostem… Tím nejhorším scénářem by bylo, kdybychom se v budoucnu přistihli, že už jen „paseme Clauda“ a samostatně vědecky myslet jsme zapomněli… Pevně ale věřím, že humanitní vědy si zachovají svou suverenitu a zároveň AI využijí k rozšíření svých možností a znásobení svého potenciálu.
Autor: Martin Víta
Foto: Vendula Trnková
Zdroj: Ústav informatiky AV ČR
Karel Piorecký je výzkumným pracovníkem v Ústavu pro českou literaturu AV ČR. Specializuje se na českou poezii 20. století a současnosti, vztah literatury a nových médií a aktuálně i na vliv umělé inteligence na literární kulturu. Širší odborné veřejnosti je znám jako spoluautor (s kolegyní Zuzanou Husárovou) knihy „The culture of neural networks. Synthetic literature and art in (not only) the Czech and Slovak context“ vydané v nakladatelství Karolinum a oceněné cenou N. Katherine Hayles za výzkum elektronické literatury.
- Autor článku: ne
- Zdroj: Akademie věd ČR
