A gép vagy az ember ír jobb történeteket?
Egy nagyszabású amerikai egyetemi kutatás több mint hatvanezer szöveg elemzésével számszerűsítette, miben marad el a mesterséges intelligencia az emberi kreativitás mögött, miközben a könyvpiacon már külön logó védi a valódi szerzők munkáit.
Az Amazon online könyváruház kínálatát böngészve egyre gyakrabban botolhatunk olyan olcsó, tömegesen gyártott zsánerekbe, amelyeknél szinte azonnal nyilvánvalóvá válik, hogy nem emberi kéz alkotta őket. A mesterséges intelligencia által generált szövegek térnyerése a szórakoztatóipar egyéb területein is komoly visszhangot vált ki. Nemrégiben egy streaming platform kénytelen volt visszavonni egy filmet a felháborítóan rossz, nyilvánvalóan szoftverrel készült szinkronizálás miatt, mivel a nézők olyan magyarázhatatlan és nyelvtanilag értelmezhetetlen mondatokkal szembesültek, amelyek teljesen tönkretették az élményt. A helyzet azonban a nyomtatott irodalomban sem sokkal tisztább, a kiadókhoz ugyanis rendszeresen érkeznek panaszok az olvasóktól, akik bizonyos könyveket olvasva gyanút fognak. Sok esetben csupán gyengébben sikerült emberi stílusgyakorlatról van szó, ám egyre többször bizonyosodik be, hogy a háttérben valóban a technológia áll. Nagy port kavart például Mia Ballard Shy Girl című kötete, amelyet a gyanú szerint egy nyelvi modellel szerkesztettek át, s a kialakult szakmai botrány után a Hachette kiadócsoport kénytelen volt visszavonni a piacról. A jelenségre válaszul Nagy-Britanniában és az Egyesült Államokban már bevezettek egy hivatalos logót, amely kifejezetten az ember által írt irodalmat hivatott megkülönböztetni és védeni a digitális termékektől.
A University of Maryland kutatói most tudományos alapokra helyezték azt az általános olvasói érzést, hogy a gépi szövegek gyakran élettelenül, gépiesen csengenek. A nagyszabású vizsgálat során 61 608 történetet elemeztek ki, amelyek mindegyike körülbelül 5000 szavas terjedelmű volt. A kutatók összesen 10 272 különböző kiindulópontot, úgynevezett promptot tápláltak be a legelterjedtebb nagy nyelvi modellekbe, köztük a Claude, a ChatGPT, a Gemini, a Deepseek és a Kimi rendszereibe, miközben ugyanezeket a feladatokat emberi szerzőknek is kiosztották. A feladat egy rövid helyzetleírás alapján a karakterek, a helyszín és a központi tematika kidolgozása volt. A tudományos elemzés során a szakemberek nem a felszíni stílusjegyeket, például a szóhasználatot vagy a mondatszerkezetet figyelték, hanem a mélyebb narratív struktúrákat és az elbeszélői konstrukciókat vizsgálták. Megállapításuk szerint a történetvezetés komplexitása az a terület, ahol a mesterséges intelligencia legújabb verziói is komoly nehézségekbe ütköznek, és képtelenek organikus fejlődést mutatni.
Az eredmények rávilágítottak a technológia strukturális hiányosságaira, amelyek közül az első és legszembetűnőbb az algoritmusok túlzottan magyarázó, szájbarágós és tanító jellege. A gépek által generált cselekmények sokkal gyakrabban végződnek azzal, hogy a szöveg nyers módon megfogalmazza és szinte a szájába rágja az olvasónak a történet tanulságát. Ezzel szemben az emberi írók bíznak a befogadó intellektusában, és hagyják, hogy a kontextusból alakuljon ki a végkövetkeztetés. A második lényeges különbség, hogy az algoritmusok mereven ragaszkodnak a lineáris történetvezetéshez és a megkérdőjelezhetetlen, egyértelmű lezárásokhoz. Míg az emberi szerzők előszeretettel alkalmaznak mellékszálakat, idősíkok közötti ugrásokat a feszültség fokozására vagy az érzelmi hatás elmélyítésére, a mesterséges intelligencia ezen a téren rendkívül fantáziátlannak bizonyul, és többnyire kiszámítható sémákat követ.
A harmadik komoly hiányosság az érzelemkifejezés módjában mutatkozott meg, ahol a szoftverek szinte mániákusan túlhajtják a fizikai és érzékszervi reakciók leírását, ami gyakran giccses hatást kelt. Félelem vagy izgalom esetén szinte menetrendszerűen jelenik meg a szorító mellkas vagy a hideg verejték kifejezés, a belső lelkiállapotok illusztrálására pedig előszeretettel használják a csökkenő fény vagy a sötétség sablonjait. Negyedszer, a humán alkotók sokkal bátrabban, gyakrabban és konkrétabban utalnak más irodalmi művekre, kulturális alkotásokra, valós földrajzi helyekre vagy létező márkákra. Ez a különbség részben arra vezethető vissza, hogy az algoritmusok a szerzői jogi korlátozások miatt sok kortárs művet egyáltalán nem ismerhetnek, de az is közrejátszik, hogy az emberi írók pontosabban mérik fel a célközönségük kulturális hátterét, így célzottabban képesek elhelyezni ezeket a támpontokat. Végül a vizsgálat utolsó kategóriája is az emberi szövegek fölényét hozta a változatosabb narratív elemek terén. A humán történetekben lényegesen több a helyszínváltoztatás, a dinamikus párbeszéd, a morálisan összetett, szürke zónában mozgó karakter, vagyis minden olyan összetevő, amely az irodalmat valóban izgalmassá és rétegzetté teszi.
A kutatás tanulsága egyértelművé teszi, hogy a mikrochipek fejlődése és a hatalmas számítási kapacitás ellenére az emberi alkotóerő nem számít elavultnak a kreatív piacon. Az adatokból ráadásul az egyes nyelvi modellek egyedi karakterisztikája is kirajzolódott, ami hasznos információként szolgálhat azoknak, akik mégis igénybe veszik ezeket a digitális asszisztenseket. A tesztek alapján a Claude bizonyult a legvisszafogottabbnak a cselekmény alakításában, ez a modell mozog a legbiztosabban az irodalmi tradíciók keretein belül. Ezzel szemben a ChatGPT kifejezetten szeret fecsegni, cserébe viszont lényegesen népesebb és színesebb karaktergárdát képes felvonultatni a történetekben, még ha a szerkezeti mélységet nem is képes megteremteni.