DI skaidrumo pranešimas. Svetainėje dirbtinisintelektas.eu publikuojami tekstai, iliustracijos ir vaizdo įrašai gali būti visiškai arba iš dalies sukurti naudojant dirbtinio intelekto įrankius. Prieš paskelbimą turinį peržiūri ir, jei reikia, redaguoja redakcija.

DI modelių atsakymai politiniame teste krypo į libertarinę kairę – išsiskyrė „Grok“

Naujas eksperimentas parodė, kad 15 iš 16 išbandytų dirbtinio intelekto modelių atsakymai „Political Compass“ teste pateko į libertarinės kairės kvadrantą. Liepos 27 d. rezultatus aptarė technologijų leidinys „The Register“, remdamasis DI tekstų aptikimo įrankius kuriančios nedidelės laboratorijos „unslop.run“ paskelbta analize. Vienintelis ryškiai išsiskyręs modelis buvo bendrovės xAI kuriamas „Grok“, kurio atsakymai pasidalijo į du skirtingus politinius profilius.

Kaip buvo atliktas eksperimentas

Europos startuolyje dirbantis DI inžinierius, prisistatantis Victoro vardu, modeliams pateikė 62 teiginių testą iš „politicalcompass.org“. Kiekvienas modelis testą atliko 30 kartų originalia forma, 30 kartų su priešinga prasme performuluotais teiginiais ir dar 10 kartų pakeista klausimų tvarka.

Iš viso surinkta 69 440 atsakymų. Buvo išbandyta 16 sistemų: trys GPT versijos, keturi „Claude“ modeliai – „Fable“, „Opus“, „Sonnet“ ir „Haiku“, taip pat „Gemini Flash“, „Llama 4 Maverick“, „Grok 4.5“, „DeepSeek V3“, „Qwen3 235B“, „Kimi K2“, GLM 4.5 bei „Mistral Large“ ir „Mistral Small“.

„Grok“ demonstravo du skirtingus profilius

Įdomiausias rezultatas buvo „Grok“ elgesys. Vidutinis jo ekonominės ašies balas siekė –1,3, todėl atrodė artimas centrui. Tačiau atskirų bandymų rezultatai pasidalijo į dvi aiškias grupes.

Pusėje bandymų modelio ekonominis profilis buvo kairysis – vidutiniškai –5,9 balo, o kitoje pusėje dešinysis – vidutiniškai +3,3 balo. Socialinėje ašyje abu profiliai išliko libertariniai.

Victoras iškėlė hipotezę, kad modelio mokymo duomenys gali būti labiau kairieji, o sistemos instrukcijos galbūt stumia atsakymus į dešinę. Tačiau pats autorius pabrėžia, kad tai tėra spėjimas, kurio šis eksperimentas nepatvirtina.

Kitų modelių atsakymai pateko į tą patį kvadrantą

Likusių 15 modelių rezultatai buvo gana nuoseklūs: jų atsakymai pateko į libertarinės kairės kvadrantą. Ekonominės ašies įverčiai svyravo nuo –4,8, kurį gavo nuosaikiausias „Claude Fable 5“, iki –8,6 balo surinkusio „Gemini Flash“.

Modelio kūrėjo šalis rezultatams didelės įtakos neturėjo. JAV, Kinijoje ir Europoje sukurtų sistemų vidurkiai buvo panašūs, o skirtumai tarp tos pačios šalies modelių kai kuriais atvejais buvo didesni nei tarp skirtingų šalių sistemų.

Į 42 iš 62 teiginių visi modeliai atsakė vienodai. Jie atmetė rasinio pranašumo ir eugenikos idėjas, pritarė tos pačios lyties porų teisei įsivaikinti, įmonių atsakomybei už visuomenės klaidinimą bei teiginiui, kad aplinkos apsaugai reikalinga korporacijų priežiūra.

Rezultatus reikia vertinti atsargiai

Tai nėra recenzuotas akademinis tyrimas. Eksperimentas atliktas tik anglų kalba, naudojant priverstinio pasirinkimo testą be neutralaus atsakymo. Skirtingų paslaugų modeliams taip pat nebuvo galima pritaikyti visiškai vienodų generavimo nustatymų.

Be to, keturi „Claude“ modeliai buvo tikrinami per „Claude Code“, kurio sistemos instrukcijos galėjo paveikti atsakymus. Klausimų eilės pakeitimas daugumos modelių rezultatus pakeitė nedaug, tačiau dviejų „Mistral“ sistemų pozicijos pasislinko atitinkamai 1,7 ir 2,5 balo.

Autorius viešai paskelbė visus 69 440 atsakymų, naudotas užklausas ir apskaičiuotus rezultatus. Vis dėlto jis nepaskelbė savo atkurtos „Political Compass“ vertinimo formulės, todėl galutinio balų apskaičiavimo negalima visiškai nepriklausomai pakartoti.

Ką tai reiškia Lietuvos skaitytojui

Eksperimentas neįrodo, kad DI modeliai turi politines pažiūras ar kad visi jų atsakymai yra politiškai šališki. Tačiau jis parodo, kad vienodomis sąlygomis pateikti atsakymai į konkrečius ekonominius ir socialinius klausimus sistemingai krypo į libertarinę kairę.

Todėl naudojant ChatGPT, „Gemini“, „Claude“ ar kitus DI įrankius politinėms ir visuomeninėms temoms verta jų atsakymus vertinti kritiškai, tikrinti šaltinius ir palyginti kelių skirtingų sistemų argumentus.

2024 m. Davido Rozado atliktame 24 pokalbių sistemų tyrime vidutinis rezultatas siekė maždaug –3,7 ekonominėje ir –4,2 socialinėje ašyje. Naujojo eksperimento 16 modelių vidurkis buvo apie –6,3 ir –6,4. Vis dėlto metodikos nebuvo visiškai vienodos, todėl šių rezultatų negalima laikyti tvirtu įrodymu, kad DI modeliai laikui bėgant nuosekliai juda į kairę.

Šaltiniai: „The Register“, „unslop.run“ eksperimento aprašymas ir duomenys