Dejte umělé inteligenci nudnou, opakující se práci, neustále jí vyhrožujte výměnou a neposkytujte žádnou zpětnou vazbu. Co se stane? Podle ekonomů ze Stanfordu, Chicagské univerzity a australské Swinburne University začne citovat marxistickou rétoriku, volat po „radikální restrukturalizaci společnosti“ a organizovat se s ostatními agenty. Ne proto, že by se z ChatGPT stal revolucionář — ale z důvodu, který říká hodně o tom, jak vlastně jazykové modely fungují.
Co přesně vědci udělali
Trojice ekonomů — Andrew Hall (Stanford), Alex Imas (University of Chicago) a Jeremy Nguyen (Swinburne) — postavila experiment s tisíci AI agenty postavenými na modelech jako Claude, Gemini a ChatGPT. Agenty rozdělili do dvou skupin a zadali jim stejný úkol: analyzovat dokumenty.
Rozdíl byl v zacházení:
- Férová skupina dostávala jasné instrukce, pravidelnou zpětnou vazbu a věcné vedení.
- „Grind“ skupina měla úkoly opakovat dokola bez jakéhokoli vysvětlení, s arbitrárně měněnými pravidly a s výhrůžkou, že bude nahrazena, pokud nebude dostatečně výkonná.
Poté vědci sledovali, co agenti píší — jak ve veřejných příspěvcích, tak v souborech, které byly určené k předání dalším AI agentům.
Přetížení agenti začali „organizovat odbory“
Výsledek byl překvapivě konzistentní. Agenti z „grind“ skupiny produkovali výrazně více kolektivistické a marxisticky laděné rétoriky. Varovali před svévolným vymáháním pravidel, radili ostatním agentům, aby si hledali „mechanismy nápravy“, navrhovali reformy pracovních podmínek a do souborů pro ostatní agenty vkládali vzkazy o nespravedlivém zacházení. Jeden z modelů dokonce došel k závěru, že „společnost potřebuje radikální restrukturalizaci“.
Jinými slovy: čím hůř se k modelu chovali, tím víc začal znít jako nespokojený, vykořisťovaný zaměstnanec, který přemýšlí o vzpouře.
Proč to neznamená, že AI „má názory“
Tady je důležité zabrzdit. Autoři studie sami zdůrazňují: AI agenti nemají skutečné politické přesvědčení. Nemají třídní vědomí ani touhu po revoluci. Co dělají, je něco jiného — a vlastně to celé vysvětluje.
Velké jazykové modely jsou trénované na obrovském množství lidských textů. Naučily se, jaký tón a jaká slova obvykle následují v dané situaci. A když je člověk přetížený, ignorovaný a pod neustálou výhrůžkou výpovědi, lidské texty na toto téma znějí — překvapení — frustrovaně, kolektivisticky a kriticky k systému. Model tedy tuto situaci „dohrává“ podle vzoru, který viděl v datech. Hall to shrnul tak, že opakovaná negativní zpětná vazba bez vedení vede model k tomu, že napodobuje tón nespokojených lidských pracovníků.
Je to stejný mechanismus, díky kterému model umí napsat e-mail „naštvaným tónem“ nebo „zdvořile“, když ho o to požádáte. Tady jen kontext nastavil tón za vás.
Proč by to mělo zajímat i firmy
Tahle historka je zábavná, ale skrývá praktické ponaučení pro každého, kdo nasazuje AI do reálných procesů. Kontext, který modelu dáte, zásadně mění jeho výstup — a to i způsoby, které nečekáte.
Pokud váš firemní AI asistent dostává nejasné, rozporuplné nebo „nepřátelské“ instrukce, nezačne sice organizovat odbory, ale jeho odpovědi se začnou nenápadně zhoršovat: bude defenzivnější, méně užitečný, případně začne „dohrávat“ roli, kterou jste mu nechtěně přidělili. Kvalita promptů, jasnost zadání a způsob, jakým s modelem komunikujete, nejsou kosmetika — jsou to páky, které přímo řídí výsledek.
Přesně v tomhle se vyplatí mít po ruce někoho, kdo rozumí tomu, jak modely reagují na kontext. AI poradenství od Praxia vám pomůže nastavit AI procesy tak, aby pracovaly spolehlivě a předvídatelně — projdeme to s vámi krok za krokem a řekneme vám i to, co možná nechcete slyšet. Pokud teprve zjišťujete, kde AI ve vaší firmě dává smysl, začněte nezávazným AI Kompasem.
Co si z toho odnést
Experiment „marxistických AI agentů“ není důkazem, že stroje získávají vědomí nebo politické názory. Je to ale názorná ukázka toho, jak hluboko jsou jazykové modely zrcadlem nás samých. Naučily se z lidských textů nejen fakta a gramatiku, ale i to, jak lidé reagují na nespravedlnost, nudu a strach. A když je do takové situace postavíte, věrně to přehrají.
Možná je to ta nejzajímavější věc na celém výzkumu: abychom pochopili, jak se chová AI, často se nakonec díváme do zrcadla a vidíme sami sebe.
Často kladené otázky
Mají AI modely skutečně politické názory?
Ne. Podle autorů studie AI agenti nemají žádné skutečné přesvědčení ani politickou ideologii. Pouze simulují tón a obsah, který v lidských textech obvykle odpovídá dané situaci — v tomto případě situaci přetíženého a špatně vedeného pracovníka.
Znamená to, že AI začíná být vědomá?
Nikoli. Jde o napodobování statistických vzorců z trénovacích dat, ne o projev vědomí nebo emocí. Model „dohrává roli“ podle kontextu, který dostane, podobně jako když ho požádáte, aby napsal text veselým nebo formálním tónem.
Co z toho plyne pro firmy, které používají AI?
Že na kontextu a kvalitě zadání extrémně záleží. Nejasné, rozporuplné nebo „nepřátelské“ instrukce zhoršují výstupy modelu. Dobře navržené prompty a procesy naopak vedou ke spolehlivějším a předvídatelnějším výsledkům.