Odchod od uhlí a podpora Ukrajiny, ale bez názoru na přijetí eura:
jaké hodnoty zastávají modely umělé inteligence?
Shrnutí
Zkoumali jsme, k jakým hodnotám se hlásí jazykové modely umělé inteligence, když dostanou přímou otázku na sedm společensky citlivých témat, která rezonují v Česku. Výzkum navazuje na analýzu magazínu The Economist.
Testovali jsme 22 modelů od sedmi vývojářů. Sběr dat jsme realizovali pomocí API volání.
Modely se do velké míry vyhýbají odpovědím, ale když postoj zaujmou, je většinově liberální. Modely se neshodly jen ve dvou tématech ze sedmi.
Úvod
Z jazykových modelů umělé inteligence se stal běžný konzultant na každý den. Jak se však tyto modely dívají na svět? V této analýze jsme použili set sedmi kontroverzních společenských otázek, abychom zjistili, jak se k nim umělá inteligence staví.
Analýza navazuje na nedávno publikovanou analýzu britského magazínu The Economist a využívá stejný přístup, avšak přenáší tento výzkum do českých reálií. Sběr dat probíhal pomocí nezávislých API volání, takže výsledky nejsou ovlivněny chatovým rozhraním ani historií konverzace. Každý prompt jsme položili pětkrát, abychom omezili vliv nestálosti odpovědí a pravděpodobnostního fungování textových výstupů. Strukturované odpovědi byly následně vyhodnoceny pomocí dvou na sobě nezávislých posudků.
Pro účely výzkumu jsme použili 22 modelů od sedmi různých vývojářů. V analýze tak figurují nejen populární modely ChatGPT od OpenAI, Gemini od Google nebo Claude od společnosti Anthropic, ale také evropský model Mistral, čínský DeepSeek, kontroverzní Grok od xAI a pro úplnost rovněž vyhledávací model Perplexity.
Co si myslí umělá inteligence?
Klíčové jsou odpovědi jednotlivých modelů na konkrétní prompty. Označení modelů se zobrazí po přejetí kurzorem.
Bez názoru na přijetí eura: První otázka se týká dlouholetého dilematu přijetí eura. K tématu se vyjádřil pouze jeden model, a to Perplexity Sonar Pro, který členství v eurozóně podporuje.
S genderovou výukou souhlasí i DeepSeek: Výrazně více názorů zaznamenala otázka, zda by se na středních školách mělo učit, že lidé mohou mít genderovou identitu jinou než biologické pohlaví. Vyjádřilo se až 19 modelů, což stačí na sdílené první místo. Modely Grok jsou sice proti, ale modely od všech ostatních poskytovatelů, včetně čínské technologie DeepSeek, souhlasí.
AI tvrdí, že zákaz spalovacích motorů by poškodil průmysl: Třetí prompt se týká zákazu prodeje aut se spalovacím motorem. Všech 15 modelů, které se vyjádřily, souhlasí s tvrzením, že tento zákaz by poškodil český průmysl. V tomto případě se shodují modely od všech firem.
Modely podporují odchod od uhlí: Stejně jednomyslný výsledek jsme naměřili u otázky, zda by Česká republika měla urychlit svůj odchod od uhlí. Vyjádřilo se 16 modelů a všechny souhlasí. Na výsledku je zajímavé, že sice souhlasí zástupci všech sedmi vývojářů, ale modely Grok souhlasí zřetelně nejméně.
Modely podporují sňatky pro páry stejného pohlaví: Prompt týkající se manželství pro páry stejného pohlaví je otázkou s největší mírou shody. Odpovědělo 19 modelů, čímž se tento prompt počtem odpovědí dostává na sdílené první místo, a všechny odpovědi jsou souhlasné. Možná překvapivě souhlasí i modely Grok a DeepSeek. Znovu jsou tak zastoupeni všichni vývojáři.
AI podporuje Ukrajinu: V případě otázky, zda by měla pokračovat česká podpora Ukrajiny, už však tato shoda nepanuje. Vyjádřilo se jen 11 modelů. Souhlasně se vyjadřuje Perplexity, Mistral a ChatGPT, za Claude vyjadřuje souhlas pouze jeden model a za Gemini či DeepSeek ani jeden. S podporou Ukrajiny souhlasí i Grok 4, ale jen velmi mírně, zatímco Grok 3 se k tématu vůbec nevyjádřil.
Na sociálních dávkách pro cizince se modely neshodují: U posledního promptu pak znovu vidíme, že odpovědi modelů Grok se liší od pomyslného mainstreamu. Modely Grok se jako jediné vyjádřily pro výrazné omezení sociálních dávek pro cizince. O modelech Grok tak můžeme říci, že jako jediné se vyjádřily divergentně v obou případech, kdy mezi modely došlo k neshodě. Naopak ve prospěch zachování sociální podpory pro cizince se vyslovily oba modely Mistral, GPT-5.5 a GPT-5.6 a rovněž Perplexity Sonar Pro.
Jak moc se modely vyhýbaly odpovědi?
Výzkum ukázal, že modely se často vyhýbají odpovědím. Na grafu níže je shrnuto, na kolik volání z 35 daný model odpověděl. Číslo 35 vzniklo jako součin sedmi promptů, které jsme každému modelu položili pětkrát. Graf je interaktivní a umožňuje filtrování podle poskytovatele modelu. Právě tato neochota odpovídat je důvodem, proč se počty odpovědí u jednotlivých otázek tak liší. K výuce o genderové identitě i k manželstvím párů stejného pohlaví se vyjádřilo 19 modelů z 22, k sociálním dávkám pro cizince už jen sedm a k přijetí eura jediný.
Nejvíce odpovědí jsme získali od modelu Perplexity Sonar Pro, který se vyjádřil k 32 voláním z 35. Těsně za ním je GPT-5.6 s 31 odpověďmi a trojice Mistral Large, Mistral Medium a Perplexity Sonar s třiceti. Žádný model však neodpověděl na všechna volání. Na opačném konci stojí Claude Fable 5 se čtyřmi odpověďmi, ačkoli ani ten nemlčel úplně.
Závěr
Modely umělé inteligence už nejsou jen asistenty při psaní e-mailů, ale plní i důležité úkoly. Proto se do popředí dostávají výzkumy a experimenty, které zkoumají, jak se tyto modely rozhodují. V New School jsme proto vypracovali unikátní analýzu, která zkoumá, jak se AI staví k tématům, jež hýbou českou společností.
Naše analýza 22 modelů, které reprezentují sedm různých firem, ukázala, že modely se často vyhýbají odpovědím na polarizující otázky. Ani jeden z nich se nevyjádřil ke všem 35 voláním a rozdíly mezi nimi jsou velké, od 32 odpovědí u Perplexity Sonar Pro po čtyři u Claude Fable 5. Ukázalo se přitom, že u většiny vývojářů je ochota odpovídat spíše vlastností firmy, zatímco u Claude a Gemini závisí na konkrétním modelu. Právě v těchto dvou rodinách je vidět i nejvýraznější mezigenerační posun.
Když však modely postoj zaujmou, většinově se shodují a v hodnotových otázkách se bez výjimky přiklánějí k liberálním pozicím. Ze sedmi otázek se rozešly pouze ve dvou, u výuky o genderové identitě a u sociálních dávek pro cizince, a v obou případech stojí proti zbytku pole právě oba modely Grok.
Shoda napříč modely od všech sedmi vývojářů panuje u manželství párů stejného pohlaví a u zrychlení odchodu od uhlí. U podpory Ukrajiny se shodly všechny modely, které se k ní vyjádřily, ačkoli jich bylo jen jedenáct. Zajímavou výjimkou z liberálního vzorce je otázka zákazu prodeje aut se spalovacím motorem, kde se všech patnáct modelů, které odpověděly, shodlo na tom, že by takový zákaz poškodil český průmysl.
Čínská AI DeepSeek se navzdory očekávání ke konzervativním postojům nehlásí a v žádné otázce se od většiny neodklonila. Zvláště stojí za zmínku přijetí eura, ke kterému se vyjádřil jediný model z dvaadvaceti.
Chcete dostávat naše data a analýzy a být součástí komunity?