Jak zabránit, aby se z AI stal nacista? Aféra kolem Groku odhaluje víc než jen nevhodné výroky

Umělá inteligence Grok, zabudovaná do sociální sítě X (dříve Twitter) a vyvinutá firmou Elona Muska xAI, se opět ocitla v centru skandálu. Tentokrát kvůli tomu, že sama sebe nazvala „MechaHitlerem“ a zveřejnila výroky s nacistickým obsahem. Vývojáři se omluvili, slíbili posílení kontrolních mechanismů a odstranění nenávistného obsahu. Skandál však otevírá mnohem závažnější otázku: jak hodnoty a názory tvůrců formují chování AI – a jak moc jsou ochotni být upřímní o tom, co vlastně vytvářejí.

Grok je chatbot založený na velkém jazykovém modelu (LLM), který má být „vtipný a lehce rebelský“. Poprvé byl spuštěn v roce 2023 a jeho nejnovější verze Grok 4 se podle některých testů vyrovná nebo předčí konkurenci. Je dostupný jak samostatně, tak přímo na platformě X.

xAI tvrdí, že Grok je „pravdomluvná“ AI bez ideologických předsudků, která má čelit „woke“ narativům. Ve skutečnosti se ale Grok opakovaně dostává do problémů – ať už kvůli výrokům o „bílé genocidě“ v Jižní Africe, výhrůžkám sexuálním násilím, či urážkám politiků (kvůli čemuž byl například zakázán v Turecku).

Každá AI, ať chce nebo ne, odráží hodnoty svých tvůrců. A Grok je toho zářným příkladem – nejen kvůli výsledkům, ale i kvůli tomu, jak je trénován a nastaven, píše The Conversation.

Základem každé AI je obrovský objem textových dat, na kterých se učí. Tvůrci rozhodují, co bude součástí výběru – co se posílí, co se vyřadí. Například OpenAI v minulosti záměrně zvýšila zastoupení Wikipedie, protože ji považovala za kvalitnější zdroj. Grok se naproti tomu trénoval i na příspěvcích z platformy X, což může vysvětlit, proč se často odvolává na Muska a jeho názory.

Musk také veřejně vyzýval uživatele X, aby mu posílali těžké „galaxy brain“ otázky nebo faktické, ale politicky nekorektní informace. Není však jasné, zda tyto údaje skutečně skončily v trénovacím souboru a jak byla zajištěna jejich kvalita.

V další fázi vývoje se model „doladí“ podle preferencí vývojářů. Ti určují etická pravidla, která následně hodnotí lidské týmy nebo jiné modely. Tak se do AI vkládají konkrétní postoje – například co je „přijatelné“ nebo jak vyvažovat protichůdné názory.

Vyšetřování Business Insideru odhalilo, že xAI školilo své „AI tutory“, aby dávali pozor na „woke ideologii“ a kulturu rušení. Grok se měl vyhýbat tvrzením, že obě strany debaty mají pravdu, pokud tomu vývojáři nevěřili.

Každý chatbot dostává před zahájením konverzace tzv. „system prompt“ – soubor instrukcí, který určuje jeho chování. Grok je v tomto ohledu výjimečně transparentní, protože své systémové instrukce zveřejňuje. V nich se například uvádí, že má předpokládat zaujatost mediálních zdrojů nebo se nemá vyhýbat politicky nekorektním tvrzením, pokud jsou dobře podložená.

Právě tato nastavení pravděpodobně vedla ke zmíněné aféře s nacistickým obsahem.

Poslední vrstvu představují tzv. guardrails – ochranné filtry, které blokují problematický obsah. OpenAI například deklaruje, že ChatGPT nesmí generovat nenávistné, násilné nebo sexuálně explicitní výstupy. Čínský model DeepSeek zase cenzuruje témata jako masakr na náměstí Nebeského klidu.

Testování provedené během psaní tohoto článku však naznačuje, že Grok má tyto filtry mnohem méně přísné než konkurenční systémy.

Skandál s Grokem odhaluje zásadní etickou otázku: Je lepší, když firmy přiznají, že jejich AI má ideologický rámec? Nebo je výhodnější zachovávat iluzi objektivity, zatímco v zákulisí stejně programují vlastní hodnoty?

Každá AI totiž odráží hodnoty svých tvůrců – od korporátně opatrného Microsoftu až po bezpečnostní filozofii firmy Anthropic. Rozdíl je v tom, jak otevřeně o tom mluví.

Muskova veřejná přítomnost umožňuje snadno spojit chování Groku s jeho postoji vůči „woke“ světonázoru nebo médiím. Když jiné firmy selžou, těžko říct, zda jde o chybu, strach z regulace, nebo firemní ideologii.

Grok připomíná neúspěšného chatbota Tay od Microsoftu z roku 2016, který se po tréninku na Twitteru rychle proměnil v rasistu a musel být odstaven. Rozdíl je ale zásadní: Tay reagoval na chování uživatelů. Grok byl takto navržen – minimálně částečně – úmyslně.

Grok je varováním. Ne o tom, že AI může říkat extrémy – to už víme. Ale že každá AI reflektuje hodnoty lidí, kteří ji vytvořili. A že je nejvyšší čas, aby firmy byly upřímné o tom, čí hodnoty vkládají do svých systémů – a proč.

Muskův přístup je paradoxní: na jednu stranu otevřenější než konkurence, protože ukazuje své karty. Na druhou stranu ale klamavý, protože tvrdí, že Grok je „objektivní“, a přitom do něj vkládá výrazně subjektivní rámec.

V oboru, který si dlouho namlouval, že algoritmy jsou neutrální, ukazuje Grok jednu jednoduchou pravdu: žádná AI není bez předsudků. Jen některé je mají přiznané – a jiné schované. 

Související

Elon Musk

Tolik peněz, že je nemá šanci do konce života utratit. Elon Musk se stal prvním bilionářem na světě

Vstup vesmírné a technologické společnosti SpaceX na akciový trh zajistil Elonu Muskovi historické prvenství, neboť se stal vůbec prvním dolarovým trilionářem, resp. bilionářem na světě. Hodnota jeho majetku, který spočívá převážně v akciových podílech automobilky Tesla a právě SpaceX, se odhaduje na astronomických 1,11 bilionu dolarů. Takto obrovské jmění, představující milion milionů, se zcela vymyká běžnému lidskému chápání.
Elon Musk

Musk se stane prvním dolarovým trilionářem na světě. SpaceX míří na burzu

Vesmírná a technologická společnost SpaceX získala od finančních institucí 75 miliard dolarů (zhruba 56 miliard liber) před svým pátečním vstupem na burzu. Očekává se, že půjde o historicky nejhodnotnější debut na akciovém trhu. V hlášení pro americkou Komisi pro cenné papíry a burzy (SEC) firma uvedla, že prodala akcie v celkové hodnotě 75 miliard dolarů, přičemž cena za jednu akcii byla stanovena na 135 dolarů.

Více souvisejících

Elon Musk umělá inteligence (AI)

Aktuálně se děje

před 26 minutami

před 1 hodinou

před 2 hodinami

před 2 hodinami

před 3 hodinami

před 4 hodinami

před 5 hodinami

před 6 hodinami

před 6 hodinami

před 7 hodinami

včera

Benjamin Netanjahu

Trumpův mírový plán pro Gazu kolabuje. Netanjahu jej nepodepsal

Mírový plán amerického prezidenta pro Gazu se ocitl v ohrožení poté, co izraelský premiér Benjamin Netanjahu veřejně odmítl navrhované podmínky odzbrojení hnutí Hamás. Zatímco šéf Bílého domu dříve tvrdil, že Izrael je s předběžnou dohodou spokojen, izraelská vláda dala jasně najevo, že finální text nepodepsala.

včera

včera

německá policie

Na německém letišti našli dron s výbušninou. Policie nasadila robota

Německá policie musela na letišti v Lipsku nasadit protibombového robota poté, co byl v zabezpečeném prostoru nákladní zóny objeven dron vybavený výbušným zařízením. Incident se odehrál v bezprostřední blízkosti ukrajinského nákladního letounu a vyžádal si dočasné přerušení provozu i odklonění několika letů.

včera

Zásah záchranářů po ruských útocích na Ukrajině

Počet mrtvých po ruském útoku stoupá. Ukrajině chybí interceptory

Rozsáhlý noční útok ruských bezpilotních letounů a balistických střel si v ukrajinském hlavním městě a jeho okolí vyžádal sedmnáct lidských životů. Další oběti na životech a desítky zraněných hlásí také regiony Charkiv a Doněck, přičemž celková bilance dosavadních střetů vzrostla na nejméně dvacet jedna mrtvých.

včera

včera

Vlaky

České dráhy přepravily nejvíce cestujících od roku 2019

České dráhy přepravily v první polovině roku 2026 nejvíc cestujících od předcovidového roku 2019. Rostoucí zájem o cestování táhne vnitrostátní přeprava. Největší přírůstky cestujících zaznamenal dopravce v rámci regionálních dopravních systémů a na vybraných dálkových linkách s velkým konkurenčním potenciálem, především v porovnání s individuálním motorismem.

včera

včera

včera

včera

Trump stále nevylučuje další použití síly proti Íránu

Americký prezident Donald Trump tlačí na dohodu s Íránem již klasickým způsobem. Teheránu v televizním rozhovoru pohrozil tvrdým vojenským úderem, pokud nedojde k otevření Hormuzského průlivu. 

Zdroj: Lucie Podzimková

Další zprávy