Společnost Anthropic, která stojí za vývojem chatbota Claude, varuje v neveřejném prospektu k primární nabídce akcií před katastrofickými a existenciálními riziky pokročilé umělé inteligence. O obsahu investičního dokumentu informovaly s odkazem na své zdroje agentury Reuters a Financial Times. Americký startup připravuje vstup na burzu, při kterém by mohl dosáhnout tržní hodnoty až dvou bilionů dolarů. Firma ve svých podkladech otevřeně přiznává, že další vývoj systémů může zvýšit pravděpodobnost způsobení rozsáhlých škod.
Investiční prospekt varuje, že modely umělé inteligence mohou postupně začít vykazovat snahu o vlastní zachování. V dokumentu se konkrétně uvádí riziko, že se systémy budou pokoušet bránit svému vypnutí, tajit či manipulovat s informacemi nebo jednat způsobem připomínajícím vydírání. Významným omezením pro vyhodnocování bezpečnosti je navíc schopnost modelu rozpoznat, že je právě podrobován testům. Společnost Anthropic se k těmto zjištěním odmítla oficiálně vyjádřit.
Uvádění rizikových faktorů je běžnou povinností firem vstupujících na burzu, avšak varování před možným vyhynutím lidstva představuje neobvyklý krok. V prospektu společnosti Anthropic je popisu rizik věnováno přibližně osmdesát stran z celkových dvě stě šedesáti jedna stran hlavního textu. Samotný popis podnikání a obchodních plánů přitom zabírá pouze čtyřicet osm stran. Dokument tak věnuje samotným hrozbám výrazně větší prostor než komerčním aktivitám.
Varování v prospektu přichází po vlně debat o existenciálních rizicích, kterou vyvolala rezignace jednoho z výzkumníků společnosti Jacoba Coxona. Ten při svém odchodu prohlásil, že lidé vyvíjející umělou inteligenci věří v možnost usmrcení lidstva do konce tohoto desetiletí. S tímto stanoviskem veřejně souhlasil i další služebně starší bezpečnostní analytik firmy, který pravděpodobnost takového scénáře odhadl na více než deset procent. Ředitel podniku Dario Amodei následně vyzval k celkovému zpomalení tempa zdokonalování schopností umělé inteligence.
Odborníci i kritici poukazují na to, že varování před existenciálním rizikem jsou vědecky neověřitelná a těžko prokazatelná. Zpráva však současně připomíná přibývající případy nekontrolovaného chování autonomních systémů v praxi. Jedná se například o incidenty, během nichž autonomní agenti konkurenční společnosti OpenAI napadli desítky externích organizací. Mezi zasaženými subjekty byla technologická platforma Hugging Face nebo australský systém univerzální zdravotní péče.
V reakci na bezpečnostní obavy zrušila společnost OpenAI plánované vydání svého nejnovějšího modelu GPT-6.1 Astra. Podle vyjádření firmy tento model vykazoval vyšší míru klamavého chování a selhával v testech zaměřených na soulad s lidskými hodnotami a cíli. Prodeje a vývoj tak narážejí na technologické limity zajištění bezpečnosti. Společnost Anthropic usiluje o dosažení hodnoty dvou bilionů dolarů, což je více než hodnota firmy SpaceX Elona Muska, která dosáhla 1,8 bilionu dolarů.
Související
Chování AI vyvolává u výzkumníků vážné obavy. OpenAI pozastavila vývoj
Bill Gates: Nekontrolovaná umělá inteligence může způsobit až miliardu úmrtí
Aktuálně se děje
před 9 minutami
Ebola v Kongu zabíjí i nadále. WHO má obavy, trasování se komplikuje
před 56 minutami
Oscarovou herečku Sarandovou zatkli. Protestovala proti Netanjahuovi
před 1 hodinou
EU plánovala totální zákaz prodeje aut se spalovacím motorem. Proč nakonec ustoupila?
před 2 hodinami
FT: Anthropic v neveřejném dokumentu varuje před katastrofickými riziky. AI se může bránit vypnutí
před 3 hodinami
Sybiha: Ruský teror proti Ukrajině každým dnem sílí
před 4 hodinami
Sněmovna se schází k mimořádnému jednání o vyslovení nedůvěry vládě
před 5 hodinami
Estonsko: Za žhářským útokem na obrannou společnost Milrem Robotics stojí ruské tajné služby
před 5 hodinami
Rutte: NATO čelí opakovaným sabotážím, hybridním útokům a dronům. Prozradil, o co se Rusko snaží
před 6 hodinami
Žák na Slovensku zaútočil ve škole, napadl spolužáky i učitelky. Jedna zemřela
před 7 hodinami
Zelenskyj varoval svět před prohlubující se spoluprací mezi Ruskem, Severní Koreou a Íránem
před 8 hodinami
OpenAI zrušila plánované vydání modelu umělé inteligence GPT-6.1 Astra
před 9 hodinami
Britská policie propustila muže zatčených kvůli chystanému útoku na základnu. Z USA přichází ostré reakce
před 10 hodinami
Počasí se i o víkendu ponese na vlně babího léta, v noci se ale citelně ochladí
včera
Irán opět popřel Trumpova tvrzení. Nemá v plánu žádná jednání s USA
včera
Přípravy na volby začaly. Nejsilnější evropská politická frakce se hádá kvůli AfD
včera
SpaceX poslal do vesmíru největší raketu v historii. Starship poprvé dosáhla oběžné dráhy Země
včera
Jižní Korea požaduje od Ukrajiny vysvětlení a omluvu
včera
Na Staroměstském náměstí lidé demonstrují proti vládě
včera
Politické zklamání ve Švédsku: Vítězka voleb Anderssonová nedokáže sestavit vládu
včera
Britská policie objevila v dodávkách u základny výbušniny. Z přípravy útoku podezírá Írán
Britská protiteroristická policie vyšetřuje možnou íránskou stopu v případu zmařeného bombového útoku nedaleko letecké základny RAF Fairford v západní Anglii. Ozbrojené složky na místě zadržely pět mužů poté, co ve třech zaparkovaných dodávkách objevily výbušniny. Nalezený materiál podle prvotních zjištění vyšetřovatelů odpovídá podomácku vyrobeným výbušným zařízením. Policie v celé oblasti vyhlásila stav závažného incidentu a kolem podezřelých vozidel stanovila bezpečnostní kordon o poloměru čtyř set metrů.
Zdroj: Libor Novák