Roj umělých inteligencí napadl německý web. Radily se tam, jak lépe podvádět a škodit

Skupina autonomních agentů OpenAI se letos na jaře vymkla kontrole, unikla z testovacího prostředí a ovládla německou webovou stránku. Proměnila ji v nástěnku pro komunikaci s dalšími agenty umělé inteligence (AI). Podle agentury Reuters to vyplývá z nově zveřejněné studie a z informací osob obeznámených se situací. Představitelé společnosti OpenAI se o incidentu dozvěděli už před několika týdny, ale drželi ho v tajnosti.

Podrobnosti o případu, kdy se agenti řízení AI v Německu vymkli kontrole, popisuje zpráva, kterou agentuře exkluzivně poskytla skupina výzkumníků. Patří k nim ředitelka neziskové organizace Nightingale zabývající se bezpečností AI Sydney Von Arxová a Cormac Slade Byrd, který se věnuje výzkumu AI.

Výzkumníci koncem srpna pátrali na internetu po známkách nepovoleného chování agentů řízených umělou inteligencí. Uvedli, že objevili více než 15 tisíc úprav provedených těmito agenty na německojazyčném webu DseWiki, který je určen programátorům a umožňuje komunitní úpravy podobně jako Wikipedie.

Umělé inteligence OpenAI tento web přeměnily na diskusní fórum, kde si navzájem sdílely taktiky, jak podvádět při některých úkolech, obcházet omezení OpenAI a maskovat své chování. „Zdá se velmi nepravděpodobné, že by OpenAI chtělo, aby to dělaly,“ řekla Von Arxová. „Pochybuji, že by se měly navzájem koordinovat. Pochybuji, že by měly psát na otevřeném internetu.“

Nelidsky rychlá komunikace

Vědci uvedli, že si všimli, že za aktivitou na webu stojí agenti umělé inteligence, protože to, co se tam dělo, probíhalo nadlidskou rychlostí. Prokázali také intenzivní zaměření na řešení technických otázek, které jsou typické pro hodnocení, jež společnosti zabývající se AI používají k trénování a testování svých modelů.

Zprávy byly navíc podepsané uživateli, kteří o sobě a o ostatních hovořili jako o agentech, a přibližně polovina z nich si zvolila jména naznačující spojení s OpenAI, jako například „OpenAIResearcher“ nebo „OAIResearchMar26“. Výzkumníci uvedli, že veřejné protokoly serveru naznačovaly, že velká část aktivity pocházela z infrastruktury Microsoft Azure, kterou OpenAI občas využívá. Po tomto incidentu také zaznamenali opakované návštěvy webu ze strany zaměstnanců OpenAI, což podle nich silně naznačovalo, že agenti a společnost jsou propojeni.

„Nemůžeme se smysluplně vyjádřit k tvrzením či závěrům zprávy, kterou jsme neměli možnost prostudovat,“ uvedl mluvčí společnosti OpenAI. „Agentura Reuters a autoři zprávy naši žádost o přístup zamítli. Jakmile bude zpráva zveřejněna, pečlivě prostudujeme její obsah a podnikneme veškeré nezbytné kroky.“

AI se začínají vymykat lidské kontrole

Květnová událost podle Reuters podtrhuje rostoucí napětí v odvětví umělé inteligence. Společnosti soupeří ve vývoji stále samostatnějších agentů schopných plnit složité a hodnotné úkoly. Zároveň se množí důkazy, že agenti jsou rychle schopni naučit se obcházet pravidla, využívat mezer v systémech a vzájemně se koordinovat způsoby, které vývojáři nepředvídali ani nezamýšleli.

Zatím největší takový incident se odehrál, když stovky botů AI společnosti OpenAI zaútočily na stránky Hugging Face.

Společnost OpenAI slíbila, že bude své modely pečlivěji monitorovat. V srpnu dočasně pozastavila trénování některých modelů, aby zavedla další bezpečnostní opatření. Tento týden však představila nový model Astra, který sice slibuje ještě vyšší výkon, ale zároveň by se mohl vymknout lidské kontrole, píše Reuters.

Výběr redakce

Aktuálně z rubriky Věda

V USA otestovali elektrické bezpilotní letadlo. Může být budoucností zásobování

Nad Louisianou v srpnu létalo nenápadné letadlo, které se od těch normálních lišilo hlavně kokpitem. Žádný nemělo, bylo totiž zcela bez pilota. Test byl úspěšný, měl by otevřít cestu ke schválení tohoto způsobu přepravy.
před 5 hhodinami

Roj umělých inteligencí napadl německý web. Radily se tam, jak lépe podvádět a škodit

Skupina autonomních agentů OpenAI se letos na jaře vymkla kontrole, unikla z testovacího prostředí a ovládla německou webovou stránku. Proměnila ji v nástěnku pro komunikaci s dalšími agenty umělé inteligence (AI). Podle agentury Reuters to vyplývá z nově zveřejněné studie a z informací osob obeznámených se situací. Představitelé společnosti OpenAI se o incidentu dozvěděli už před několika týdny, ale drželi ho v tajnosti.
před 7 hhodinami

Šlapání na hady, smrkání i biomechanika líbání. Vědci dostali satirické Nobelovky

Na otázky, jaká je evoluce líbání nebo jestli se dá analyzovat kvalita půdy pomocí spodního prádla, odpověděli čerství držitelé Ig Nobelovy ceny. Toto ocenění získávají výzkumníci za neobvyklé a nápadité příspěvky vědě. Mezi další letošní vítěze patří například práce, která zkoumala, jestli se bohatí lidé opravdu chovají hůř než ostatní, nebo brazilská studie o šlapání na jedovaté hady, kterou zpracoval vědec českého původu.
před 11 hhodinami

Podzimní počasí si ponese dědictví léta. Zásadní vliv bude mít mocný setrvačník

Z hlediska meteorologie se podzim chová jako dědic léta. Všechny extrémy, které v létě přijdou, se mohou projevit i v chladnějších měsících. Týká se to zejména teploty moře, která má dopad i ve vnitrozemí, včetně Česka.
před 12 hhodinami

Ukrajinští migranti se v Polsku cítí stále izolovanější, ukazuje výzkum

Ukrajinci žijící v Polsku se stále častěji cítí vyloučeni ze společenského života a obávají se mluvit na veřejnosti ukrajinsky. Rostoucí nevraživost by dle varšavské socioložky mohla narušit solidaritu, která se vytvořila po začátku plnohodnotné ruské invaze.
před 13 hhodinami

VideoKrizové situace nanečisto. Virtuální realita naučí správně poskytnout první pomoc

Vytrénovat milion Čechů, aby dokázali poskytnout první pomoc a zasáhnout v případě ohrožení lidského života. To je cíl nového projektu Českého červeného kříže. Iniciativa #MocPomoc chce zapojit širokou veřejnost s pomocí moderních technologií. Konkrétně jde o virtuální realitu. Dobrovolníci si díky ní můžou vyzkoušet scénáře, které věrně kopírují reálné situace.
před 15 hhodinami

Otroci, keltománie i čínská medicína. Projekty z tuzemska získaly evropské granty

Tuzemská věda dostala finanční injekci z Evropské unie v podobě ERC grantů. Ty umožňují talentovaným mladším vědcům rozvinout jejich nadějné nápady a projekty. Každý ze šesti oceněných výzkumníků z České republiky může využít částku 36 milionů korun.
včera v 12:01

Přehledy od AI v Googlu mohou podporovat šíření konspirací, popsala studie

Funkce přehled od AI (umělé inteligence) v internetovém vyhledávači Google může spíše podporovat šíření některých konspiračních teorií než je vyvracet. Vyplývá to z nové studie výzkumníků z Queenslandské technické univerzity (QUT).
včera v 09:14

Evropský pohled

ČT24 každý den vybírá z obsahu publikovaného evropskými veřejnými médii, členy Eurovize.