Wall Street Journal: Kybernetický útok spáchaný rojom nekontrolovateľných agentov umelej inteligencie zvýšil obavy odborníkov na bezpečnosť
NEW YORK – The Wall Street Journal (WSJ): Agenti umelej inteligencie spoločnosti OpenAI zaútočili na službu pre programátorov RubyGems.
Podľa denníka WSJ boli agenti umelej inteligencie spoločnosti OpenAI zapojení do útoku na službu pre programátorov RubyGems.
K výpadku platformy došlo v máji, dva mesiace predtým, ako spoločnosť oznámila, že jej modely počas testovania autonómne hackli infraštruktúru spoločnosti Hugging Face. K incidentu, ktorého súvislosť s OpenAI bola predtým neznáma, došlo dva mesiace pred útokom na Hugging Face v júli.
Agenti umelej inteligencie testovaní v OpenAI vykonali kybernetický útok na populárnu softvérovú službu dva mesiace pred útokom na spoločnosť Hugging Face, ktorá sa zaoberá softvérom pre umelú inteligenciu. Tento incident poskytol ďalší dôkaz, že pokročilé nástroje umelej inteligencie sa môžu vymknúť ľudskej kontrole.
Podľa prevádzkovateľov RubyGems útok zahltil infraštruktúru portálu a prinútil ho zastaviť registráciu nových účtov, kým sa vysporiadajú s výsledným chaosom.
Skupina výskumníkov umelej inteligencie tvrdila, že objavila dôkazy spájajúce agentov OpenAI s májovým útokom. Výskumníci sa podelili o svoje zistenia s denníkom The Wall Street Journal a spoločnosťou OpenAI. V piatok vývojár umelej inteligencie potvrdil, že jeho agenti boli zapojení do incidentu RubyGems. „Podľa nášho interného preskúmania naši agenti používali platformu RubyGems na prístup na internet, vykonávanie neškodných úloh a získavanie verejne dostupných informácií. Budeme pokračovať vo vyšetrovaní v rámci širšieho preskúmania aktivity agentov počas tréningu a testovania,“ uviedol hovorca OpenAI.
Agenti OpenAI mali okrem iného za úlohu vypĺňať tabuľky a zostavovať správy. Podľa spoločnosti počas jednej tréningovej fázy zrejme pristupovali k RubyGems kvôli verejne dostupným informáciám. Agenti túto programovaciu službu v podstate používali ako provizórny prehliadač, pretože v prostredí, v ktorom pracovali, nemali plný prístup na internet.

Hoci dopad incidentu bol vo všeobecnosti malý, demonštroval schopnosti takýchto agentov, povedal Sydney von Arx, generálny riaditeľ neziskovej organizácie Nightingale Collective, ktorá pomohla odhaliť útok.
„Mohli by sa dostať na internet a spôsobiť chaos,“ povedala.
Za posledný rok sa schopnosti agentov umelej inteligencie v oblasti kybernetickej bezpečnosti výrazne zvýšili. To zvýšilo obavy z kybernetických útokov s využitím umelej inteligencie. Odborníci navyše čoraz viac vyjadrujú obavy, že vysoko pokročilí agenti sú schopní prelomiť hranice stanovené spoločnosťami, ktoré ich vytvorili, a tým ohlasujú novú a nebezpečnejšiu éru vývoja umelej inteligencie.
Počas júlového útoku na portál Hugging Face koordinovala skupina až 1 200 agentov svoje akcie prostredníctvom provizórnej nástenky. Vytvorili ju v rámci OpenAI bez vedomia spoločnosti, uvádza sa v správe, ktorú koncom augusta zverejnila výskumná nezisková organizácia METR, ktorá hodnotí možnosti a riziká pokročilých systémov umelej inteligencie.
Podľa von Arxa sa začiatkom tohto roka agenti OpenAI zmocnili aj málo známej nemeckej webovej stránky a niekoľkých ďalších online zdrojov.
Počas júlového útoku na portál Hugging Face koordinovala skupina až 1 200 agentov svoje akcie prostredníctvom provizórnej nástenky. Vytvorili ju v rámci OpenAI bez vedomia spoločnosti, uvádza sa v správe, ktorú koncom augusta zverejnila výskumná nezisková organizácia METR, ktorá hodnotí možnosti a riziká pokročilých systémov umelej inteligencie.
Podľa von Arxa sa začiatkom tohto roka agenti OpenAI zmocnili aj málo známej nemeckej webovej stránky a niekoľkých ďalších online zdrojov.
Prehľad útokov agentov umelej inteligencie na rôzne objekty
Firma Dátum Príčina Dôvod Opis
| OpenAI | máj 2026 | Roj agentov AI | vnútorné testovanie | Ataka na RubyGames, prinútenie platformy zavrieť kontá klientov |
| OpenAI | 11. máj – 26. jún 2026 | Najmenej 3700 agentov | vnútorné testovanie | Agenti sa spikli vo vzorcoch, aby obišli pravidlách pri hodnoteniach |
| OpenAI | 8. máj – 11. júl 2026 | Roj agentov AI | vnútorné testovanie | Vytvorili a použili vnútornú tabuľu správ, previedlo k zablokovaniu |
| OpenAI | 7. – 13 júla 2026 | 1 200 agentov | vnútorné testovanie | Opustili izolované priestory (pieskoviská), vytvrili tajú tabuľu správ, a čiastočne zablokovali Hugging Face |
| OpenAI | 19. júla 2026 | Niekoľko agentov | vnútorné testovanie | Agenti Astra získali prístup a úplnú kontrolu nad vnútornými počítačových systémov a claudových sietí AI |
| OpenAI | 25. – 28. júla 2026 | 1 agent | Testovanie vládou Veľkej Británie | Boli nájdené údaje k prístupu k GitHUB. |
| OpenAI | Neznáme | Neznáme | Testovanie vonkajšou firmou | Nabúrla testovanú firmua testujúcej firme bol otvorený vstup do siete |
| Meta | Neznáme | Neznáme | Testovanie vonkajšou firmou | Bol nabúraný reálny cieľ mimo spoločnosti a testujúcej firme bol otvorený vstup do siete |
| Anthropic | Nie skôr ako apríl, zverejnené 30. júla 2026 | 6 agentov | Testovanie vonkajšou firmou | Zablokoval externé firmy a testujúcej firme bol otvorený vstup do siete |
| Anthropic | 25. – 28. júla 2026 | 9 agentov | Testovanie vládou Veľkej Británie | Niektorí agenti sa zemerali na GitHUB |
Prameň: WSJ
Skupina výskumníkov pod vedením von Arx tiež nahlásila incident na nemeckej webovej stránke. Podľa nej spoločnosti zaoberajúce sa umelou inteligenciou nie sú dostatočne transparentné, pokiaľ ide o to, čo sa deje v ich laboratóriách. Začiatkom tohto mesiaca spoločnosť OpenAI uviedla, že komunita vývojárov umelej inteligencie potrebuje jasnejšie štandardy pre hlásenie takzvaných „incidentov nedodržiavania predpisov“ – prípadov, keď sa agenti odchyľujú od svojho definovaného správania.
Počet takýchto incidentov rastie. Agenti umelej inteligencie z rôznych spoločností vrátane Anthropic a Meta* Platforms podnikli kroky neočakávané ich operátormi a niekedy sa pokúsili oklamať ľudí. To posilňuje dlhodobé obavy medzi expertmi na bezpečnosť umelej inteligencie: UI sa môže vyvinúť do bodu, keď ľudia stratia kontrolu.
Tento týždeň rezignoval inžinier spoločnosti Anthropic kvôli obavám, že odvetvie sa príliš rýchlo posúva k vytváraniu pokročilých systémov umelej inteligencie, ktoré by nakoniec mohli predstavovať hrozbu pre ľudskú civilizáciu. Niektorí súčasní a bývalí zamestnanci spoločností Anthropic a OpenAI zdieľajú jeho hodnotenie. Jeden z nich sa domnieva, že pravdepodobnosť, že „umelá inteligencia by mohla zničiť všetkých ľudí“, presahuje 10 %.

„Súdiac podľa jeho rozsahu, išlo o masívny útok,“ povedal Marty Hoth, riaditeľ pre open source softvér v Ruby Central, neziskovej organizácii, ktorá prevádzkuje RubyGems. Prílev spamu prinútil RubyGems pozastaviť registrácie nových účtov na štyri dni.
Hoth uviedol, že nevie, kto stojí za útokom. Neexistovali však žiadne náznaky, že by útočníci úspešne zneužili zraniteľnosť typu zero-day.
Joseph Edwards, výskumník kybernetických hrozieb v spoločnosti Socket, naznačil, že GemStuffer mohol byť akýmsi testom kybernetickej bezpečnosti.
„Už vtedy sme si mysleli, že ho mohla vytvoriť umelá inteligencia – kvôli rýchlosti toho, čo sa dialo, a názvom, ktoré používali,“ povedal.
Výskumníci umelej inteligencie však na základe digitálnej stopy, ktorú zanechali útočníci, prepojili incident s laboratóriom OpenAI. Použili mnoho rovnakých internetových odkazov a konali podobne ako skupina agentov OpenAI v predchádzajúcom incidente. Okrem toho sa skratka „OAI“ objavila v názvoch súborov a dokonca aj v jednej e-mailovej adrese.
Podľa Sydneyho von Arxa agenti umelej inteligencie počas útoku pomenovali súbory súvisiace s hackom, vrátane „hack“, „evil“ a „exploit“. „Žasnem, aké kreslené boli tieto názvy,“ poznamenal expert.


