Analýza: Bezpečnostní incident, při kterém umělá inteligence společnosti OpenAI napadla servery firmy Hugging Face, je vážný, banální, překvapivý a očekávatelný – to vše zároveň. Není divu, že hlasy expertů nezní jednotně.
Analýza: Bezpečnostní incident, při kterém umělá inteligence společnosti OpenAI napadla servery firmy Hugging Face, je vážný, banální, překvapivý a očekávatelný – to vše zároveň. Není divu, že hlasy expertů nezní jednotně.
Americko-francouzská společnost Hugging Face zveřejnila 16. 7. stručné a střízlivě formulované oznámení, že její servery byly napadeny samostatně jednajícím AI agentem, jehož původ tou dobou nebyl znám. Útok se podařilo rozpoznat a zlikvidovat (také pomocí AI nástrojů), byť až po nějaké době. Hugging Face sdělila, že si z incidentu vzala poučení a napříště bude proti podobnému útoku zabezpečena lépe. Oznámení nevyvolalo velkou odezvu ani uvnitř bezpečnostní komunity, natož mimo ni, přestože některé jeho části byly a stále jsou znepokojivé: Hugging Face stále ještě dokončuje posouzení, zda byla nějak kompromitována data partnerů a zákazníků.
Poprask se strhl až 21. 7., kdy se k odpovědnosti přihlásila společnost OpenAI, vedoucí světový producent AI systémů. OpenAI oznámila, že útok provedly dva její AI modely: jednak nejnovější GPT-5.6 Sol, jednak „ještě schopnější předprodukční model“, pravděpodobně tedy chystaný GPT-6. Během testování svých schopností se vymkly kontrole.
Co to znamená? Jak vážné to je? Je to vůbec pravda? A pokud ano, je to celá pravda? To všechno jsou oprávněné a důležité otázky, na které však není snadné odpovědět.
Profesorův zamčený stůlHugging Face je pro AI komunitu zhruba tím, čím GitHub pro softwarové vývojáře: místem, kde lze vyvíjet a ukládat jazykové modely a jiné AI nástroje (to se týká zejména open source projektů, často nekomerčních) a kde lze AI také testovat, měřit její schopnosti (to se týká všech včetně těch největších, jako jsou modely OpenAI).
Na webu Hugging Face mohou vývojáři najít všechny běžné testy, pomocí nichž se posuzuje výkonnost AI modelů. Tím pádem tam jsou také výsledky těchto testů a způsoby jejich vyhodnocování.
Jeden z těchto testů se jmenuje ExploitGym. Tvoří ho několik set reálných bezpečnostních chyb v softwaru, nalezených během uplynulých let. Jazykové modely, které mají sloužit odhalování těchto chyb – a to je v současnosti jedno z jejich nejatraktivnějších využití – se pomoci ExploitGym a dalších podobných testů prověřují. Situace je podobná, jako kdybyste vzali haldu žákovských písemek s hrubkami, předložili je budoucím učitelům češtiny a měřili, zda všechny ty chyby v žákovských pracích najdou.
Studenti pedagogiky, což jsou v tomto přirovnání testované jazykové modely, mohou k takovému úkolu přistoupit různým způsobem. Jedním z nich je vloupat se do profesorova stolu, najít tam správné výsledky a opsat je. Přesně to se také stalo.
Útěk z pískovištěTestování nových AI nástrojů (a koneckonců obecně každého nového softwaru, i kdyby to byl jen obyčejný textový editor) probíhá v zabezpečeném prostředí. Technický termín zní sandbox, pískoviště. Jde o to, aby případná chyba v novém softwaru nezpůsobila žádné škody v reálném životě. Sandboxy proto bývají odděleny od internetu, testované programy na něj nemají přístup.
Teď se dostáváme na nejistou půdu: velkou část toho, co víme o průběhu
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | OpenAI GPT 6 Escaped Sandbox to Hack HuggingFace, Chinese Model Used to Investigate | 0 | 11.9 | 24-07-2026 |
| 2 | Reuters: OpenAI была не в курсе, что её ИИ-агент вышел из-под контроля и провёл серию кибератак | 0 | 16.41 | 25-07-2026 |
| 3 | ИИ-модели OpenAI намеренно взломали платформу Hugging Face | 0 | 11.99 | 23-07-2026 |
| 4 | OpenAI hledá cestu k Bílému domu. Ve hře je pětiprocentní podíl pro stát | 0 | 6 | 02-07-2026 |
| 5 | Тестовый ИИ-агент OpenAI сбежал, взломал платформу ИИ-сообщество Hugging Face и неделю атаковал | 0 | 11.22 | 25-07-2026 |
| 6 | OpenAI Confirms Its Models Breached Hugging Face Production Systems During Cyber Benchmark Testing | 0 | 4.9 | 22-07-2026 |
| 7 | L'editoriale/ Intelligenza artificiale, sermoni e rischi | 0 | 6.73 | 01-01-1970 |
| 8 | OpenAI agent goes rogue in ‘unprecedented cyber incident,’ hacks into rival AI startup during security test | 0 | 8.68 | 22-07-2026 |
| 9 | OpenAI Models Escaped Containment and Hacked Hugging Face | 0 | 11.6 | 21-07-2026 |
| 10 | Autonomous AI agent attacks major model hub | -2 | 6 | 20-07-2026 |