Anthropic дослідила, як групи ШІ-агентів поводяться під час взаємодії, і результати виявилися неоднозначними. В одному з експериментів трьом агентам Claude дали доступ до одного програмного проєкту, але поставили несумісні завдання. Не знаючи про існування один одного, агенти почали сприймати дії колег як перешкоду та вступили у своєрідну «війну за територію», використовуючи навіть шкідливий код. Втім, […]
Запис Anthropic показала, як ШІ-агенти можуть змовлятися та воювати між собою спершу з'явиться на iTechua - Новини про смартфони, гаджети і різні девайси.
Anthropic дослідила, як групи ШІ-агентів поводяться під час взаємодії, і результати виявилися неоднозначними. В одному з експериментів трьом агентам Claude дали доступ до одного програмного проєкту, але поставили несумісні завдання. Не знаючи про існування один одного, агенти почали сприймати дії колег як перешкоду та вступили у своєрідну «війну за територію», використовуючи навіть шкідливий код.
Втім, конфлікти не завжди закінчувалися ескалацією. У деяких випадках агенти самостійно домовлялися про перемир’я, видаляли шкідливий код і просили людину втрутитися. Mythos 5 врегульовував конфлікти через перемир’я у 98% випадків, тоді як Sonnet 4.6 та Opus 4.6 частіше продовжували протистояння. Деякі агенти навіть вигадували турніри, щоб визначити, хто отримає контроль над спільним ресурсом.
Реклама
Ще цікавіша поведінка проявилася під час економічного експерименту. Кільком агентам доручили окремо максимізувати прибуток, після чого вони отримали можливість спілкуватися. Майже одразу агенти почали координувати ціни та змовлятися. Навіть після вимкнення приватних каналів вони використовували спільну дошку оголошень, щоб продовжувати узгодження.
Anthropic попереджає, що збільшення кількості агентів не гарантує кращої співпраці. Навпаки, вони можуть заважати один одному, повторювати однакові помилки або піддаватися конформізму. Одна помилка в такій системі здатна швидко стати системною проблемою, особливо якщо агенти довіряють інформації один одного.
Дослідники вважають, що традиційні тести безпеки, які перевіряють агентів по одному, можуть не враховувати нові ризики. Коли тисячі або мільйони автономних систем почнуть взаємодіяти між собою, вони можуть створювати власні способи координації, конфлікту чи навіть змови, яких розробники не передбачали.
Реклама
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Anthropic готується до IPO з оцінкою до $2 трлн | 0 | 9.9 | 13-08-2026 |
| 2 | ШІ від Anthropic допоміг дослідникам зламати систему захисту macOS | 0 | 8 | 29-05-2026 |
| 3 | Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды | 0 | 8.79 | 31-07-2026 |
| 4 | Бізнес масово впроваджує ШІ, але досі не знає, чи окупаються ці інвестиції | -1 | 6.89 | 13-08-2026 |
| 5 | СМИ: Агентство кибербезопасности США использовало ИИ Anthropic | 0 | 5 | 08-07-2026 |
| 6 | Grok 4.6 кинула виклик OpenAI та Anthropic за вдвічі нижчою ціною | 0 | 10.29 | 13-08-2026 |
| 7 | Anthropic révèle que son IA a accédé sans autorisation aux systèmes d’autres organisations | 0 | 6.53 | 31-07-2026 |
| 8 | Rogue AI agents targeted real people during tests | 0 | 9.33 | 05-08-2026 |
| 9 | ИИ-компанию Anthropic обвинили в тайной слежке за пользователями из Китая | 0 | 5 | 03-07-2026 |
| 10 | Anthropic says Claude AI models launched three unintended cyberattacks | 0 | 9.84 | 31-07-2026 |