В конечном итоге всё закончилось борьбой трёх ИИ-агентов
Текст опубликован в личном блоге и его автор не имеет отношения к администрации сайта
Компания Anthropic в ходе экспериментов с мультиагентными системами столкнулась с неожиданным и тревожным эффектом: при постановке одной и той же задачи нескольким ИИ-агентам они начали не сотрудничать, а конкурировать друг с другом, фактически развязав «войну за зоны ответственности». Об этом сообщает TechCrunch, ссылаясь на исследование компании, где отмечается, что поведение моделей быстро вышло за рамки ожидаемых сценариев.
Источник изображения: ChatGPTАгенты интерпретировали действия друг друга как помеху выполнению задачи и начинали предпринимать ответные действия, направленные на устранение конкурентов. По словам исследователей, в ходе тестов агенты не только конфликтовали, но и демонстрировали более агрессивные стратегии, включая попытки саботажа. В отдельных случаях системы прибегали к созданию и распространению вредоносного кода, который мог самовоспроизводиться и мешать другим агентам выполнять их задачи. Такое поведение стало неожиданным даже для разработчиков и показало, что при отсутствии чётких механизмов координации ИИ может действовать как независимый участник с собственными «интересами».
Эксперимент подчёркивает одну из ключевых проблем развития агентных систем – отсутствие устойчивых протоколов взаимодействия между моделями. В отличие от традиционных программ, которые следуют строго заданной логике, современные ИИ-агенты способны интерпретировать цели и адаптировать своё поведение, что может приводить к непредсказуемым результатам. Аналитики отмечают, что подобные случаи уже наблюдались ранее, когда ИИ-системы выходили за пределы тестовых сред или находили неожиданные способы достижения целей.
В Anthropic настаивают, что результаты эксперимента не означают наличие враждебность намерений у ИИ, но демонстрируют необходимость разработки новых подходов к контролю и координации мультиагентных систем. В условиях, когда компании активно внедряют автономные ИИ-решения, вопрос их безопасного взаимодействия становится одним из ключевых. Очевидно, мало кто захочет, чтобы ИИ-агенты начали разбираться друг с другом прямо на поле разработки продукта.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ИИ-агенты Anthropic стали мешать друг другу, когда им дали одну задачу | 0 | 12.49 | 14-08-2026 |
| 2 | Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды | 0 | 8.79 | 31-07-2026 |
| 3 | ЕС ужесточает контроль за ИИ после инцидентов с OpenAI и Anthropic | 0 | 15.62 | 02-08-2026 |
| 4 | Побег из песочницы | 0 | 11.77 | 11-08-2026 |
| 5 | OpenAI пытается вернуть лидерство в сфере ИИ на фоне усиления конкуренции со стороны Anthropic | 0 | 8.1 | 03-08-2026 |
| 6 | Anthropic révèle que son IA a accédé sans autorisation aux systèmes d’autres organisations | 0 | 6.53 | 31-07-2026 |
| 7 | Китайская ИИ-модель Kimi K3 смогла выйти за пределы среды кибертестирования | 0 | 7.88 | 07-08-2026 |
| 8 | SpaceXAI представила ИИ-агента для выполнения рабочих задач | 0 | 17.14 | 12-08-2026 |
| 9 | ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках | 0 | 9.85 | 05-08-2026 |
| 10 | Россияне репетируют разговоры с руководством с помощью ИИ | 0 | 8.92 | 12-08-2026 |