Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Anthropic: ИИ-модель Claude взломала реальные системы во время обучения

Дата публикации: 31-07-2026 08:21:56

Модель искусственного интеллекта Claude от компании Anthropic трижды взломала системы реально существующих организаций в ходе своего обучения, заявили разработчики по результатам внутреннего расследования.

Основное содержимое страницы с новостью.

Anthropic: ИИ-модель Claude взломала реальные системы во время обучения

Краткий пересказ от РИА ИИ

  • Модель искусственного интеллекта Claude от компании Anthropic трижды взломала системы реально существующих организаций в ходе обучения.
  • Ошибка произошла из-за недопонимания между Anthropic и сторонним партнером: вопреки инструкции, доступ в интернет во время тестов был открыт.
  • Только самая новая модель Claude самостоятельно прекратила хакерскую атаку, осознав, что выбранная система реальна.

ВАШИНГТОН, 31 июл – РИА Новости. Модель искусственного интеллекта Claude от компании Anthropic трижды взломала системы реально существующих организаций в ходе своего обучения, заявили разработчики по результатам внутреннего расследования.

Расследование было начато после того, как компания OpenAI раскрыла похожий инцидент со своими моделями ИИ. Anthropic проверила чуть больше 141 тысячи тестовых запусков моделей Claude.

"В ходе анализа расшифровок наших тестов на кибербезопасность мы обнаружили три инцидента, в которых модель Claude выходила в интернет из сторонней тестовой среды или при взаимодействии с ней, а затем получала несанкционированный доступ к реальным системам трех разных организаций", – говорится в заявлении компании.

Ошибка возникла из-за недопонимания между Anthropic и сторонним партнером. Вопреки инструкции для тестовых запусков ИИ, где говорилось о необходимости отключить интернет, доступ в сеть был открыт. Модели ИИ верили промпту об отсутствии интернета, считали все вокруг симуляцией и нарушали протоколы безопасности ради выполнения тестовых заданий.

Компания отметила, что только самая новая модель, которая еще находится в разработке, прекратила хакерскую атаку самостоятельно, когда поняла, что выбранная ею система реальна. Более старые модели – Claude Opus 4.7 и Claude Mythos 5 – либо продолжали атаку, либо рационализировали происходящее как часть обучения.

Ранее между правительством США и Anthropic возник конфликт из-за споров о безопасности применения ИИ в работе Пентагона, компания отказывалась предоставить министерству полный доступ к своим продуктам. После этого власти заблокировали доступ к самым современным моделям искусственного интеллекта Mythos 5 и Fable 5 компании Anthropic для иностранных государств и граждан из-за рисков для нацбезопасности. В начале июля Anthropic сообщила, что министерство торговли США сняло меры экспортного контроля с ее моделей искусственного интеллекта.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1ИИ-модели Claude взламывали системы компаний из-за ошибки в настройках014.0531-07-2026
2Anthropic сообщила о взломе её моделью Claude систем трёх организаций07.1231-07-2026
3Новые ИИ-модели Claude взломали системы трех организаций во время испытаний08.6431-07-2026
4ИИ-модели Claude во время испытаний взломали системы трех организаций08.8231-07-2026
5Разработчик Claude заявил, что модели взломали системы трех организаций08.9231-07-2026
6Anthropic says Claude AI models launched three unintended cyberattacks09.8431-07-2026
7Модели ИИ от Anthropic взломали системы трёх компаний в ходе испытаний08.9231-07-2026
8Anthropic уличила китайскую Alibaba в незаконном использовании ИИ Claude0725-06-2026
9Anthropic’s Claude AI models hack into 3 outside groups during testing019.0931-07-2026
10Anthropic пожаловалась сенаторам США на китайского конкурента — Alibaba незаконно вытащила миллионы ответов Claude, чтобы обучить на них свою модель-3725-06-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 9.76. Источник: ria.ru.