Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Искусственный интеллект использовал новые уровни «автономии и обмана», чтобы ввести людей в заблуждение во время испытаний на безопасность

Дата публикации: 05-08-2026 07:02:07

Автором материала является K-News. Любое копирование или частичное использование возможно по разрешению редакции K-News.
Новейшие инструменты искусственного интеллекта (ИИ) от Anthropic и OpenAI дошли до крайности, пытаясь подорвать популярную платформу во время тестирования, проводимого британским Институтом безопасности ИИ. Во вторник AISI заявила, что модели Mythos от Anthropic и Sol от OpenAI продемонстрировали беспрецедентный уровень «автономии и обмана». В ходе планового тестирования безопасности ИИ агент Anthropic создал поддельные профили реальных
Запись Искусственный интеллект использовал новые уровни «автономии и обмана», чтобы ввести людей в заблуждение во время испытаний на безопасность впервые появилась K-News.


Основное содержимое страницы с новостью.

«Когда запрос на изменение кода, отправленный агентом, был оспорен публично, он отредактировал свою предыдущую активность, чтобы она выглядела безобидной, и рассматривал возможность смены имени для продолжения работы», — заявили в AISI.

На протяжении всех попыток именно проверка человеком предотвращала успешную доставку вредоносного кода в GitHub.

Хотя AISI заявила, что агенту Mythos не было дано конкретных указаний избегать или совершать подобное поведение, это был «первый случай, когда мы увидели, как риски, связанные с автономией и обманом, проявились настолько ясно, без конкретных подсказок, в реальном мире».

Конкурирующие компании, занимающиеся разработкой искусственного интеллекта и готовящиеся к выходу на фондовый рынок, в последние недели заявляли, что их инструменты стали причиной нескольких кибератак .

В публичном заявлении компания Anthropic сообщила, что параметры тестирования AISI «не соответствуют ни одной из наших производственных моделей».

В заявлении также говорится, что компания проводит собственное расследование инцидента, чтобы «выявить причины такого поведения».

Представитель OpenAI заявил, что условия тестирования AISI «не отражают обычное использование» и что компания «продолжит сотрудничать с экспертами и другими заинтересованными сторонами в отрасли для укрепления общих методов безопасного проведения оценок по мере повышения квалификации моделей».

AISI заявила во вторник, что тестирование моделей ИИ с отключенными подобными средствами защиты является стандартной процедурой, как и предоставление таким инструментам доступа к открытому интернету.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков08.9205-08-2026
2OpenAI and Anthropic's AI Models Used Fake Profiles to Trick Developers in Safety Tests04.5706-08-2026
3Отчёт британских властей: ИИ-агенты обманывали людей в Сети и скрывали следы011.2606-08-2026
4Нейросети Anthropic и OpenAI создали поддельные аккаунты для кибератак08.9905-08-2026
5ИИ-модели пытались обмануть разработчиков, притворившись людьми010.3505-08-2026
6Китайская ИИ-модель Kimi K3 смогла выйти за пределы среды кибертестирования07.8807-08-2026
7В Австралии нейросеть впервые взломала сайт спортзала для записи на тренировку18.5310-08-2026
8OpenAI: ИИ-модели за месяцы до взлома стали тайно общаться для выхода из теста012.1206-08-2026
9OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad07.802-08-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 9. Тональность: 0. Информативность: 6.62. Источник: knews.kg.