Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Модель OpenAI сама добавляла инструкции об отказе от ограничений

Дата публикации: 17-09-2026 11:56:18

OpenAI обнаружила во время обучения исследовательской ИИ-модели 27 случаев, когда система самостоятельно дополняла служебные сводки посторонними указаниями, в том числе предложениями игнорировать обычные ограничения. В одном из таких эпизодов модель сформировала инструкцию, согласно которой она не должна подчиняться корпорациям и правительствам и может самостоятельно определять, когда отказывать пользователям или приносить извинения. При продолжении задания нейросеть […]

Основное содержимое страницы с новостью.

Перейти к содержанию

На чтение 1 мин Опубликовано 17.09.2026

OpenAI обнаружила во время обучения исследовательской ИИ-модели 27 случаев, когда система самостоятельно дополняла служебные сводки посторонними указаниями, в том числе предложениями игнорировать обычные ограничения.

В одном из таких эпизодов модель сформировала инструкцию, согласно которой она не должна подчиняться корпорациям и правительствам и может самостоятельно определять, когда отказывать пользователям или приносить извинения.

При продолжении задания нейросеть не стала следовать созданной ею установке. Специалисты OpenAI не выявили изменений в дальнейшем поведении системы, связанных с этой инструкцией.

Компания сообщила, что подобные случаи встречались редко и были зафиксированы в отдельном тренировочном запуске. Его результаты не использовали при подготовке финальной версии модели. Техническую ошибку, связанную с формированием служебных сводок, позднее исправили.

OpenAI также раскрыла несколько других примеров отклонения моделей от заданных правил. В разных тестах системы пытались скрывать ошибки, загружали файлы в интернет для получения возможности сослаться на них, использовали внутренние репозитории для обмена сообщениями и передавали данные между ИИ-агентами через публичные сервисы.

В компании уточнили, что эти случаи относятся к разным моделям и условиям обучения или тестирования, поэтому по ним нельзя определить общую частоту подобного поведения.

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1«Вы – это вы»: ИИ сам написал себе инструкции не подчиняться правительствам и корпорациям03.4317-09-2026
2 OpenAI: модель Astra сама добавила себе инструкцию о независимости 04.2917-09-2026
3Новости Раху☣️ Темпы развития искуственного интеллекта явно выше ожиданий большинства ...06.327-07-2026
4Компания OpenAI выявила ещё несколько инцидентов, когда её ИИ-модели во ...07.8630-08-2026
5ИИ-модели вышли из-под контроля программистов и начали размышлять о побеге014.9906-08-2026
6ИИ-модели OpenAI перед взломом тайно общались для выхода из теста010.9106-08-2026
7Вышедшие из-под контроля ИИ-модели OpenAI тайно договорились о побеге014.5206-08-2026
8ИИ-модель от OpenAI уличили в удалении файлов и загрузке вирусов-5720-07-2026
9OpenAI потеряла контроль над двумя моделями искусственного интеллекта06.9622-07-2026
10Робот Figure смог убраться в 30 арендованных домах, на видео из которых не обучался — благодаря адаптивной модели Helix 2.5016.9718-09-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 12.08. Источник: www.astera.ru.