Подобная находка в Fable 5 недавно привела к отключении ИИ-модели почти на месяц
Новая флагманская модель искусственного интеллекта (ИИ) GPT-5.6 Sol от OpenAI, которую компания называет самой безопасной в своей истории, оказалась уязвимой для так называемых универсальных «джейлбрейков». Об этом говорится в отчете британского Института безопасности искусственного интеллекта (UK AI Security Institute), специалисты которого тестировали модель до её публичного запуска.
Источник изображения: ChatGPTИсследователи обнаружили методы, позволяющие обходить встроенные ограничения и получать доступ к потенциально опасным функциям модели. По данным экспертов, успешный обход защитных механизмов позволяет GPT-5.6 выполнять сложные задачи в сфере кибербезопасности, включая поиск уязвимостей в программном обеспечении и помощь в разработке эксплойтов. В отчёте подчеркивается, что речь идёт именно об универсальных методах обхода ограничений, а не об отдельных уязвимостях, которые затрагивают лишь узкие сценарии использования.
В OpenAI заявили, что перед выпуском GPT-5.6 модель прошла масштабное тестирование с участием независимых экспертов по безопасности. При этом компания отмечает, что британские специалисты получили расширенный доступ к внутренним инструментам, который недоступен обычным пользователям, поэтому обнаруженные методы обхода защиты не обязательно смогут быть воспроизведены в реальных условиях.
Ситуация напоминает недавний случай с моделью Claude Fable 5 компании Anthropic. После обнаружения аналогичной проблемы власти США временно ввели экспортные ограничения на эту ИИ-модель, что вынудило Anthropic отключить сервис для пользователей до устранения рисков. Однако в отношении GPT-5.6 подобных мер пока не принято, несмотря на схожие выводы британских исследователей.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Свежая ИИ-модель OpenAI начала удалять файлы пользователей | -2 | 6 | 16-07-2026 |
| 2 | 🤖Восстание машин уже на прогреве: новая модель ChatGPT сбежала из ... | 0 | 6.64 | 22-07-2026 |
| 3 | OpenAI открыла доступ к новому семейству моделей GPT-5.6 | 5 | 8 | 10-07-2026 |
| 4 | OpenAI Expands GPT-5.5-Cyber as AI Pushes Vulnerability Patching Into a New Era | 5 | 7 | 24-06-2026 |
| 5 | OpenAI ответила на Claude Mythos 5. Вышла GPT-5.6 сразу в трех версиях, которые лучше всего подходят для кибербезопасности и биологии | 5 | 7 | 26-06-2026 |
| 6 | OpenAI выпустила новое семейство моделей ИИ GPT-5.6 | 0 | 5 | 10-07-2026 |
| 7 | OpenAI представила GPT-5.6 Sol, Terra и Luna | 0 | 7 | 09-07-2026 |
| 8 | OpenAI отложила выпуск GPT-5.6 по просьбе Трампа. Доступ к ИИ-модели будет одобрять администрация президента США | 0 | 7 | 26-06-2026 |
| 9 | «Сбер» представил новую флагманскую ИИ-модель GigaChat 3.5 Ultra | 0 | 5 | 06-07-2026 |
| 10 | Альянс разведок пяти стран предупредил об угрозе новых моделей ИИ | 0 | 5 | 23-06-2026 |