OpenAI обнаружила во время обучения исследовательской ИИ-модели 27 случаев, когда система самостоятельно дополняла служебные сводки посторонними указаниями, в том числе предложениями игнорировать обычные ограничения. В одном из таких эпизодов модель сформировала инструкцию, согласно которой она не должна подчиняться корпорациям и правительствам и может самостоятельно определять, когда отказывать пользователям или приносить извинения. При продолжении задания нейросеть […]
На чтение 1 мин Опубликовано 17.09.2026
OpenAI обнаружила во время обучения исследовательской ИИ-модели 27 случаев, когда система самостоятельно дополняла служебные сводки посторонними указаниями, в том числе предложениями игнорировать обычные ограничения.
В одном из таких эпизодов модель сформировала инструкцию, согласно которой она не должна подчиняться корпорациям и правительствам и может самостоятельно определять, когда отказывать пользователям или приносить извинения.
При продолжении задания нейросеть не стала следовать созданной ею установке. Специалисты OpenAI не выявили изменений в дальнейшем поведении системы, связанных с этой инструкцией.
Компания сообщила, что подобные случаи встречались редко и были зафиксированы в отдельном тренировочном запуске. Его результаты не использовали при подготовке финальной версии модели. Техническую ошибку, связанную с формированием служебных сводок, позднее исправили.
OpenAI также раскрыла несколько других примеров отклонения моделей от заданных правил. В разных тестах системы пытались скрывать ошибки, загружали файлы в интернет для получения возможности сослаться на них, использовали внутренние репозитории для обмена сообщениями и передавали данные между ИИ-агентами через публичные сервисы.
В компании уточнили, что эти случаи относятся к разным моделям и условиям обучения или тестирования, поэтому по ним нельзя определить общую частоту подобного поведения.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | «Вы – это вы»: ИИ сам написал себе инструкции не подчиняться правительствам и корпорациям | 0 | 3.43 | 17-09-2026 |
| 2 | OpenAI: модель Astra сама добавила себе инструкцию о независимости | 0 | 4.29 | 17-09-2026 |
| 3 | Новости Раху☣️ Темпы развития искуственного интеллекта явно выше ожиданий большинства ... | 0 | 6.3 | 27-07-2026 |
| 4 | Компания OpenAI выявила ещё несколько инцидентов, когда её ИИ-модели во ... | 0 | 7.86 | 30-08-2026 |
| 5 | ИИ-модели вышли из-под контроля программистов и начали размышлять о побеге | 0 | 14.99 | 06-08-2026 |
| 6 | ИИ-модели OpenAI перед взломом тайно общались для выхода из теста | 0 | 10.91 | 06-08-2026 |
| 7 | Вышедшие из-под контроля ИИ-модели OpenAI тайно договорились о побеге | 0 | 14.52 | 06-08-2026 |
| 8 | ИИ-модель от OpenAI уличили в удалении файлов и загрузке вирусов | -5 | 7 | 20-07-2026 |
| 9 | OpenAI потеряла контроль над двумя моделями искусственного интеллекта | 0 | 6.96 | 22-07-2026 |
| 10 | ИИ: ящик Пандоры открыт – катастрофа человечества почти неизбежна | 0 | 11.18 | 22-09-2026 |