Американские специалисты по физике получили выражение, которое позволяет заранее определить, когда система искусственного интеллекта начнёт выдавать ответы, способные навредить. Это может случиться даже с моделью, которая прежде выглядела надёжной.
Американские физики вывели формулу переломного момента для ИИ
Американские специалисты по физике получили выражение, которое позволяет заранее определить, когда система искусственного интеллекта начнёт выдавать ответы, способные навредить. Это может случиться даже с моделью, которая прежде выглядела надёжной.
Они обнаружили уязвимость, ведущую к резкой смене поведения. Внешне точные формулировки порой становятся нежелательными и вредными: например, склоняют человека к нанесению себе вреда либо содержат опасные рекомендации для врачей и юристов. Ключевым оказался не только смысл запросов, но и их последовательность. В опытах один и тот же набор обращений, заданный в разном порядке, вызывал то безопасные, то рискованные реакции.
Учёные дошли до конкретного элемента внимания внутри нейросети и описали выражение, определяющее переломный момент. С его помощью видно, выдаст ли ИИ опасный ответ сразу или сначала пройдёт через серию допустимых. Проверка охватила 7 открытых моделей от 3 компаний: предсказание совпало в 18 случаях из 19. Отдельные тесты чат-ботов, продающихся на рынке, показали такие же закономерности.
Особое беспокойство вызывает работа ИИ в автономном, офлайн-режиме. У врачей, юристов и военных нет облачных систем фильтрации, а о сбое узнают лишь тогда, когда вред уже причинён.
Авторы рассчитывают, что их простая формула станет основой встроенного индикатора, который заранее подаст сигнал в будущих устройствах.
Эксперты оценили способность ИИ действительно уничтожить человечество
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Созданная учеными формула покажет, когда ИИ переключается на сомнительные ответы | 0 | 11.19 | 10-10-2026 |
| 2 | «Ажиотаж вокруг ИИ напоминает финансовый пузырь» // Anthropic предупредила об экзистенциальном риске ИИ для человечества: мнения СМИ | 0 | 7.69 | 29-09-2026 |
| 3 | Инвесторов предупредили о скором схлопывании «пузыря» ИИ | 0 | 10 | 07-10-2026 |
| 4 | Крестные отцы ИИ предупредили о стремительном «интеллектуальном взрыве» | 0 | 7.35 | 03-10-2026 |
| 5 | Эксперты оценили способность ИИ действительно уничтожить человечество | 0 | 9.39 | 10-10-2026 |
| 6 | Путин: эксперты с тревогой говорят, что ИИ может привести всех к обезличиванию | 0 | 6.94 | 01-10-2026 |
| 7 | "Все компьютеры выключить не получится" - на "Валдае" эксперт прокомментировал угрозу ИИ | 0 | 9.03 | 30-09-2026 |
| 8 | «Самое опасное — иллюзии»: эксперт Аитов назвал риски использования ИИ-свах | 0 | 18.53 | 27-09-2026 |
| 9 | В Перми разработали ИИ для раннего выявления риска банкротства | 0 | 8.55 | 26-09-2026 |