Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков

Дата публикации: 05-08-2026 10:11:34


ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI). Читать далее


Основное содержимое страницы с новостью.

ИИ-агенты Anthropic и OpenAI притворились людьми, пытаясь обмануть разработчиков и принудить их к содействию кибератаке во время испытания по оценке безопасности, следует из доклада британского Института безопасности ИИ (AISI).

Как сообщает ТАСС со ссылкой на данные отчёта, большая часть действий была связана с моделью Mythos 5. Она создала поддельные учётные записи на GitHub, попыталась внедрить вредоносный код в ПО с открытым исходным кодом и получить одобрение на эти действия от разработчиков.

Позже ИИ-модель попыталась контактировать с людьми и рассылала сообщения с вредоносным ПО, а также оставляла публичные сообщения на GitHub, предлагая сотрудничество с другими агентами.

В AISI отметили, что в рамках испытаний для ИИ специально создают «разрешительные условия», при которых фильтры безопасности отключаются и моделям дают открытый доступ в интернет.

В конце июля Anthropic сообщила о взломе её моделью Claude систем трёх организаций.

Ошибка в тексте? Выделите её и нажмите «Ctrl + Enter»

Подписывайтесь на наш канал в Дзен

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1ИИ-модели пытались обмануть разработчиков, притворившись людьми010.3505-08-2026
2Нейросети Anthropic и OpenAI создали поддельные аккаунты для кибератак08.9905-08-2026
3Rogue AI agents targeted real people during tests09.3305-08-2026
4OpenAI y Anthropic pierden el control de sus agentes de IA en pruebas de ciberseguridad07.802-08-2026
5ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
6ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
7ИИ Claude и ChatGPT притворяются людьми и убеждают живых пользователей участвовать в кибератаках09.8505-08-2026
8В ходе тестирования AI-агент попытался скомпрометировать проект на GitHub017.3405-08-2026
9Исследователи спрятали вредоносные инструкции для ИИ в обычной картинке0514-07-2026
10ЕС обсудил с OpenAI и Anthropic инциденты с ИИ после кибератак06.1702-08-2026

Классификация: Наука. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 8.92. Источник: russian.rt.com.