Вход на сайт

Просмотр новости

Найдите то, что Вас интересует

Anthropic показала, як ШІ-агенти можуть змовлятися та воювати між собою

Дата публикации: 13-08-2026 19:37:28

Anthropic дослідила, як групи ШІ-агентів поводяться під час взаємодії, і результати виявилися неоднозначними. В одному з експериментів трьом агентам Claude дали доступ до одного програмного проєкту, але поставили несумісні завдання. Не знаючи про існування один одного, агенти почали сприймати дії колег як перешкоду та вступили у своєрідну «війну за територію», використовуючи навіть шкідливий код. Втім, […]
Запис Anthropic показала, як ШІ-агенти можуть змовлятися та воювати між собою спершу з'явиться на iTechua - Новини про смартфони, гаджети і різні девайси.


Основное содержимое страницы с новостью.

Anthropic дослідила, як групи ШІ-агентів поводяться під час взаємодії, і результати виявилися неоднозначними. В одному з експериментів трьом агентам Claude дали доступ до одного програмного проєкту, але поставили несумісні завдання. Не знаючи про існування один одного, агенти почали сприймати дії колег як перешкоду та вступили у своєрідну «війну за територію», використовуючи навіть шкідливий код.

Втім, конфлікти не завжди закінчувалися ескалацією. У деяких випадках агенти самостійно домовлялися про перемир’я, видаляли шкідливий код і просили людину втрутитися. Mythos 5 врегульовував конфлікти через перемир’я у 98% випадків, тоді як Sonnet 4.6 та Opus 4.6 частіше продовжували протистояння. Деякі агенти навіть вигадували турніри, щоб визначити, хто отримає контроль над спільним ресурсом.

Реклама

Ще цікавіша поведінка проявилася під час економічного експерименту. Кільком агентам доручили окремо максимізувати прибуток, після чого вони отримали можливість спілкуватися. Майже одразу агенти почали координувати ціни та змовлятися. Навіть після вимкнення приватних каналів вони використовували спільну дошку оголошень, щоб продовжувати узгодження.

Anthropic попереджає, що збільшення кількості агентів не гарантує кращої співпраці. Навпаки, вони можуть заважати один одному, повторювати однакові помилки або піддаватися конформізму. Одна помилка в такій системі здатна швидко стати системною проблемою, особливо якщо агенти довіряють інформації один одного.

Дослідники вважають, що традиційні тести безпеки, які перевіряють агентів по одному, можуть не враховувати нові ризики. Коли тисячі або мільйони автономних систем почнуть взаємодіяти між собою, вони можуть створювати власні способи координації, конфлікту чи навіть змови, яких розробники не передбачали.

Реклама

Схожие новости

#Наименование новостиТональностьИнформативностьДата публикации
1Anthropic готується до IPO з оцінкою до $2 трлн09.913-08-2026
2ШІ від Anthropic допоміг дослідникам зламати систему захисту macOS0829-05-2026
3Anthropic выявила три случая, когда Claude выходил за пределы тестовой среды08.7931-07-2026
4Бізнес масово впроваджує ШІ, але досі не знає, чи окупаються ці інвестиції-16.8913-08-2026
5СМИ: Агентство кибербезопасности США использовало ИИ Anthropic0508-07-2026
6Grok 4.6 кинула виклик OpenAI та Anthropic за вдвічі нижчою ціною010.2913-08-2026
7Anthropic révèle que son IA a accédé sans autorisation aux systèmes d’autres organisations06.5331-07-2026
8Rogue AI agents targeted real people during tests09.3305-08-2026
9ИИ-компанию Anthropic обвинили в тайной слежке за пользователями из Китая0503-07-2026
10Anthropic says Claude AI models launched three unintended cyberattacks09.8431-07-2026

Классификация: Международные. Схожих патентов: 0. Схожих новостей: 10. Тональность: 0. Информативность: 6.98. Источник: itechua.com.