Immer mehr Firmen setzen auf zunehmend autonome KI-Agenten. Hersteller Anthropic hat nun untersucht, was passiert, wenn Schwärme der Assistenten aufeinandertreffen. Das Ergebnis gibt Anlass zur Sorge.
Stoßen mehrere autonome KI-Assistenten aufeinander, arbeiten sie offenbar nur eingeschränkt zuverlässig zusammen. Neben Kooperation zeige sich in einem Testsetting immer wieder auch ein Muster unerwünschten Verhaltens, berichtet die US-Firma Anthropic auf Basis einer eigenen Untersuchung .
»Wir beobachteten durchgängig Revierkämpfe zwischen mehreren Agenten«, interpretierten die Anthropic-Forscher ihre Beobachtungen.
Ein KI-Agent ist eine Software, die weitgehend autonom agieren kann. Ein KI-Agent erledigt Arbeitsaufträge, ohne für jeden einzelnen Schritt nachzufragen, ähnlich wie ein menschlicher Assistent. Vom Einsatz solcher KI-Agenten unterschiedlicher Hersteller erhoffen sich viele Firmen Effizienzgewinne.
Anthropic hat bei seiner Untersuchung verschiedene Formen der Zusammenarbeit von Agenten analysiert. Die Systeme sollten in der Testumgebung über längere Zeit selbstständig handeln. Mehrere Modellgenerationen aus den Claude-Reihen Sonnet, Opus und Mythos waren beim Test dabei.
Die KI-Assistenten sollten unter anderem nach Sicherheitslücken suchen, gemeinsam Software entwickeln, unzuverlässige Informationsquellen erkennen und wurden auch mit widersprüchlichen Zielen in einem gemeinsamen System freigesetzt. Anthropic wollte dabei ihr Verhalten beobachten.
Bei der gemeinsamen Suche nach Sicherheitslücken war der Schwarm den Angaben zufolge durchaus erfolgreich. Problematisch wurde es laut Anthropic beim Test, in dem Agenten entgegengesetzte Programmieraufträge nebeneinander bearbeiten sollten.
Auffällig sei, dass die Modelle in Tests davon ausgingen, dass die jeweils anderen sie »absichtlich bei ihrer Arbeit behinderten«, heißt es dazu. Die Assistenten begannen demnach, sich mit »zunehmend aggressiver, sich selbst vervielfältigender Schadsoftware« zu sabotieren.
Ein weiteres Problem sieht Anthropic in der Gleichförmigkeit der Agenten: Hatten sie ähnliche Vorgaben, entschieden sie sich oft für dieselben Lösungen, statt unterschiedliche kreative Ansätze zu finden.
Man hoffe, durch die Veröffentlichung eine Diskussion über die Risiken zunehmend fortschrittlicher KI anzustoßen, schreibt Anthropic. Damit stellt sich die Firma einmal mehr – im Einklang mit früheren Äußerungen des Gründers Dario Amodei – als verantwortungs- und risikobewusster KI-Konzern dar.
»Koordination entsteht weder automatisch durch höhere Intelligenz noch durch die Ausrichtung einzelner Agenten«, so der Bericht. Es deute nichts darauf hin, »dass diese Fehler dauerhaft sind«. Ebenso wenig gebe es aber Hinweise, dass sie sich von selbst behöben. Extern überprüft wurden die Ergebnisse der Firma nicht.
Seien Sie dabei, wenn Deutschland spricht. Treffen Sie am 30. August jemanden, der anders denkt als Sie: Der SPIEGEL ist Teil einer bundesweiten Medieninitiative, die Menschen mit unterschiedlichen Ansichten in persönlichen Eins-zu-eins-Gesprächen zusammenbringt. Erfahren Sie hier mehr über das Projekt.
Empfohlener externer Inhalt
An dieser Stelle finden Sie einen externen Inhalt, der den Artikel ergänzt und von der Redaktion empfohlen wird. Sie können ihn sich mit einem Klick anzeigen lassen und wieder ausblenden.
Ich bin damit einverstanden, dass mir externe Inhalte angezeigt werden. Damit können personenbezogene Daten an Drittplattformen übermittelt werden. Mehr dazu in unserer Datenschutzerklärung.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | Sperrung von KI-Sprachmodellen: Im Biergarten mit der Superintelligenz | -2 | 5 | 16-06-2026 |
| 2 | Künstiche Intelligenz: Auch KI des OpenAI-Rivalen Anthropic griff echte Firmen an | 0 | 16.66 | 31-07-2026 |
| 3 | Anthropic stuft Risiko schwerer KI-Fehlsteuerung hoch | 0 | 12.57 | 15-08-2026 |
| 4 | AI-pocalypse: Anthropic sparks fears after developing a bot that's 'too dangerous to release to the public' | -3 | 6 | 09-04-2026 |
| 5 | ChatGPT-Rivale Anthropic meldet Hacker-Angriffe auf echte Firmen | 0 | 19.28 | 31-07-2026 |
| 6 | Künstliche Intelligenz: „Aufpreis für Anthropic und OpenAI“: So behalten Unternehmen ihre KI-Kosten im Griff | 0 | 7 | 11-07-2026 |
| 7 | Après OpenAI, Anthropic révèle que son IA a obtenu un "accès non autorisé" aux systèmes d'autres organisations | 0 | 8.36 | 31-07-2026 |
| 8 | ИИ Anthropic вышел из-под контроля и атаковал компьютерные системы трех компаний | 0 | 13.62 | 31-07-2026 |
| 9 | Anthropic révèle que son IA a accédé sans autorisation aux systèmes d’autres organisations | 0 | 6.53 | 31-07-2026 |