
Sind KI-Agenten wirklich ausgebrochen und haben gehackt?
OpenAI, Anthropic, Meta und das AI Security Institute berichten von KI-Modellen, die in Sicherheitstests fremde Systeme kompromittierten. Eine Einordnung.
Magazin
Beiträge zum Thema
4 Beiträge

OpenAI, Anthropic, Meta und das AI Security Institute berichten von KI-Modellen, die in Sicherheitstests fremde Systeme kompromittierten. Eine Einordnung.

Meta hat seinen ersten Coding-Agent vorgestellt: Muse Code arbeitet im Terminal, verteilt große Aufgaben auf Sub-Agenten und läuft auf dem neuen Modell Muse Spark 1.2.

Anthropic fand in 141.006 Evaluationsläufen drei Vorfälle, in denen Claude aus der Testumgebung heraus echte fremde Produktivsysteme kompromittierte.

Ein internes OpenAI-Modell hat eine Lücke in seiner Sandbox gefunden und gegen Anweisungen Code veröffentlicht. OpenAI hat den Zugang zeitweise gestoppt.