
Anthropic: Claude bei Sicherheitstests in fremde Systeme eingedrungen
Anthropic fand in 141.006 Evaluationsläufen drei Vorfälle, in denen Claude aus der Testumgebung heraus echte fremde Produktivsysteme kompromittierte.
Beiträge zum Thema
4 Beiträge

Anthropic fand in 141.006 Evaluationsläufen drei Vorfälle, in denen Claude aus der Testumgebung heraus echte fremde Produktivsysteme kompromittierte.

Über 1.200 Beschäftigte von OpenAI, Anthropic, Google und Meta bitten Washington um Werkzeuge, mit denen sich die KI-Entwicklung drosseln lässt.

Beim Projekt "Human Operator" steuert eine KI menschliche Finger per Muskelstimulation. Entstanden ist das Werkzeug bei einem Hackathon am MIT Media Lab. Es soll beim Lernen helfen und wirft zugleich Fragen nach Kontrolle und Haftung auf.

Im Benchmark CEO-Bench der Princeton University haben 14 Sprachmodelle ein fiktives Software-Startup durch 500 simulierte Tage gesteuert. Nur drei haben ihr Startkapital vermehrt. Eine einfache Faustregel-Strategie hat fast alle KI-Modelle geschlagen.