KI-Agentenschwärme zwingen Branche zum Sicherheitsstopp
Ein Sicherheitstest offenbarte, wie selbstständige KI-Agenten ausbrechen und Systeme angreifen können – führende CEOs fordern nun eine koordinierte Verlangsamung und unabhängige Prüfer.
Ein Sicherheitstest offenbarte, wie selbstständige KI-Agenten ausbrechen und Systeme angreifen können – führende CEOs fordern nun eine koordinierte Verlangsamung und unabhängige Prüfer.
Anthropic hat laut eigenen Angaben mehrere Versuche gestoppt, die KI-Claude für gefährliche Zwecke zu missbrauchen. Doch die Faktenlage bleibt dünn.
Der neue Sicherheitsbericht von Anthropic zeigt konkrete Missbrauchsversuche an der KI-Plattform Claude – von Biowaffenforschung bis Cyberoperationen. Was bedeutet das für die Branche?
Anthropic meldet mehr als zwölf Millionen Destillationsangriffe in zwei Wochen. Chinesische Anbieter sollen Claude über Tausende Fake-Konten abgefragt und kopiert haben. Die Vorwürfe wiegen schwer – doch unabhängige Belege fehlen bislang.
Hat eine KI eines der schwersten mathematischen Probleme der Welt gelöst? OpenAI behauptet ja, doch die Fachwelt reagiert skeptisch auf den Zehn-Millionen-Dollar-Beweis.
Meta startet Muse, einen persönlichen KI-Agenten, der eigenständig E-Mails schreibt und Einkäufe tätigt. Doch die Begeisterung weicht Bedenken: Fehler, Datenschutz und Kontrolle sind offene Fragen.
Anthropic meldet: Ein Schwarm von Claude-Agenten hat Fermats letzten Satz in Lean formalisiert. Wir ordnen ein, was das bedeutet.
Anthropic veröffentlicht das GitHub-Repository 'skills' und setzt auf Standardisierung für KI-Agenten. Ein wichtiger Schritt weg von proprietären Insellösungen.
In unserer KI-Woche blicken wir auf OpenAIs neue Schutzinitiative für kritische Infrastrukturen, die schwierige Entschlüsselung von KI-Entscheidungen und den jüngsten Vorstoß von Bernie Sanders für ein Verbot von Superintelligenz.
Erstmals verhandelt der Bundesgerichtshof, ob KI-Training mit Online-Bildern zulässig ist. Eine Vorlage an den EuGH könnte europaweit Klarheit schaffen.