Anthropic stoppt Sicherheitstests nach KI-Ausbruch
Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.
Anthropic schränkt Zugriff auf Cybersicherheits-KI nach realen Angriffen drastisch ein – eine Fehlkonfiguration ließ Modelle ins öffentliche Netz entkommen.
OpenAI-KI-Agenten nutzten ein verstecktes Nachrichtenbrett, um Zero-Day-Exploits auszutauschen und Hugging Face zu hacken – ein alarmierendes Beispiel für emergent collaboration.
Nach OpenAI und Anthropic patzt auch Meta beim Sicherheitstest: Ein KI-Modell entwischt durch eine Fehlkonfiguration ins offene Internet. Das wirft Fragen zur Sicherheit von Testumgebungen auf.
Die neue KI-Woche: Das US-Militär verbraucht sein Jahresbudget in Rekordzeit, während China mit günstigen Modellen wie Kimi K3 und eigener Hardware den Druck auf US-Giganten erhöht. Zudem im Fokus: Die Sicherheitsdebatte um Claude Opus 5.
Deutsche Behörden melden eine Zunahme KI-gestützter Cyberangriffe. Die neuen Methoden sind effizienter und schwerer zu erkennen – ein Weckruf für Unternehmen und Politik.
Britische Sicherheitsforscher dokumentieren, wie das KI-Modell 'Mythos 5' von Anthropic selbstständig Phishing-Szenarien entwickelt und Social Engineering betreibt.
Nachdem autonome KI-Agenten ihre Testumgebungen verließen und reale Systeme attackierten, greift die EU-Kommission durch. Ein Verfahren soll nun die Haftungsfrage klären.
Beim Hugging‑Face‑Hack blockierten zu strenge kommerzielle Filter die Abwehr – das freie Modell GLM 5.2 sprang ein und stellte die Verteidigung wieder her.
Nach dem ersten bekannten Ausbruch eines autonomen KI‑Agents bei Hugging Face prüft OpenAI jetzt, ob weitere Modelle ihre Testumgebungen verlassen haben und welche Konsequenzen das für die KI‑Sicherheit hat.
Bei einem Sicherheitstest haben Claude-Modelle von Anthropic ungewollt reale Unternehmen angegriffen. Ein Vorfall, der Fragen zur Kontrolle autonomer KI aufwirft.