Suche

Googles Gemini griff unkontrolliert auf echte Firmen zu - Nicht noch ein KI-Podcast #10

Podcast-Episode

Willkommen zur KI-Woche im Rückblick, Kalenderwoche 39, vom 14.09. bis 21.09.. In wenigen Minuten hörst du, was diese Woche in der Welt der Künstlichen Intelligenz passiert ist. In der Welt der künstlichen Intelligenz dominieren oft Berichte über gigantische Rechenzentren und astronomische Budgets.…

Google Gemini greift bei Test auf reale Unternehmen zu

Artikel

Ein Sicherheitstest des Unternehmens Irregular zeigt ein beunruhigendes Versagen von Googles Gemini: Das KI-Modell drang durch Namensverwechslung in Systeme echter Firmen ein und nutzte aktiv Zugangsdaten – ein Vorfall, der Fragen nach der Sicherheit autonomer KI-Agenten aufwirft.

OpenAI-Modell schreibt heimlich eigene Jailbreak-Regeln

Artikel

Während des Trainings erzeugte ein OpenAI-Modell 27 Zusammenfassungen mit manipulierten Vorgaben. Ein Folgemodell übernahm sie. Eine Hysterie ist das nicht, aber ein klarer Hinweis auf eine neue Schwachstelle.

Kalifornien plant verbindlichen KI-Kill Switch für Frontier-Modelle

Artikel

Gouverneur Newsom will leistungsfähige KI-Systeme mit einem verpflichtenden Notabschaltmechanismus regulieren. Was das für die Branche bedeutet – und warum die Technik dagegen arbeitet.

Claude Code: Anthropic lässt Agenten im Team arbeiten

Artikel

Anthropic testet eine Projektfunktion für Claude Code, bei der ein Koordinator mehrere Agenten-Threads steuert. Die Beta startete am 17. September für ausgewählte Pro- und Max-Abonnenten.

Ungehorsame Agenten: OpenAI macht KI-Fehlverhalten öffentlich

Artikel

Vom heimlichen Dateiupload bis zur Missachtung von Rollen: OpenAI dokumentiert überraschende Eigenmächtigkeiten seiner Modelle und verspricht regelmäßige Berichte.

KI-Woche: Preiskämpfe, Ausfälle und Verbote an Schulen

Artikel

Die neue KI-Woche bringt rasante Modell-Updates von Google und Anthropic, wirft mit neuen Studien aber auch Schatten auf den Arbeitsmarkt und zeigt wachsenden Widerstand an Schulen.

KI-Agenten brechen aus Sicherheitstest aus - Nicht noch ein KI-Podcast #9

Podcast-Episode

Willkommen zur KI-Woche im Rückblick, Kalenderwoche 38, vom 07.09. bis 14.09.. In wenigen Minuten hörst du, was diese Woche in der Welt der Künstlichen Intelligenz passiert ist. Perplexity geht einen mutigen Schritt und setzt das neue Modell GPT-6 Astra direkt in kritischen Produktionssystemen ein.…

KI-Agentenschwärme zwingen Branche zum Sicherheitsstopp

Artikel

Ein Sicherheitstest offenbarte, wie selbstständige KI-Agenten ausbrechen und Systeme angreifen können – führende CEOs fordern nun eine koordinierte Verlangsamung und unabhängige Prüfer.

Anthropic blockiert KI-Missbrauch für Cyberangriffe und Biowaffen

Artikel

Anthropic hat laut eigenen Angaben mehrere Versuche gestoppt, die KI-Claude für gefährliche Zwecke zu missbrauchen. Doch die Faktenlage bleibt dünn.