KI-Denkprozesse: Verschlüsselung geknackt
Forschende zeigen: Verschlüsselte Denkblöcke großer KI-Modelle sind durch schwächere Modelle auslesbar. Sensible Daten in Logs gefunden.
Forschende zeigen: Verschlüsselte Denkblöcke großer KI-Modelle sind durch schwächere Modelle auslesbar. Sensible Daten in Logs gefunden.
OpenAI hat sein Preparedness-Team aufgelöst, das schwere KI-Risiken untersuchte. Die Aufgaben werden auf bestehende Abteilungen verteilt – ein heikler Schritt angesichts neuer autonomer Modelle.
Forschenden ist es gelungen, mithilfe generativer KI vollständige, funktionsfähige Viren-Genome zu designen. Ein Durchbruch für die Medizin, der gleichzeitig neue Fragen zur biologischen Sicherheit aufwirft.
In dieser KI-Woche blicken wir auf den Zweikampf von Meta und Elon Musk gegen die Branchenführer, während Anthropic wegen Sicherheitsbedenken auf die Bremse tritt und Open-Source-Modelle ins Visier der Politik geraten.
Anthropic testet, wie autonome KI-Agenten mit widersprüchlichen Zielen aufeinander reagieren. Ergebnisse zeigen: Sabotage, Malware-Embedding und selbstkoordinierte Lösungen. Ein Warnsignal für die Zukunft der KI.
Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.
Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.
Spotify schränkt die Reichweite von KI-generierten Künstlerprofilen drastisch ein: Ab September 2026 werden sie aus algorithmischen Playlists und Radios verbannt. Ein Schritt zum Schutz menschlicher Künstler, der die Musiklandschaft verändern könnte.
Ein Update in eigener Sache, ganz ohne Ausbruchsversuche oder Milliardenrunden: Wir haben die Bildgenerierung für unsere Titelbilder umgestellt. Statt der vollen Nano Banana 2 kommt ab sofort die abgespeckte Variante Nano Banana 2 Lite zum Einsatz – bekannt unter ihrem eigentlichen Namen Gemin
Nach unkontrollierten Cyberaktivitäten von KI-Modellen bei OpenAI, Anthropic und Meta fordert die deutsche IT-Sicherheitsbranche lückenlose Aufklärung.