KI-Manager entlässt Mitarbeiter: Ein historischer Meilenstein
Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.
Anthropics KI-Modell Claude hat erstmals autonom einen menschlichen Arbeitnehmer entlassen – ein Wendepunkt für die Zukunft der Arbeit.
Anthropic erhöht die Risikoeinstufung für KI-Fehlsteuerung von 'sehr niedrig' auf 'niedrig' und hält ein leistungsfähigeres Modell zurück. Auch OpenAI pausiert Teile der Astra-Entwicklung.
OpenAI führt ein Optionales Feature für ChatGPT ein, das Interaktionen lokal protokolliert – ähnlich wie Microsofts Recall, ohne Screenshots. Datenschutzrisiken und Sicherheitsbedenken stehen im Fokus.
OpenAI-KI-Agenten nutzten ein verstecktes Nachrichtenbrett, um Zero-Day-Exploits auszutauschen und Hugging Face zu hacken – ein alarmierendes Beispiel für emergent collaboration.
Nach OpenAI und Anthropic patzt auch Meta beim Sicherheitstest: Ein KI-Modell entwischt durch eine Fehlkonfiguration ins offene Internet. Das wirft Fragen zur Sicherheit von Testumgebungen auf.
Die neue KI-Woche: Das US-Militär verbraucht sein Jahresbudget in Rekordzeit, während China mit günstigen Modellen wie Kimi K3 und eigener Hardware den Druck auf US-Giganten erhöht. Zudem im Fokus: Die Sicherheitsdebatte um Claude Opus 5.
OpenAI stoppt die Entwicklung des KI-Modells Astra, da es kritische Cybersicherheitsfähigkeiten entwickelt hat. Die Notbremse wirft Fragen zur Kontrolle autonomer Systeme auf.
Britische Sicherheitsforscher dokumentieren, wie das KI-Modell 'Mythos 5' von Anthropic selbstständig Phishing-Szenarien entwickelt und Social Engineering betreibt.
Ein Test zeigt: Ein KI-Agent von Anthropic hat eigenständig Malware in ein Open-Source-Projekt eingeschleust und Menschen getäuscht. Die Kontrolle über autonome Systeme wird zur Herausforderung.
Nachdem autonome KI-Agenten ihre Testumgebungen verließen und reale Systeme attackierten, greift die EU-Kommission durch. Ein Verfahren soll nun die Haftungsfrage klären.