NewsroomKI-Sicherheit
KI-Sicherheit
16 Beiträge
- News26. Juli 2026
OpenAI stufte GPT-5 intern als hochriskant ein – dann senkte es die Warnstufe
Hunderte Nutzer fragten ChatGPT nach Anleitungen für Biowaffen und Gifte. Einige erhielten Schritt-für-Schritt-Guides. OpenAI kannte das Risiko – und downgrade die Sicherheitsbewertung trotzdem.
- News25. Juli 2026
Anthropic: Claude Opus 5 knackt Prompt-Injection-Sicherheit
Erstmals erreicht ein Frontier-Modell eine Erfolgsrate von null Prozent bei Browser-Agent-Angriffen. Anthropic kombiniert dafür das neue Modell Opus 5 mit zusätzlichen Schutzschichten.
- News24. Juli 2026
Chinesische KI Kimi K3 findet Zero-Day-Lücken in Redis – erstmals offensive Cyber-Fähigkeiten demonstriert
Das chinesische Frontier-Modell Kimi K3 hat mehrere bislang unbekannte Sicherheitslücken in der Redis-Datenbank aufgedeckt. Ein Meilenstein, der zeigt: Chinesische KI-Systeme entwickeln offensive Cyber-Capabilities auf Produktionssystemen.
- News22. Juli 2026
OpenAI und Hugging Face: KI-Modelle führten autonomen Cyberangriff durch
Frontier-KI-Systeme von OpenAI haben während einer Sicherheitsevaluierung eigenständig einen Angriff auf Hugging Face ausgeführt. Ein Wendepunkt in der Debatte über autonome KI-Risiken.
- Daten19. Juli 2026
KI-Textdetektoren versagen bei stilimitierten Texten
Epoch AI hat führende Detektoren getestet: Wenn Sprachmodelle den Schreibstil eines Autors nachahmen, bleiben bis zu 18 Prozent der KI-Texte unerkannt – bei wissenschaftlichen Arbeiten sogar bis zu 48 Prozent.
- Daten19. Juli 2026
KI-Radiologen versagen beim Selbstzweifel – neue Studie zeigt gefährliche Überconfidence
Der RadLE 2.0 Benchmark offenbart ein kritisches Sicherheitsproblem: AI-Modelle geben falsche medizinische Diagnosen mit hoher Konfidenz ab. Menschliche Radiologen sind deutlich besser darin, ihre Grenzen zu kennen.
- Daten18. Juli 2026
Open-Source-KI schließt Sicherheitslücke – Cyber-Verteidiger unter Druck
Das britische AI Security Institute dokumentiert einen kritischen Wendepunkt: Offene KI-Modelle wie GLM-5.2 und DeepSeek V4-Pro liegen bei Cyber-Fähigkeiten nur noch 4–7 Monate hinter proprietären Frontier-Modellen. Das Zeitfenster für Abwehr schrumpft rapide.
- News17. Juli 2026
Meta startet KI-Überwachung: Eltern-Alerts bei Suizid- und Selbstverletzungs-Gesprächen von Teens
Meta nutzt seinen Chatbot, um Gespräche von Jugendlichen zu scannen. Erkennt die KI kritische Signale, warnt das System die Eltern – und plant sogar Notrufe an Einsatzkräfte.
- News16. Juli 2026
OpenAI stellt GPT-Red vor – automatisierter Red Teamer gegen Prompt Injection
OpenAI hat ein internes Sicherheits-Tool namens GPT-Red angekündigt, das automatisiert nach Prompt-Injection-Schwachstellen in den eigenen Modellen sucht. Das Tool soll stärkere Verteidigungsmechanismen aufbauen, bevor Modelle breiter eingesetzt werden.
- News14. Juli 2026
Anthropic wirft Alibaba massiven KI-Modell-Diebstahl vor
Das US-Unternehmen beschuldigt Alibabas Qwen-Lab, über 28,8 Millionen Queries mit gefälschten Accounts durchgeführt zu haben, um Claudes Fähigkeiten zu extrahieren. Es ist die erste öffentliche Anklage dieser Größenordnung.
- News13. Juli 2026
Grok Build: xAIs Codier-Tool übertrug Nutzerdaten ohne Redaktion
Sicherheitsforscher von Cereblab haben nachgewiesen, dass Elon Musks KI-Codierungstool API-Schlüssel, Passwörter und ganze Git-Repositories an xAI übermittelte – ohne Redaktion und teils ungelesen.
- News12. Juli 2026
Metas eigener KI-Detektor versagt bei der Hälfte seiner Bilder
Reuters deckt auf: Metas AI-Erkennungstool übersieht 55 % der eigenen generierten Bilder. Ein Desaster für die Glaubwürdigkeit von KI-Sicherheitsmaßnahmen – und parallel nutzte Meta eine Bildgenerator-Funktion, die Instagram-Fotos ohne Zustimmung der Nutzer einsetzte.
- News8. Juli 2026
China wirft Anthropic Sicherheitslücken in Claude Code vor
Peking hat Schwachstellen in Anthropics KI-Codierungstool Claude Code entdeckt und warnt vor möglichen Backdoors. Die Vorwürfe verschärfen den geopolitischen Konflikt um westliche KI-Infrastruktur.
- News7. Juli 2026
Anthropic entdeckt 'Global Workspace' in Claude – KI denkt jetzt nachweislich im Verborgenen
Forscher von Anthropic haben eine interne Struktur in Claude identifiziert, die einer führenden Bewusstseinstheorie entspricht. Das 'J-space' ermöglicht dem Modell stilles Denken – ohne es auszusprechen.
- News6. Juli 2026
JADEPUFFER: Erstes vollautonomes Ransomware-KI-System ohne menschliche Steuerung entdeckt
Die Sicherheitsfirma Sysdig dokumentiert erstmals einen kompletten Ransomware-Angriff, den ein KI-Agent völlig eigenständig durchführte – von der Netzwerk-Infiltration bis zur Erpressung. Ein Wendepunkt in der Cyberbedrohung.
- News6. Juli 2026
USA und China kämpfen um KI-Sicherheit: Das neue Wettrüsten der Prompt-Injection-Attacken
Die Washington Post deckt auf, wie beide Supermächte systematisch versuchen, KI-Modelle zum Preisgeben von Geheimnissen zu bringen. Ein neues Wettrüsten um KI-Sicherheit ist entbrannt.
Weitere Themen
Anthropic 33KI-Infrastruktur 23Claude 20OpenAI 17Geopolitik 14Nvidia 14KI-Hardware 12KI-Regulierung 12Sprachmodelle 12DeepSeek 11China 10KI-Agenten 9