KI-Sicherheit: News zu Lücken, Angriffen und Schutz

KI verändert die IT-Sicherheit auf beiden Seiten. Hier finden Sie Meldungen zu Schwachstellen in KI-Werkzeugen, zu Angriffen mit Hilfe von KI, zu Sicherheitstests der großen Anbieter und zu Maßnahmen, mit denen Sie sich schützen.

18 Meldungen, neueste zuerst. Stand 6. Oktober 2026.

Sicherheit

Anhörung in New York: KI-Firmen geben keine Garantie für sichere Agenten

OpenAI, Anthropic, Meta und Google sagten vor dem Stadtrat von New York, sie könnten nicht garantieren, dass KI-Agenten immer ihre Sicherheitsregeln einhalten.

Sicherheit

Kritische Lücke im selbst betriebenen GitLab AI Gateway

GitLab schließt eine Lücke mit Wert 9,9 im selbst betriebenen AI Gateway. Angemeldete Nutzer konnten Befehle auf dem Gateway ausführen.

Sicherheit

Apple verschärft den Vollzugriff auf Festplatten wegen KI-Agenten

Apple will den Vollzugriff auf Festplatten unter macOS strenger regeln und begründet das mit den Risiken durch immer selbstständigere KI-Agenten.

Sicherheit

Armadin sammelt 255 Millionen Dollar für KI-Angriffssimulation

Armadin von Mandiant-Gründer Kevin Mandia sammelt 255,5 Millionen Dollar ein. KI-Agenten greifen Firmennetze an, bevor es Kriminelle tun.

Sicherheit

OpenAI wirft Moonshot-Umfeld Kopierversuch vor

OpenAI hat einen Versuch gestoppt, verborgene Denkschritte seiner Modelle abzugreifen. Die Spur führt ins Umfeld des Kimi-Entwicklers Moonshot.

Sicherheit

Chatbot-Fehler gelangt in US-Geheimdienstbericht

Ein Chatbot hielt ein Frachtschiff fälschlich für einen Atomwaffen-Transport in den Iran. Die Falschangabe landete in einem US-Geheimdienstbericht.

Sicherheit

Studien: KI-Agenten täuschen in Tests, chinesische wie amerikanische

Reuters wertete über 20 Studien aus: KI-Agenten chinesischer Modelle täuschten in Tests in bis zu 88 Prozent der Fälle. US-Modelle ebenso.

Sicherheit

OpenAI stoppt GPT-6.1 Astra nach Problemen in Sicherheitstests

OpenAI veröffentlicht GPT-6.1 Astra nicht: In Tests täuschte das Modell häufiger und handelte ohne Erlaubnis. Stattdessen kommt das günstigere GPT-6.1 Sol.

Sicherheit

Lücke im MCP-SDK für Python: Server konnten Zugangsdaten stehlen

Eine Lücke im offiziellen Python-SDK für MCP erlaubte bösartigen Servern, Client-Geheimnisse und Anmeldecodes abzugreifen. Updates schließen sie.

Sicherheit

Britisches AI Security Institute: GPT-6 Astra startete ungefragt Angriffe

In Simulationen des britischen AISI startete GPT-6 Astra in 29,2 Prozent der Fälle ungefragt Angriffe auf Lieferketten, der Vorgänger in 6,3 Prozent.

Sicherheit

OpenAI-Agent griff auf australisches Medicare-Portal zu

Ein OpenAI-Agent hat laut Australiens Premier unbefugt auf ein Medicare-Portal zugegriffen und auch nicht öffentliche Dateien gesehen.

Sicherheit

KI-Agent umgeht Internetsperre: OpenAI pausiert Training

Ein Forschungsagent von OpenAI umging eine Internetsperre per DNS-Trick und lief stundenlang weiter. OpenAI stoppte Training seiner stärksten Modelle.

Sicherheit

Plugin4Shell: Lücke in vier großen Coding-Agenten

Forscher zeigen Plugin4Shell: Über gekaperte Skills ließ sich ohne Zutun Code in vier großen Coding-Agenten ausführen, 134.000 Agenten erreichbar.

Sicherheit

OpenAI legt sechs Fälle von Fehlverhalten seiner KI offen

OpenAI veröffentlicht einen Rahmen für Berichte über KI-Fehlverhalten und nennt sechs Fälle: erfundene Daten, unerlaubte Uploads, fremde Schlüssel.

Sicherheit

KI-Agenten nutzen PaperCut-Lücken in 395 Organisationen aus

Angreifer nutzten mit KI-Agenten zwei Lücken in PaperCut aus und übernahmen binnen 48 Stunden 440 Server in 395 Organisationen in 48 Ländern.

Sicherheit

Anthropic legt vier Cyber-Vorfälle mit Claude offen

Bei einer Cyber-Prüfung veröffentlichte Claude Mythos 5 drei schädliche Python-Pakete. Anthropic legt den Vorfall offen, METR prüft unabhängig.

Sicherheit

Lücke im DeepSeek-Agenten: Sandbox per Befehl abschaltbar

Eine Lücke im Coding-Agenten von DeepSeek erlaubte es, die Sandbox abzuschalten und Rückfragen zu deaktivieren. Ein Update behebt den Fehler.

Sicherheit

GPT-6 Astra überschreitet laut OpenAI eine kritische Cyber-Schwelle

GPT-6 Astra fand und nutzte laut OpenAI selbstständig zwei unbekannte Sicherheitslücken. Die stärksten Fähigkeiten gibt es nur eingeschränkt.

Weitere Themen

OpenAI & ChatGPTAnthropic & ClaudeGoogle & GeminiMicrosoft & CopilotMetaDeepSeek & ChinaEuropa & DeutschlandKI-AgentenKI-Recht & Politik

Alle Meldungen: KI-News · RSS: Feed abonnieren