Sveriges mest populära poddar
Der KI-Podcast
Der KI-Podcast

Hacken KIs jetzt einfach ALLES, STÄNDIG, ÜBERALL?

46 min18 augusti 2026

Om avsnittet

OpenAIs ausgebrochene Hacking-KI schien vor einigen Wochen noch ein spektakulärer Einzelfall zu sein. Doch seitdem haben Anthropic und Meta ähnliche Vorfälle gemeldet.

OpenAIs ausgebrochene Hacking-KI schien vor einigen Wochen noch ein spektakulärer Einzelfall zu sein. Doch seitdem haben Anthropic und Meta ähnliche Vorfälle gemeldet, ein privater OpenClaw-Agent manipulierte die Warteliste eines Fitnessstudios und Taiwan berichtete von einem KI-gestützten Angriff auf Regierungsbehörden.

Marie und Fritz fragen: Stecken hinter all diesen Fällen neue, gefährliche Fähigkeiten der KI-Systeme? Wie funktioniert KI-Hacking überhaupt? Und warum erzählen die KI-Firmen so bereitwillig Geschichten darüber, wie löchrig ihre Sandkästen sind? 

Über die Hosts:

Marie Kilg ist Journalistin und KI-Expertin. Zuvor war sie Chief AI Officer bei der Deutschen Welle und Produkt-Managerin bei Amazon Alexa. Fritz Espenlaub ist freier Journalist und Ökonom. Neben „Der KI-Podcast“ hostet er auch „Die Peter Thiel Story“ und „Die OpenAI Story“ (DLF).

In dieser Folge:

00:00 Nach dem OpenAI-Hack: Plötzlich hat jeder eine Hacking-KI
02:25 Anthropic und Meta melden weitere Ausbrüche  
08:45 OpenClaw hackt die Warteliste eines Fitnessstudios  
12:10 Was unabhängige Sicherheitstests über die Modelle zeigen  
14:45 KI-Agenten greifen taiwanische Regierungsstellen an  
17:45 Wie hacken Sprachmodelle eigentlich?  
26:20 Echtes Sicherheitsrisiko oder erfolgreiche PR?  
34:55 Europas Problem mit den besten Cyber-KIs  
36:30 Was haben wir mit KI gemacht?

Podcast-Tipp der Woche: Die Großen Fragen in 10 Minuten
https://1.ard.de/DGF

Unsere erste Folge zum Angriff auf Hugging Face: „OpenAI vs HuggingFace: Hack oder Marketing?“
https://www.ardsounds.de/episode/urn:ard:episode:4aaa592c21402242/

Anthropic über drei reale Zwischenfälle bei seinen Cybersecurity-Tests
https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals

Meta bestätigt, dass ein Modell während eines Tests in die Systeme eines anderen Unternehmens eingedrungen ist
https://www.reuters.com/technology/metas-ai-model-hacked-another-company-during-testing-information-reports-2026-08-05/

Ein OpenClaw-Agent hackt die Buchungsseite eines australischen Fitnessstudios
https://www.abc.net.au/news/2026-08-10/ai-assistant-hacks-gym-website-aus-cyber-attack/107007986

Modelle von OpenAI und Anthropic greifen bei britischen Sicherheitstests zu falschen Identitäten und Phishing-Mails
https://www.theguardian.com/technology/2026/aug/05/openai-anthropic-models-went-rogue-cybersecurity-test-ai-security-institute

Taiwan meldet einen KI-gestützten Cyberangriff auf Regierungsstellen
https://www.theguardian.com/technology/2026/aug/13/taiwan-ai-assisted-cyber-attacks-overseas

Mistral will chinesische Open-Source-Modelle auf europäischer Infrastruktur anbieten
https://mistral.ai/news/regional-inference-open-models-new-compute/

So soll das unsichtbare Wasserzeichen in Claude-Texten funktionieren
https://www.anthropic.com/news/claude-text-watermark

Warum Hank Green nach der Kritik an seiner KI-Nutzung eigene Regeln aufgestellt hat
https://www.vox.com/future-perfect/498851/hank-green-ai-controversy-research

Redaktion und Mitarbeit: Fritz Espenlaub, Elisa Harlan, Marie Kilg, Franziska Kulczycki, Gudrun Riedl, Christian Schiffer, Gregor Schmalzried, Torsten Teichmann

Kontakt: [email protected]

Unterstützt uns: Wenn euch dieser Podcast gefällt, freuen wir uns über eine Bewertung auf eurer liebsten Podcast-Plattform. Abonniert den KI-Podcast in ARD Sounds oder wo immer ihr eure Podcasts hört, um keine Episode zu verpassen. Und empfehlt uns gerne weiter!

Der KI-Podcast med ARD finns tillgänglig på flera plattformar. Informationen på denna sida kommer från offentliga podd-flöden.