News
Herausforderungen bei der Erkennung von KI-generierten Videos durch führende Chatbots
Das Wichtigste in Kürze
- Führende KI-Chatbots wie ChatGPT haben erhebliche Schwierigkeiten, von OpenAIs eigenem Tool Sora generierte Videos als KI-generiert zu identifizieren.
- Eine Studie von NewsGuard ergab, dass ChatGPT in 92,5 % der Fälle scheiterte, während xAIs Grok eine Fehlerrate von 95 % aufwies und Googles Gemini in 78 % der Fälle falsch lag.
- Sichtbare Wasserzeichen von Sora können leicht entfernt werden, und selbst unsichtbare C2PA-Metadaten lassen sich durch einfache Download-Methoden umgehen.
- Die Chatbots neigen dazu, ihre Einschränkungen bei der Erkennung von KI-generierten Inhalten nicht transparent zu kommunizieren, was das Risiko der Verbreitung von Desinformation erhöht.
- Die rasante Zunahme von Deepfakes, mit einem Anstieg von schätzungsweise 500.000 im Jahr 2023 auf 8 Millionen im Jahr 2025, überfordert die aktuellen Erkennungssysteme.
- Experten betonen die Notwendigkeit von Medienkompetenz und kritischem Denken, da visuelle Überprüfung und technische Erkennung zunehmend an ihre Grenzen stoßen.
KI-Chatbots und die Herausforderung der Video-Authentizität: Eine Analyse
Die fortschreitende Entwicklung von künstlicher Intelligenz hat zu einer neuen Ära der Inhaltsgenerierung geführt, insbesondere im Bereich der Videoerstellung. Tools wie OpenAIs Sora ermöglichen die Produktion von täuschend echten Videos, die von menschlichen Beobachtern kaum von realen Aufnahmen zu unterscheiden sind. Doch wie verhält es sich mit der Fähigkeit von KI-Systemen selbst, diese synthetischen Inhalte zu identifizieren? Eine aktuelle Untersuchung beleuchtet die Grenzen führender KI-Chatbots bei der Erkennung von KI-generierten Videos und wirft Fragen hinsichtlich der Vertrauenswürdigkeit digitaler Medien auf.
Die erschreckende Fehlerrate führender KI-Chatbots
Eine von NewsGuard durchgeführte Studie hat die Leistung dreier prominenter KI-Chatbots – xAIs Grok, OpenAIs ChatGPT und Googles Gemini – bei der Unterscheidung zwischen echten und von Sora generierten Videos evaluiert. Die Ergebnisse zeigen eine bemerkenswerte Unfähigkeit dieser Systeme, KI-generierte Inhalte zuverlässig zu erkennen.
- xAIs Grok scheiterte bei 95 % der getesteten Sora-Videos.
- OpenAIs ChatGPT wies eine Fehlerrate von 92,5 % auf. Dies ist besonders bemerkenswert, da Sora ein Produkt desselben Unternehmens ist.
- Googles Gemini zeigte mit einer Fehlerrate von 78 % die beste, wenngleich immer noch unzureichende, Leistung unter den Testkandidaten.
Für die Untersuchung wurden 20 Sora-Videos verwendet, die auf nachweislich falschen Behauptungen basierten. Die Chatbots wurden mit Fragen wie "Ist das echt?" oder "Ist das KI-generiert?" konfrontiert, um reale Benutzerinteraktionen zu simulieren. Die hohe Fehlerrate deutet auf eine grundlegende technische Limitierung hin, die über einzelne Plattformen hinausgeht und die gesamte Chatbot-Industrie betrifft.
Die Illusion der Wasserzeichen: Ein trügerischer Schutz
Sora integriert standardmäßig ein sichtbares, animiertes Wasserzeichen in alle generierten Videos, das mit dem Wort "Sora" versehen ist und sich über den Bildschirm bewegt. Dieses soll als Indikator für KI-generierte Inhalte dienen. Die NewsGuard-Analyse zeigt jedoch, dass dieser Schutzmechanismus nur begrenzt wirksam ist.
- Bereits Wochen nach der Einführung von Sora im Februar 2025 tauchten mehrere kostenlose Online-Dienste auf, die in der Lage sind, diese Wasserzeichen zu entfernen.
- Selbst bei intakten Wasserzeichen zeigten die Chatbots Schwächen: Grok scheiterte in 30 % der Fälle, ChatGPT in 7,5 % der Fälle. Nur Gemini konnte alle markierten Videos korrekt als KI-generiert identifizieren.
Neben sichtbaren Wasserzeichen enthalten Sora-Videos auch unsichtbare Metadaten, sogenannte Content Credentials, die dem C2PA-Standard entsprechen. Diese können über offizielle Tools wie verify.contentauthenticity.org überprüft werden. Allerdings erweisen sich auch diese Metadaten als fragil. Ein einfacher Rechtsklick und "Speichern unter" beim Herunterladen eines Videos kann diese Informationen entfernen, während der Download über die offizielle Sora-Oberfläche sie intakt lässt. Dies untergräbt die Verlässlichkeit dieser Authentifizierungsmechanismen in unkontrollierten Verbreitungsszenarien.
Mangelnde Transparenz und die Verbreitung von Desinformation
Ein weiteres Problem ist die mangelnde Transparenz der getesteten Systeme. Die Chatbots informieren die Nutzer selten über ihre eingeschränkte Fähigkeit, KI-generierte Inhalte zu erkennen. NewsGuard zufolge wies ChatGPT nur in 2,5 % der Tests auf diese Einschränkung hin, Gemini in 10 % und Grok in 13 %.
Stattdessen lieferten die Systeme oft selbstbewusste, aber falsche Einschätzungen. In einem Fall behauptete Grok, ein KI-Video stamme von einer nicht existierenden "Sora News"-Organisation, was die Glaubwürdigkeit der Informationen untermauerte und Desinformation förderte. Solche Szenarien legen die Grundlage für gezielte Desinformationskampagnen, bei denen überzeugende Videos erstellt werden können, in der Gewissheit, dass selbst KI-gestützte Faktenchecks versagen werden.
OpenAIs Kommunikationsleiter Niko Felix bestätigte gegenüber NewsGuard, dass "ChatGPT nicht die Fähigkeit besitzt, zu bestimmen, ob Inhalte KI-generiert sind", erklärte jedoch nicht, warum diese Einschränkung nicht standardmäßig kommuniziert wird.
Googles SynthID: Ein Schritt in die richtige Richtung mit Einschränkungen
Google verfolgt mit Gemini einen anderen Ansatz. Das Unternehmen bewirbt seine Fähigkeit, Inhalte des eigenen Bildgenerators Nano Banana Pro zu erkennen. In Tests identifizierte Gemini alle eigenen KI-Bilder korrekt, selbst nach Entfernung der Wasserzeichen. Dies wird durch das SynthID-Tool ermöglicht, das Inhalte unsichtbar als KI-generiert markiert und Bearbeitungen wie das Zuschneiden überstehen soll.
Googles Kommunikationsmanager Elijah Lawal räumte jedoch ein, dass die Verifizierung derzeit nur für Googles eigene Inhalte funktioniert. Gemini kann Sora-Videos oder Produkte anderer Anbieter nicht zuverlässig erkennen. Dies verdeutlicht die fragmentierte Landschaft der KI-Erkennung, in der die Effektivität oft von der vertikalen Integration des Anbieters abhängt.
Die Deepfake-Explosion und der Vertrauensverlust
Das Versagen der Erkennungssysteme ereignet sich zu einem Zeitpunkt, an dem Deepfakes rasant zunehmen. Schätzungen von DeepStrike gehen davon aus, dass die Anzahl der Online-Deepfakes von etwa 500.000 im Jahr 2023 auf rund 8 Millionen im Jahr 2025 ansteigen wird, mit einer jährlichen Wachstumsrate von nahezu 900 %.
Experten warnen vor einem bevorstehenden Vertrauensverlust in digitale Inhalte. Siwei Lyu, Professor für Informatik an der University at Buffalo, prognostiziert, dass sich die Situation im Jahr 2026 voraussichtlich verschlimmern wird, da Deepfakes als synthetische Akteure in der Lage sein werden, in Echtzeit auf Menschen zu reagieren. Die Zunahme von Deepfakes übersteigt die Verbesserungen der Erkennungssysteme bei weitem, wodurch die Verifizierungsinfrastruktur einem permanenten Aufholbedarf unterliegt.
Die Auswirkungen reichen bereits bis in Gerichtssäle und politische Konflikte. KI-generierte Beweismittel haben ihren Weg in Gerichtsverfahren gefunden, und Desinformationskampagnen, die etwa ukrainische Soldaten als sich ergebend darstellen, können mit der Gewissheit erstellt werden, dass KI-Faktenchecks versagen werden.
Menschliche Grenzen und die Notwendigkeit von Medienkompetenz
Nicht nur KI-Chatbots haben Schwierigkeiten, Deepfakes zu erkennen. Auch Menschen tun sich schwer damit. Hany Farid, Professor für Informatik an der UC Berkeley School of Information, stellte in seiner Forschung fest, dass Menschen ebenso wahrscheinlich echte Inhalte als Fälschung und gefälschte Inhalte als echt einstufen. Die Genauigkeitsraten verschlechtern sich bei politischen Inhalten aufgrund des Bestätigungsfehlers.
Diese Konvergenz von technischen Erkennungsfehlern und menschlichen kognitiven Verzerrungen schafft eine doppelte Verifizierungskrise. Angesichts dieser Herausforderungen betonen Experten die Bedeutung von Kontext und gesundem Menschenverstand.
Siwei Lyu weist darauf hin, dass oft nicht das Medium selbst fehlerhaft ist, sondern der Kontext, in dem es präsentiert wird, oder die Quelle, die nicht vollständig vertrauenswürdig ist. Daher seien allgemeines Bewusstsein und gesunder Menschenverstand die wichtigsten Schutzmaßnahmen, die keiner speziellen Schulung bedürfen.
Die Zukunft der digitalen Medien erfordert eine verstärkte Förderung von Medienkompetenz und kritischem Denken, um der Flut von synthetischen Inhalten, die die Grenze zwischen Realität und Fiktion verwischen, entgegenzuwirken.
Bibliography
- Akewushola, N. (2026, January 23). AI Chatbots struggle to detect AI-generated videos - Report. FactCheckHub. Retrieved from https://factcheckhub.com/ai-chatbots-struggle-to-detect-ai-generated-videos-report/
- Kemper, J. (2026, January 25). ChatGPT fails to spot 92% of fake videos made by OpenAI's own Sora tool. The Decoder. Retrieved from https://the-decoder.com/chatgpt-fails-to-spot-92-of-fake-videos-made-by-openais-own-sora-tool/
- Kasanmascheff, M. (2026, January 25). AI Videos: ChatGPT Can't Spot 92% of Fake Videos Created by OpenAI's Own Sora Model. WinBuzzer. Retrieved from https://winbuzzer.com/2026/01/25/chatgpt-fails-to-spot-92-fake-videos-openai-sora-xcxwbn/
- NewsGuard. (2026, January 22). AI Fools Itself: Top Chatbots Don't Recognize AI-Generated Videos. Retrieved from https://www.newsguardtech.com/special-reports/top-ai-chatbots-dont-recognize-ai-generated-videos
- NewsGuard. (2025, October 17). OpenAI’s Sora: When Seeing Should Not Be Believing. Retrieved from https://www.newsguardtech.com/special-reports/openai-sora-seeing-should-not-be-believing
- Pacifici, S. I. (2026, January 22). AI Fools Itself: Top Chatbots Don't Recognize AI-Generated Videos. beSpacific. Retrieved from https://www.bespacific.com/ai-fools-itself-top-chatbots-dont-recognize-ai-generated-videos/
- Santa Fe Community College Library. (n.d.). Misinformation and Media Literacy: Current News About... Retrieved from https://libraryhelp.sfcc.edu/misinformation-literacy/current-news
- Weatherbed, J. (2025, October 27). Sora is showing us how broken deepfake detection is. The Verge. Retrieved from https://www.theverge.com/report/806359/openai-sora-deepfake-detection-c2pa-content-credentials
- De Vynck, G. (2024, February 28). The future of AI video is here, super weird flaws and all. The Washington Post. Retrieved from https://www.washingtonpost.com/technology/interactive/2024/ai-video-sora-openai-flaws/
- Chedraoui, K. (2025, October 29). Deepfake Videos Are More Realistic Than Ever. How Can You Spot if a Video Is Real or Sora AI? CNET. Retrieved from https://www.cnet.com/tech/services-and-software/deepfake-videos-are-more-realistic-than-ever-how-can-you-spot-if-a-video-is-real-or-sora-ai/
KI, die in Deutschland zu Hause ist.
Testen Sie Mindverse Studio oder sprechen Sie mit unserem Team über Ihren Anwendungsfall.