News

LAION stellt neues offenes Videodatenset für die KI-Forschung vor

LAION stellt neues offenes Videodatenset für die KI-Forschung vor

Das Wichtigste in Kürze

  • LAION hat das "Big Video Dataset" (LAION-BVD) veröffentlicht, ein umfangreiches offenes Videodatenset für die KI-Forschung.
  • Das Dataset umfasst 80 Millionen Videos mit einer Gesamtdauer von 10 Millionen Stunden, gesammelt aus 1,3 Milliarden URLs.
  • Es ist für multimodales Vortraining konzipiert und enthält Videoclips, Audiobeschreibungen und Standbilder.
  • Modelle, die mit LAION-BVD trainiert wurden, zeigen eine verbesserte Leistung bei Video-zu-Text-Benchmarks.
  • Die Nutzung ist auf nicht-kommerzielle Forschungszwecke beschränkt, basierend auf rechtlichen Präzedenzfällen in Deutschland.

LAION präsentiert umfangreiches offenes Videodatenset für die KI-Forschung

Die Organisation LAION (Large-scale Artificial Intelligence Open Network) hat mit der Veröffentlichung des "Big Video Dataset" (LAION-BVD) einen bedeutenden Beitrag zur Open-Science-Bewegung im Bereich der Künstlichen Intelligenz geleistet. Dieses neue Datenset stellt eine der größten öffentlich zugänglichen Sammlungen von Videomaterial dar, die speziell für die Forschung und Entwicklung multimodaler KI-Modelle konzipiert wurde. Es bietet Forschenden eine bisher unerreichte Datengrundlage zur Weiterentwicklung von Systemen, die Video, Audio und Text miteinander verknüpfen können.

Umfang und Zusammensetzung des Datensets

LAION-BVD ist das Ergebnis eines umfassenden Sammelprozesses. Ausgangspunkt waren 1,3 Milliarden Video-URLs, die aus dem CommonCrawl-Archiv extrahiert wurden. Aus dieser riesigen Menge wurden 80 Millionen Videos heruntergeladen, was einer Gesamtspielzeit von 10 Millionen Stunden entspricht. Dieses Rohmaterial wurde anschließend weiterverarbeitet:

  • Es wurden 55 Millionen einzelne Videoclips extrahiert.
  • Für jeden Clip wurden automatisch generierte Beschreibungen des visuellen Inhalts sowie der Audiospur erstellt.
  • Zusätzlich umfasst das Datenset 300 Millionen Standbilder, die aus den Videosequenzen gewonnen wurden.

Die Mehrheit der im Datenset enthaltenen Videos stammt von Plattformen wie YouTube und ist überwiegend in englischer Sprache verfügbar. Diese Zusammensetzung beeinflusst die Anwendungsbereiche und die kulturelle Ausrichtung der damit trainierten Modelle.

Multimodales Training und Leistungsverbesserungen

Das primäre Ziel von LAION-BVD ist das multimodale Vortraining von KI-Modellen. Dies bedeutet, dass Modelle lernen sollen, Zusammenhänge zwischen verschiedenen Datenmodalitäten – in diesem Fall Video, Audio und Text – herzustellen. Ein solches Training ermöglicht es KI-Systemen, komplexe Inhalte besser zu verstehen und zu interpretieren, indem sie visuelle Informationen mit begleitenden Geräuschen und beschreibendem Text verbinden.

Erste Evaluierungen zeigen vielversprechende Ergebnisse. Modelle, die mit LAION-BVD trainiert wurden, haben bei gängigen Video-zu-Text-Benchmarks eine verbesserte Leistung erzielt. Berichten zufolge übertreffen sie vergleichbare Modelle, die mit anderen Datensätzen wie InternVid trainiert wurden, um bis zu 2,1 Prozentpunkte. Diese Leistungssteigerung unterstreicht das Potenzial von LAION-BVD als Trainingsgrundlage für fortschrittliche KI-Anwendungen im Bereich der Videoanalyse und -generierung.

Rechtliche Rahmenbedingungen und Nutzungsbeschränkungen

Die Bereitstellung eines derart umfangreichen Datensets, das aus öffentlich zugänglichen Quellen gesammelt wurde, wirft regelmäßig Fragen bezüglich Urheberrecht und Datennutzung auf. LAION hat das Datenset explizit für nicht-kommerzielle Forschungszwecke freigegeben. Diese Einschränkung basiert auf einer juristischen Einschätzung, die sich unter anderem auf ein Urteil des Landgerichts Hamburg aus dem Jahr 2024 stützt. Dieses Urteil erlaubte LAION das Sammeln urheberrechtlich geschützter Inhalte für nicht-kommerzielle Forschungszwecke.

LAION fordert alle Nutzer des Datensets dazu auf, die Rechte der ursprünglichen Inhaltsersteller zu respektieren. Die Verfügbarkeit des Datensets und des zugehörigen Codes auf Plattformen wie GitHub unterstreicht den Open-Science-Ansatz der Organisation, wobei die spezifischen Nutzungsbedingungen beachtet werden müssen.

Bedeutung für die KI-Landschaft

Die Veröffentlichung von LAION-BVD ist ein signifikanter Schritt für die globale KI-Forschungsgemeinschaft. In einer Zeit, in der viele große KI-Labore ihre Trainingsdaten proprietär halten, fördert LAION mit diesem offenen Datenset Transparenz und Zugänglichkeit. Es ermöglicht einem breiteren Kreis von Forschenden, an der Entwicklung und Verbesserung multimodaler KI-Modelle zu arbeiten, was potenziell zu schnelleren Innovationen und einer demokratischeren Entwicklung im Bereich der Künstlichen Intelligenz führen kann.

Für Unternehmen, die im B2B-Bereich tätig sind und KI-Lösungen entwickeln oder anwenden, bietet die Existenz solcher Datensätze indirekt Vorteile. Sie beschleunigen die Grundlagenforschung, aus der später kommerziell nutzbare Technologien entstehen können. Die verbesserte Fähigkeit von KI-Modellen, Video-, Audio- und Textdaten zu verknüpfen, wird zukünftig Anwendungen in Bereichen wie Content-Analyse, automatisierte Medienproduktion, Sicherheitsüberwachung und interaktive Systeme maßgeblich beeinflussen.

Fazit

LAION-BVD stellt eine wertvolle Ressource dar, die das Potenzial hat, die Forschung im Bereich des multimodalen maschinellen Lernens erheblich voranzutreiben. Die Kombination aus Umfang, Vielfalt und der expliziten Ausrichtung auf Forschungszwecke macht es zu einem wichtigen Baustein für die nächste Generation von KI-Systemen, die ein tieferes Verständnis unserer komplexen audiovisuellen Welt entwickeln können.

Bibliographie

- Hochlehnert, A., et al. (2026). LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training. arXiv preprint arXiv:2608.24845. - LAION. (n.d.). LAION Big Video Dataset. Verfügbar unter: https://projects.laion.ai/bvd/ - Bastian, M. (2026). LAION drops massive open video dataset with 10 million hours of footage for AI research. The Decoder. Verfügbar unter: https://the-decoder.com/laion-drops-massive-open-video-dataset-with-10-million-hours-of-footage-for-ai-research/ - Petersen, B. (2026). LAION Releases 10M-Hour Video Dataset for AI. AI Daily Post. Verfügbar unter: https://aidailypost.com/news/laion-releases-10-million-hour-video - Superpower Daily Editorial Desk. (2026). LAION Releases 10-Million-Hour Video Corpus for Research, Excluding Commercial Use. Superpower Daily. Verfügbar unter: https://superpowerdaily.com/posts/laion-releases-10-million-hour-video-corpus-for-research-excluding-commercial-use

KI, die in Deutschland zu Hause ist.

Testen Sie Mindverse Studio oder sprechen Sie mit unserem Team über Ihren Anwendungsfall.