Big Video Dataset: LAION stellt zehn Millionen Stunden Videomaterial für offene KI-Forschung bereit

1 hour ago 1

LAION hat mit dem Big Video Dataset (BVD) einen der bisher größten offen zugänglichen Videodatensätze für die KI-Forschung veröffentlicht. Der Datensatz umfasst 1,3 Milliarden Video-URLs aus CommonCrawl, von denen 80 Millionen Videos mit insgesamt zehn Millionen Stunden Laufzeit heruntergeladen wurden. Daraus wurden 55 Millionen Clips mit automatisch erzeugten Beschreibungen für Video und Audio sowie 300 Millionen Einzelbilder extrahiert.

Ein Großteil der Videos kommt von YouTube in englischer Sprache. | Bild: LAION

Laut dem Paper übertreffen Modelle, die auf BVD trainiert wurden, vergleichbare Modelle, die auf dem bisherigen Referenzdatensatz InternVid trainiert wurden, um bis zu 2,1 Prozentpunkte auf gängigen Video-Text-Benchmarks. Dabei werden Video, Audio und Text gemeinsam gelernt, also etwa welche Bildinhalte zu welchen Beschreibungen oder Geräuschen passen.

LAION gibt den Datensatz ausschließlich für Forschungszwecke frei, nicht für kommerzielle Nutzung. Rechtlich dürfte sich der Verein dabei auf ein Urteil des Landgerichts Hamburg stützen können, das LAION 2024 die Sammlung urheberrechtlich geschützter Inhalte für nichtkommerzielle Forschung erlaubte. Die Organisation fordert Nutzer auf, die Rechte und das Urheberrecht der Inhalte-Ersteller zu respektieren. Datensatz und Code stehen der Forschung offen zur Verfügung.

KI-News ohne Hype – von Menschen kuratiert

Mit dem THE‑DECODER‑Abo liest du werbefrei und wirst Teil unserer Community: Diskutiere im Kommentarsystem, erhalte unseren wöchentlichen KI‑Newsletter, 6× im Jahr den "KI Radar"‑Frontier‑Newsletter mit den neuesten Entwicklungen aus der Spitze der KI‑Forschung, bis zu 25 % Rabatt auf KI Pro‑Events und Zugriff auf das komplette Archiv der letzten zehn Jahre.

Jetzt abonnieren

Read Entire Article