[{"data":1,"prerenderedAt":30},["ShallowReactive",2],{"nr-de-laion-80-millionen-videos-ki-forschung":3},{"slug":4,"title":5,"dek":6,"date":7,"time":8,"publishedAt":9,"updated":10,"updatedAt":10,"dateFmt":11,"updatedFmt":10,"kind":12,"tier":13,"author":14,"authorName":15,"topics":16,"tracker":22,"trackerLabel":23,"headlineStat":24,"image":25,"ogImage":26,"imageAlt":5,"csv":10,"minutes":27,"words":28,"html":29},"laion-80-millionen-videos-ki-forschung","LAION veröffentlicht 80 Millionen Videos für offene KI-Forschung","Mit dem Big Video Dataset stellt LAION einen der größten offenen Videodatensätze bereit – zehn Millionen Stunden Material für KI-Labs weltweit.","2026-08-29","13:31","2026-08-29T13:31:00+02:00","","29. August 2026","news","standard","ideal-syka","Ideal Syka",[17,18,19,20,21],"Open-Source-KI","Videodatensätze","KI-Forschung","LAION","Urheberrecht","\u002Fstand-der-ki","Fortschritt an der KI-Front","80 Millionen Videos, zehn Millionen Stunden","\u002Fnewsroom\u002Fimg\u002Flaion-80-millionen-videos-ki-forschung.webp","\u002Fog-nr\u002Flaion-80-millionen-videos-ki-forschung.de.png",2,404,"\u003Cp>LAION hat das \u003Cstrong>Big Video Dataset (BVD)\u003C\u002Fstrong> veröffentlicht und damit eine der bisher größten frei zugänglichen Videodatenbanken für KI-Forschung geschaffen. Das Ausmaß ist beeindruckend: \u003Cstrong>80 Millionen Videos\u003C\u002Fstrong> mit insgesamt \u003Cstrong>zehn Millionen Stunden\u003C\u002Fstrong> Laufzeit, aus denen \u003Cstrong>55 Millionen Clips\u003C\u002Fstrong> mit automatisch generierten Beschreibungen extrahiert wurden. Hinzu kommen \u003Cstrong>300 Millionen Einzelbilder\u003C\u002Fstrong>. Der Datensatz wird Forschern weltweit zur Verfügung gestellt und ermöglicht es ihnen, Video-Sprachmodelle zu trainieren.\u003C\u002Fp>\n\u003Ch2>Kurz &amp; knapp\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Cstrong>80 Millionen Videos\u003C\u002Fstrong> aus 1,3 Milliarden URLs (hauptsächlich von YouTube, englischsprachig)\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Leistungsvorteil\u003C\u002Fstrong>: Modelle auf BVD trainiert übertreffen bisherigen Referenzdatensatz InternVid um bis zu \u003Cstrong>2,1 Prozentpunkte\u003C\u002Fstrong>\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Rechtliche Basis\u003C\u002Fstrong>: Hamburger Urteil von 2024 erlaubt LAION die Sammlung urheberrechtlich geschützter Inhalte für nichtkommerzielle Forschung\u003C\u002Fli>\n\u003Cli>\u003Cstrong>Zugang\u003C\u002Fstrong>: Kostenlos für Forschung verfügbar, kommerzielle Nutzung ausgeschlossen\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Ch2>Wie das Training funktioniert\u003C\u002Fh2>\n\u003Cp>Das Besondere am BVD ist der multimodale Ansatz: Die Modelle lernen gleichzeitig aus \u003Cstrong>Video, Audio und Text\u003C\u002Fstrong>. Das System versteht also nicht nur, welche Bildinhalte zu welchen Beschreibungen passen, sondern auch, welche Geräusche und Musik dazu gehören. Diese Kombination führt zu den gemessenen Leistungssteigerungen auf Standard-Benchmarks für Video-Text-Aufgaben.\u003C\u002Fp>\n\u003Ch2>Rechtliche Gratwanderung\u003C\u002Fh2>\n\u003Cp>LAION bewegt sich hier in einem sensiblen Bereich. Der Verein stützt sich auf ein \u003Cstrong>Urteil des Landgerichts Hamburg aus 2024\u003C\u002Fstrong>, das die Sammlung urheberrechtlich geschützter Inhalte für nichtkommerzielle Forschung erlaubt. Das ist eine wichtige Precedenz für Open-Source-KI in Deutschland und Europa – allerdings auch umstritten. LAION fordert Nutzer ausdrücklich auf, &quot;die Rechte und das Urheberrecht der Inhalte-Ersteller zu respektieren&quot;. Ob diese rechtliche Position vor höheren Instanzen oder bei kommerziellen Anwendungen hält, bleibt offen.\u003C\u002Fp>\n\u003Ch2>Was das für deutsche Forschung bedeutet\u003C\u002Fh2>\n\u003Cp>Für deutsche und europäische KI-Labs ist das BVD ein strategischer Gewinn. Bislang waren große Videodatensätze für das Training von Video-Sprachmodellen schwer zugänglich – wer nicht bei OpenAI, Google oder anderen US-Konzernen arbeitet, war auf kleinere oder lizenzierte Datenquellen angewiesen. Mit BVD können Universitäten, Forschungsinstitute und auch europäische Startups nun an der Frontier von Video-KI-Modellen arbeiten, ohne von proprietären APIs abhängig zu sein. Das ist besonders relevant für Anwendungen in Medizin, Industrie 4.0 oder Barrierefreiheit, wo europäische Datenschutzstandards und lokale Anforderungen zählen.\u003C\u002Fp>\n\u003Cp>Allerdings: Der Datensatz ist hauptsächlich englischsprachig und von YouTube geprägt. Wer deutsche oder europäische Inhalte trainieren möchte, wird zusätzliche Quellen brauchen. Auch die Frage, wie lange die rechtliche Basis hält, wenn kommerzielle Anwendungen entstehen, bleibt relevant für die Langzeitplanung von Forschungsprojekten.\u003C\u002Fp>\n\u003Ch2>Quellen\u003C\u002Fh2>\n\u003Cul>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fthe-decoder.de\u002Fbig-video-dataset-laion-stellt-zehn-millionen-stunden-videomaterial-fuer-offene-ki-forschung-bereit\u002F\">The Decoder (DE)\u003C\u002Fa>\u003C\u002Fli>\n\u003Cli>\u003Ca href=\"https:\u002F\u002Fthe-decoder.com\u002Flaion-drops-massive-open-video-dataset-with-10-million-hours-of-footage-for-ai-research\u002F\">The Decoder\u003C\u002Fa>\u003C\u002Fli>\n\u003C\u002Ful>\n\u003Cp>\u003Cem>Redaktionell verantwortet von \u003Ca href=\"\u002Fautor\u002Fideal-syka\">Ideal Syka\u003C\u002Fa>. Quellen und Arbeitsweise: \u003Ca href=\"\u002Fredaktion\">Redaktion &amp; Methode\u003C\u002Fa>. Hinweise und Korrekturen: \u003Ca href=\"mailto:ai@i6eal.de\">ai@i6eal.de\u003C\u002Fa>.\u003C\u002Fem>\u003C\u002Fp>\n",1788003440960]