LAION、AI研究向け1000万時間の動画データセット「BVD」を公開
本文の状態
日本語全文を表示中
詳細モードで約1分の本文を読めます。
同じ出来事の情報源
この情報源を基点に整理
The Decoder
LAION が AI 研究向けに 8000 万本、1000 万時間の映像を含む大規模オープンデータセット「Big Video Dataset」を公開し、既存ベンチマークを上回る性能を示した。
AI深層分析を開く2026年8月29日 19:15
AI深層分析
キーポイント
大規模なデータセットの公開
LAION は AI 研究用のオープンデータセット「Big Video Dataset (BVD)」を発表し、8000 万本の動画、1000 時間の再生時間、5500 万個の自動記述クリップを含む。
性能ベンチマークでの優位性
BVD で訓練されたモデルは、以前のベンチマークである InternVid を最大 2.1 パーセントポイント上回る性能を記録したと報告されている。
法的根拠の明確化
LAION は非営利研究目的での著作権素材収集を認める 2024 年のハンブルク裁判所の判決を根拠として、法的リスクへの対応を示している。
重要な引用
Models trained on BVD beat the previous benchmark, InternVid, by up to 2.1 percentage points.
LAION can likely point to a 2024 Hamburg court ruling that allows collecting copyrighted content for non-commercial research.
編集コメントを表示
編集コメント
このデータセットは、動画生成や理解タスクにおける研究の加速に寄与する重要なインフラとなる。法的な裏付けが明確化されたことで、研究者が著作権問題を懸念せず大規模実験を行える環境が整ったと言える。
Source Article
元記事を日本語で読む
本文に関係しない購読案内、埋め込み通知、サイト内プロモーションは除いています。

LAION が公開した大規模動画データセット「Big Video Dataset (BVD)」は、AI 研究用のオープンデータセットとして最大級の規模を誇ります。8000 万本の動画と 1000 万時間の再生時間、そして 5500 万件の自動生成されたクリップが含まれています。
この BVD で学習させたモデルは、既存のベンチマークである InternVid を最大で 2.1 ポイント上回る性能を達成しました。法的な観点からは、LAION は非営利目的の研究のために著作権のあるコンテンツを収集することを認めた 2024 年のハンブルク裁判所の判決に基づき、このデータセットの公開が可能であると判断しています。
本記事「LAION が AI 研究向けに 1000 万時間の映像を含む大規模オープン動画データセットを公開」は、The Decoder にて最初に掲載されました。
関連記事
今日のまとめ
AIデイリーブリーフで今日の重要ニュースをまとめ読み