aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-27

一千万小时视频公开供任何人训练——迄今最大的开放视频数据集来自一家德国非营利机构

一千万小时视频公开供任何人训练——迄今最大的开放视频数据集来自一家德国非营利机构

曾以图像数据集助力训练Stable Diffusion的德国非营利机构LAION于8月25日发布了LAION-BVD:从Common Crawl中收集的13亿条视频链接,其中实际下载了8000万段视频、合计1000万小时。团队从中切出5500万个片段,并为画面和声音分别生成机器撰写的字幕,还提取了3亿帧单独画面。用它训练出的模型属于有竞争力而非破纪录:ViCLIP视频-文本模型相对InternVid基线最多提升2.1%,音频-文本和图像-文本结果则与现有的大型未筛选数据集持平——且数据或模型规模越大,提升越明显。一个附带发现是:取自场景切换处的帧在统计上与普通网络图片不同,这使它们本身就可作为图像训练数据。该数据集仅限研究用途发布,不可商用。

为什么重要?视频是人工智能开放阵营与封闭阵营差距拉得最开的地方。训练视频模型的实验室手握授权协议和外界无法查看的抓取档案,这也意味着外界无从核查其中到底放进了什么。一个这种量级的公开数据集同时做成两件事:让小实验室和大学真正有东西可训练,也让安全研究者和记者拥有一份获准审查的语料。仅限研究的许可是其中的关键限制——它对研究这些模型的人的帮助,大于对试图与之竞争的人的帮助。
#视频

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

Odyssey开放了能在浏览器里操控的世界模型。
2026-10-11
尼康因生成式AI取消了一段显微视频的冠军。
2026-10-11
没有一个人工智能模型能重新想出人类一月发表的方法。
2026-10-11
OpenAI的评分模型为了换新环境,把自己的环境毁了。
2026-10-11
新的全天紫外线地图有三分之一是预测出来的
2026-10-10