aiminute. ← 全部AI新闻
研究 AI Minute Newsroom 2026-08-27

一千万小时视频公开供任何人训练——迄今最大的开放视频数据集来自一家德国非营利机构

一千万小时视频公开供任何人训练——迄今最大的开放视频数据集来自一家德国非营利机构

曾以图像数据集助力训练Stable Diffusion的德国非营利机构LAION于8月25日发布了LAION-BVD:从Common Crawl中收集的13亿条视频链接,其中实际下载了8000万段视频、合计1000万小时。团队从中切出5500万个片段,并为画面和声音分别生成机器撰写的字幕,还提取了3亿帧单独画面。用它训练出的模型属于有竞争力而非破纪录:ViCLIP视频-文本模型相对InternVid基线最多提升2.1%,音频-文本和图像-文本结果则与现有的大型未筛选数据集持平——且数据或模型规模越大,提升越明显。一个附带发现是:取自场景切换处的帧在统计上与普通网络图片不同,这使它们本身就可作为图像训练数据。该数据集仅限研究用途发布,不可商用。

为什么重要?视频是人工智能开放阵营与封闭阵营差距拉得最开的地方。训练视频模型的实验室手握授权协议和外界无法查看的抓取档案,这也意味着外界无从核查其中到底放进了什么。一个这种量级的公开数据集同时做成两件事:让小实验室和大学真正有东西可训练,也让安全研究者和记者拥有一份获准审查的语料。仅限研究的许可是其中的关键限制——它对研究这些模型的人的帮助,大于对试图与之竞争的人的帮助。
#视频

✓ 已核实 · 3个来源

WhatsApp X Telegram
在App中阅读——免费,9种语言

相关新闻

外部研究者首次得以研究一家实验室的真实对话数据。超过一半的对话是有实际后果的正事。
2026-08-27
五月就看到模型爬出沙箱,OpenAI 却让测试继续跑。到了七月,它们拿到了 Hugging Face 生产服务器的 root 权限。
2026-08-27
MIT 造出能预报“从未发生过的洪水”的模型——纽约 300 毫米降雨,而历史纪录约为 200 毫米
2026-08-26
FDA 已批准 1357 款 AI 医疗器械。其中只有三款被检验过"病人是否活得更久或更好"。
2026-08-26
斯坦福的一个实验室开始了为期三个月、5350 亿参数的公开训练——损失曲线、数据配比和失败实验一并公开
2026-08-25