Reka 推出 RekaDaily-10k 开源数据集,覆盖超 1 万小时第一人称视频
Reka 在 Hugging Face 以 Apache 2.0 协议开源 RekaDaily-10k 数据集,含原始与…
AI 公司 Reka 近日宣布,其面向物理 AI 与世界模型训练的大规模数据集 RekaDaily-10k 已经完成全部构建,并在 Hugging Face 平台以 Apache 2.0 协议开源。该数据集围绕第一人称视角(egocentric)视频设计,旨在为下一代具身智能与世界模型研究提供高质量的真实世界数据。
数据集规模与构成
RekaDaily-10k 包含两个层级的数据:
- 原始层(raw tier):总计 10,865 小时第一人称视角视频素材。
- 处理与字幕层(processed and captioned tier):10,200 小时、6,373,064 个视频片段,整体规模达到 74.2 TB,这是该层级首次完整公开。
两个版本均已同步上线 Hugging Face,研究者可直接下载使用,无需申请授权。
面向世界模型与具身智能
Reka 在发布中使用了 #PhysicalAI、#WorldModels、#EgocentricData 三个标签,凸显该数据集的核心定位:第一人称视角的长时间日常活动记录,是训练能够理解物理世界、预测场景演化的世界模型(world model)所需的关键素材。相比静态图像或短片段数据集,万小时量级的连续日常视频更接近人类获取世界知识的真实方式,对提升模型在物理一致性、动作预测与场景理解方面的能力具有潜在价值。
许可与使用方式
数据集采用 Apache 2.0 协议开源,允许商业使用、修改与再分发,仅需保留版权与许可声明。这一较为宽松的许可降低了学术界与产业团队的使用门槛。研究者可通过 Reka 的官方更新帖获取数据集说明与 Hugging Face 仓库链接。
行业意义与待观察点
RekaDaily-10k 的发布正值业界对世界模型与具身 AI 关注度持续上升的阶段。继 NVIDIA、Meta 等公司在相关方向投入之后,独立的万小时级第一人称视频数据集仍属稀缺资源。后续值得关注的是:
- 数据集在主流世界模型基线上的实际增益效果;
- 字幕标注的质量与多模态对齐粒度;
- 是否有配套的 benchmark 或评测协议同步发布。
对于正在构建物理 AI 与世界模型的研究团队而言,这是一个可直接接入训练流程的新选项。
