桃子桃子快讯
返回首页
开源

Reka 推出 RekaDaily-10k 开源数据集,覆盖超 1 万小时第一人称视频

Reka 在 Hugging Face 以 Apache 2.0 协议开源 RekaDaily-10k 数据集,含原始与…

2026.09.17 · 周四2 分钟阅读

AI 公司 Reka 近日宣布,其面向物理 AI 与世界模型训练的大规模数据集 RekaDaily-10k 已经完成全部构建,并在 Hugging Face 平台以 Apache 2.0 协议开源。该数据集围绕第一人称视角(egocentric)视频设计,旨在为下一代具身智能与世界模型研究提供高质量的真实世界数据。

数据集规模与构成

RekaDaily-10k 包含两个层级的数据:

  • 原始层(raw tier):总计 10,865 小时第一人称视角视频素材。
  • 处理与字幕层(processed and captioned tier):10,200 小时、6,373,064 个视频片段,整体规模达到 74.2 TB,这是该层级首次完整公开。

两个版本均已同步上线 Hugging Face,研究者可直接下载使用,无需申请授权。

面向世界模型与具身智能

Reka 在发布中使用了 #PhysicalAI、#WorldModels、#EgocentricData 三个标签,凸显该数据集的核心定位:第一人称视角的长时间日常活动记录,是训练能够理解物理世界、预测场景演化的世界模型(world model)所需的关键素材。相比静态图像或短片段数据集,万小时量级的连续日常视频更接近人类获取世界知识的真实方式,对提升模型在物理一致性、动作预测与场景理解方面的能力具有潜在价值。

许可与使用方式

数据集采用 Apache 2.0 协议开源,允许商业使用、修改与再分发,仅需保留版权与许可声明。这一较为宽松的许可降低了学术界与产业团队的使用门槛。研究者可通过 Reka 的官方更新帖获取数据集说明与 Hugging Face 仓库链接。

行业意义与待观察点

RekaDaily-10k 的发布正值业界对世界模型与具身 AI 关注度持续上升的阶段。继 NVIDIA、Meta 等公司在相关方向投入之后,独立的万小时级第一人称视频数据集仍属稀缺资源。后续值得关注的是:

  • 数据集在主流世界模型基线上的实际增益效果;
  • 字幕标注的质量与多模态对齐粒度;
  • 是否有配套的 benchmark 或评测协议同步发布。

对于正在构建物理 AI 与世界模型的研究团队而言,这是一个可直接接入训练流程的新选项。

信源