成立不到两月,这家具身团队展示了双足机器人端到端感控方案
具身智能初创公司共生知行展示双足人形机器人开卡丁车演示,采用端到端感控一体化模型 DPC,团队由多位具身智能顶会论文一作…
具身智能初创公司「共生知行」近日展示了其双足人形机器人驾驶卡丁车的视频。从上车、转向、油门控制到全程维持平衡,机器人依靠一套端到端感知—控制一体化方案完成。共生知行成立于 2026 年 6 月底,距公开演示时不到两个月。
团队背景:具身智能顶会一作密集组队
共生知行 CEO 丁鹏翔为浙江大学与西湖大学博士,其学术履历涵盖四足 VLA 模型 QUAR-VLA(ECCV 2024)、首个人形 VLA 模型 Humanoid-VLA(2025.02)、AAAI 2026 Best Paper 论文 ReconVLA,以及开源 VLA 项目 VLA-Adapter(一周内 GitHub Star 过千)。
据公司介绍,核心成员均为博士及 00 后,研究方向覆盖:
- 四足、机械臂、人形机器人基座模型;
- 跨本体全身操作模型 HEX(首个面向全尺寸双足人形机器人的 Whole-Body Manipulation Model);
- Loco-manipulation 领域 VLA 模型 Trajbooster;
- 人形遥操系统 OpenWBC;
- 以及 CoRL 最佳论文、IJCNN Best Paper Candidate 等成果。
公司表示,其成员覆盖了国际 Loco-manipulation 领域最前沿 5 篇工作中的 3 篇。该描述来自公司及 CEO 采访自述,未经第三方独立核实。
技术方向:打穿大脑与小脑的割裂
当前主流人形机器人方案普遍采用「大脑(感知、决策)+ 小脑(运动控制)」的分层架构。共生知行认为,这种分层会带来级联误差,且上层「大脑」难以获得下层「小脑」的动作反馈,导致任务效果受限。
公司发布的 DPC(Direct Perception Control Model,直接感控一体化模型)试图绕开分层:
- 输入:多模态感知数据(视觉、语言、机器人状态、物理信号);
- 中间层:统一感知控制模型,从视觉、语言、本体、历史反馈与接触反馈直接生成带力反馈的全身动作;
- 输出:全身协调的关节力矩,目标是实现「原生交互的全身具身智能」。
据公司自述,DPC 支持多源异构数据训练,无本体预训练算法仅需少量真实数据即可完成复杂全身协同操作,并能跨构型适配。
行业语境与待验证之处
需要指出的是,原文大量使用了营销化表述(多次出现「离谱」「不讲武德」等用词),并以「产业终局」「中国年轻一代引领世界」等定性结论作为叙事框架,而非给出可对比的 benchmark 数据或第三方评测。
就目前公开信息而言,以下几点尚待外部验证:
- 卡丁车演示的具体成功率、测试条件与可复现性;
- DPC 模型的参数规模、训练数据量与跨本体迁移实验细节;
- 与 Figure Helix、Pi0.5 等同类端到端方案在公开基准上的对比结果;
- 公司目前的融资、团队规模与商业落地规划。
文中关于「2026 年是双足人形端到端感控一体大脑窗口期,约 4–7 个月」的判断,来自 CEO 个人表态,属行业观点而非已验证事实。
小结
共生知行的演示展示了端到端全身控制在双足人形机器人上的一种可能路径,也反映了近期具身智能赛道「年轻学者下场组队」的人才结构变化。但作为一家成立不到两个月的初创公司,其技术成熟度与实际影响力仍需后续独立验证与公开基准支撑。
