桃子桃子快讯
返回首页
行业动态

卡帕西用 Opus 5 生成《魔戒》3D 交互世界

Karpathy 输入《魔戒》首段与百万 token 预算,Opus 5 耗时 2 小时写出 5500 行 Three.…

2026.08.02 · 周日2 分钟阅读

知名 AI 研究者、前特斯拉 AI 总监 Andrej Karpathy 近日在 X 平台分享了一项个人实验:他向大模型 Opus 5 输入托尔金《指环王》开篇段落,并给出约 100 万 token(折合约 10 美元)的预算,要求其用 Three.js 渲染出可交互漫游的场景。模型最终耗时约 2 小时,自主写出了 5500 行代码,以过程化方式逐步构建出故事对应的画面。Karpathy 用「有些粗糙但很有趣」形容最终效果,认为模型需要自行决定在 (x, y, z) 坐标中如何摆放并调度各类多边形素材,还要编写动画逻辑,本身就是一件「让人有点难以置信」的事。

为什么这件事有意思

Karpathy 强调,这一任务恰好展现了 LLM 与人类创作者的不同:正常情况下,没有人会愿意花时间写如此高度定制化的内容;但 LLM 拥有「无限的耐心和体力」,于是「从来没人会做的事」变成了「反正免费,何不试试」。他由此延伸出一个更大的想象:未来用户可以让模型按需生成高度定制化的虚拟世界,扮演旁观者 NPC、原著角色,或参与特定剧情,「有点像一次性的 GTA」——只要给一段提示,就能得到一个可以走进去的 X 世界。

当前的明显短板

Karpathy 同时指出,游戏/世界生成场景暴露了 LLM 的一个弱点:模型缺乏高效、原生感知视频或在场景中「游玩」的能力。在他的实验中,Opus 5 只能通过在不同时间点反复截图来缓慢、痛苦地进行自检,并多次出错、产生大量视觉毛刺(jank)。他将这一点归结为「多模态 + 玩法」层面仍较薄弱的能力空缺,并认为这是下一阶段需要补齐的方向。

信号与边界

这不是一次系统性的基准测试,也不是厂商发布,而是 Karpathy 作为一线研究者的个人体验与判断。但它传递出一个清晰的信号:在「创造力」与「长时程自主执行」这两个维度上,主流大模型已经能完成过去被视为「不划算」的任务;而在「自检」与「原生多模态感知」上,仍有明显缺口。这也使得「让 LLM 写一个能玩的游戏」与「让 LLM 玩自己写的游戏」之间,存在一道尚未跨越的鸿沟。

信源