Opus 5 游戏提示词走红:多 Agent 协作 24 小时造出 3A 级游戏原型
Matt Shumer 提出的「挑战循环」提示词在 X 上爆火,借助主 Agent、子 Agent 与评委 Agent…
近日,一段被命名为「挑战循环」的 Opus 5 游戏开发提示词在 X 平台爆火,吸引上百万人围观。AI 创业者 Matt Shumer 在提示词中要求模型打造一款画面水准对标最新 3A 第一人称射击游戏的原型,核心机制并非单纯生成素材,而是引入了一套多 Agent 协作与强制验收流程。在该流程下,主 Agent 拿到任务后自行拆解,并为每个部分安排专属制作 Agent;最关键的差异是新增了一个评委 Agent,它会以盲测并排对比方式,将生成画面与真实 3A 游戏参照物逐项比较,达不到标准就持续返工。
24 小时肝出翻版《星际拓荒》
网友 Anshu 用这套提示词,独自用 24 小时从零做出一款太空探索网页游戏《The Long Silence》,风格被普遍认为接近《星际拓荒》。具体流程分为三个阶段:
- Step 1:要求 Opus 5 使用 Three.js 开发太空探索游戏,玩家可走动、可驾驶飞船,要求浏览器端尽量稳定运行到 60 帧,世界观与技术架构由模型自行决定。素材环节通过 Claude Code 安装 Blender MCP 后,自动调用工具完成建模。
- Step 2:首版可玩后,向 Opus 5 下达持续 24 小时的视觉升级目标,多个子 Agent 并行提速,评委 Agent 将截图与《星空》等 3A 太空游戏逐项对比,并禁止模型自行降低评判标准。作者还会在提示中给予正向激励,例如「你有能力达到这个目标——尽你所能,不要放弃」。
- Step 3:作者通过手机查看进度,在模型过度投入星球场景时要求其调整优先级;运行结束后用其他 Claude 修复渲染问题、清理代码并完成部署,最后要求 Opus 5 将经验沉淀为 skill 提交至 GitHub。
根据公开仓库,Opus 5 在审核过程中还自行构建了一套验收工具,内置 17 项强制校验流程,脚本会自动截取不同场景、统计帧率并分析曝光数据。该游戏目前已上线网页可玩。
网友集体抄作业
提示词走红后,多名开发者在不同类型上完成复刻:Ryan Campbell 用同一方法迭代出一款卡丁车游戏,针对局部渲染、移动端性能与镜头持续优化;Yogi Suria 则直接造出被戏称为「Claudepunk 2077」的作品。把同一指令迁移给 GPT-5.6 Sol 也得到不错的效果,只是略逊于 Opus 5。
这印证了 A 社发布 Opus 5 时强调的能力定位——模型更适合长时间、多步骤工作,更愿意检查自身结果、发现错误并持续迭代。从这个角度看,「挑战循环」更像是在 Opus 5 现有能力之上套了一层更严格的外部校正机制。
提示词作者与背景
发明这一玩法的 Matt Shumer 本身就是 AI 创业者和投资人。今年 2 月,他曾以一篇《Something Big Is Happening》的长文在科技圈刷屏,累计浏览量突破 8000 万次,核心观点是大众对前沿模型能力的认知已明显落后于 AI 从业者的实际体验。此次 Opus 5 游戏潮被视作其判断的一份新样本。
