Matt Shumer 的「挑战循环」Prompt,让 Opus 5 用主 Agent + 制作 Agent + 评委 Agent 的多智能体结构自驱迭代,配合 Three.js + Blender MCP,单人在 24 小时内复刻《星际拓荒》级别网页游戏。


Matt Shumer 的「挑战循环」Prompt,让 Opus 5 用主 Agent + 制作 Agent + 评委 Agent 的多智能体结构自驱迭代,配合 Three.js + Blender MCP,单人在 24 小时内复刻《星际拓荒》级别网页游戏。
最近在 X 上爆火的一条 Opus 5 游戏提示词,让开发者 Anshu 一个人在 24 小时 内,从零做出了可网页对标的太空探索游戏《The Long Silence》。原作者 Matt Shumer 用同一套提示词,让 Opus 5 在不使用任何外部素材的情况下,生成出一版《使命召唤》级别的 FPS 原型。
这条 Prompt 的核心叫 「挑战循环」(Challenge Loop)——它不是教模型怎么写游戏,而是给模型装一个「不让它下班」的评委。本篇拆解它的多 Agent 结构、可复用的三步流程,以及如何把这套模式迁移到你自己的长程任务上。
可玩成品:《The Long Silence》已开源并可直接网页开玩——longsilence.anshu.dev
大多数多 Agent 游戏开发流程停在「拆任务 → 干活」这一层。挑战循环多加了一个独立评委 Agent,结构如下:
关键在于评委 Agent 是独立的——它不归主 Agent 管,不会让模型悄悄降低评判标准给自己放水。只要画面不如同类游戏,就自动返工。
⚠️ 现实提醒:这套 Prompt 不可能真的 1:1 复刻 3A 大作。把它当成极限施压手段——逼出 Opus 5 的自主规划和长程迭代能力,由你(用户)来决定何时喊停。
只给最低限度的硬约束,其余让模型自己决定。例如:
用 Three.js 制作一款太空探索游戏。玩家可以在游戏中走动、驾驶飞船。视觉不要太塑料。浏览器中尽量稳定运行到 60 帧。
游戏世界观、技术架构、美术风格——通通交给 Opus 5 自主决策。素材方面,Claude Code 在装好 Blender MCP 后,会自己寻找工具建模,不需要你手动喂素材。
💡 提示:不要在这一步过度约束。Opus 5 的长程规划能力需要空间来发挥,前期框太死反而限制了它的迭代空间。
首版可玩后,给 Opus 5 一个长时间窗口的目标,要求它全面提升视觉效果。此时多个子 Agent 开始并行工作:
Anshu 提醒,这里也要适当给 Opus 5 一些"甜枣"配合极限施压:
你有能力达到这个目标——尽你所能,不要放弃。
通过手机随时查看进度。当发现模型在某一个星球场景上耗费太多时间时,手动调整它的优先级,把注意力拉回到核心体验。
停止自动循环后:
根据 Anshu 的开源仓库,Opus 5 在审核过程中自己造了一套验收工具:内置 17 项强制校验流程、自动截取不同场景对比、帧率统计、曝光数据分析。这是模型在被评委 Agent 施压后,主动产出的副产物——你可以直接复用这套验收脚本到自己的项目里。
完成后的产物应当满足:
可以直接打开 longsilence.anshu.dev 体验这套流程产出的成品效果。
挑战循环的真正价值不在游戏开发,而是一个可迁移的多 Agent 验证模式:
主 Agent(拆任务)
├── 制作 Agent × N(并行干活)
└── 评委 Agent(独立、盲测、不让步)
↓
达标?否 → 返工
是 → 下一个迭代这个结构适用于任何有客观参照物的长程任务:
网友已经验证了它的可迁移性:Ryan Campbell 用同一套 Prompt 迭代出一款卡丁车游戏,Yogi Suria 直接造出了 Claudepunk 2077。同样的指令迁移到 GPT-5.6 Sol 也跑得起来,效果只略逊 Opus 5。

GPT-5.5加持的Codex单周下载量突破9000万,Token效率提升40%,16人团队月省3.2万美元,开发者正在用脚投票。

一张AI记忆卡片贴在手机背面,自动汇总微信、飞书等所有应用消息,支持智能总结、定时推送和自定义灯效提醒,让你告别消息轰炸。

Claude深度集成微软Excel、PowerPoint、Word和Outlook,支持跨应用连续工作流,对话记忆在所有Office应用中共享。