SceneMaker 是一个突破性的开源框架,能从单张图像生成完整的、带 Mesh 的 3D 场景,完美解决物体遮挡和空间位姿问题。


SceneMaker 是一个突破性的开源框架,能从单张图像生成完整的、带 Mesh 的 3D 场景,完美解决物体遮挡和空间位姿问题。
SceneMaker 是由 IDEA 研究院与香港科技大学联合推出的开源 3D 场景生成框架。它解决了当前 3D 生成领域最大的痛点——"半开放"窘境。 以往的模型只能生成简单的室内样板间,而 SceneMaker 能够处理开放世界中的任意图像(室内、室外、合成图),并生成包含完整 Mesh(网格)的可编辑 3D 场景。
智能去遮挡 (Decoupled De-occlusion) 现实照片中物体常互相遮挡。SceneMaker 能"脑补"出物体被挡住的部分。
精准位姿估计 (Pose Estimation) 它能准确计算出每个物体在三维空间中的位置、旋转和大小。
开放世界泛化能力 不局限于客厅或卧室。街道、公园、桌面摆件、甚至动漫手办,它都能重建。
对于游戏开发者、VR/AR 内容创作者以及具身智能研究者来说,SceneMaker 是一个极具价值的生产力工具。它将"2D转3D"的门槛再次降低,且质量达到了工业级可用的标准。

AI 不是不会用,是你不会拆。从目标到动作到判断,一篇讲透如何把脑中经验变成 AI 能执行的结构化 Skill。

Anthropic 给 Claude Code 加上 Artifacts,开发过程实时生成可分享网页,团队协作告别人工转述。

OpenAI 给 Codex 上线 Record & Replay,录下你在 Mac 上的操作流程,自动生成可复用 Skill,是时候重新思考自动化了。