SceneMaker 是一个突破性的开源框架,能从单张图像生成完整的、带 Mesh 的 3D 场景,完美解决物体遮挡和空间位姿问题。


SceneMaker 是一个突破性的开源框架,能从单张图像生成完整的、带 Mesh 的 3D 场景,完美解决物体遮挡和空间位姿问题。
SceneMaker 是由 IDEA 研究院与香港科技大学联合推出的开源 3D 场景生成框架。它解决了当前 3D 生成领域最大的痛点——"半开放"窘境。 以往的模型只能生成简单的室内样板间,而 SceneMaker 能够处理开放世界中的任意图像(室内、室外、合成图),并生成包含完整 Mesh(网格)的可编辑 3D 场景。
智能去遮挡 (Decoupled De-occlusion) 现实照片中物体常互相遮挡。SceneMaker 能"脑补"出物体被挡住的部分。
精准位姿估计 (Pose Estimation) 它能准确计算出每个物体在三维空间中的位置、旋转和大小。
开放世界泛化能力 不局限于客厅或卧室。街道、公园、桌面摆件、甚至动漫手办,它都能重建。
对于游戏开发者、VR/AR 内容创作者以及具身智能研究者来说,SceneMaker 是一个极具价值的生产力工具。它将"2D转3D"的门槛再次降低,且质量达到了工业级可用的标准。

新加坡 Sapiens AI 推出 Agnes-2.5-Flash 编程模型,官方宣称免费不限期、进入全球 Coding 第一梯队,已上线 Agnes Code 桌面端。

LiblibAI 的专业 AI 视频平台 LibTV 推出全球最大的视频 Agent Skill Hub,把 100+ 导演级 Skill 打包给 Agent 调用,一句话从剧本干到成片。

PixVerse 完成 4.39 亿美元 C 轮融资并推出 Game Engine,基于实时世界模型 R1 把视频生成变成可即时响应输入的可交互世界。