toolin.ai logo
toolin.ai
首页
AI工具
AI技能包
AI资讯
精选推文
AI提示词
价格
提交AI工具提交
toolin.ai logo
toolin.ai

AI玩家的创作利器库,发现最佳AI工具组合,提升您的创作效率

AI工具1,408个
技能包11个
产品功能
  • AI工具
  • AI技能包
  • AI资讯
  • 精选推文
  • 提交AI工具
  • 价格
关于我们
  • 关于Toolin
  • 联系我们
  • 合作洽谈
  • 更新日志
关注我们
© 2025 toolin.ai. All rights reserved.
服务条款隐私政策

AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通

2026/07/24
·toolin小编

清华 CVPR'26 Highlight 开源项目 AutoMIA,输入两张图即可生成可 3D 打印的体素镜像错觉艺术模型(STL-ready),单张 RTX 3090、76 秒/设计。

AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通
AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通
2026/07/24

AutoMIA:两张图生成可 3D 打印的镜像错觉,单卡 RTX 3090 跑通

清华 CVPR'26 Highlight 开源项目 AutoMIA,输入两张图即可生成可 3D 打印的体素镜像错觉艺术模型(STL-ready),单张 RTX 3090、76 秒/设计。

AutoMIA 是什么关键事实(官方已披露)开始前的准备第一步:克隆仓库并装依赖第二步:准备两张参考图第三步:运行生成第四步:导出并 3D 打印应用场景常见问题写在最后
AI产品

镜像错觉(Mirror Illusion)是一种古老的艺术形式——从某个角度看到一个形象,换一个角度又看到完全不同的另一个形象。AutoMIA 把这件事自动化了:输入两张图,输出一个可以直接 3D 打印的体素镜像错觉模型(STL-ready)。它是清华朱军/胡晓林 Lab(一作朱小佩)+ 华科李泽远的工作,被 CVPR 2026 收为 Highlight,并拿下了 Efficient CVPR Award。最关键的是:单张 RTX 3090 就能跑,76 秒生成一个设计。

如果你做创意编程、3D 打印、装置艺术或视觉设计,这是一篇务实的上手指南。

AutoMIA 是什么

AutoMIA = Automatic Mirror Illusion Art。它解决的核心问题是:如何自动从两张参考图,生成一个沿不同视角呈现不同形象的 3D 体素模型。

传统镜像错觉艺术是手工活,需要艺术家反复打磨几何外形,让它在两个不同视角下分别"看起来像"两个不同的图。AutoMIA 把这个流程变成一个可微分优化问题:定义两个视角下的"看起来像"目标,让体素模型同时满足,自动搜索出几何解。

输出的体素模型可以直接导出为 STL,送进切片软件打印成实体。

关键事实(官方已披露)

  • 作者机构:清华(朱军 / 胡晓林 Lab,一作朱小佩)+ 华中科技大学(李泽远)
  • 学术认可:CVPR 2026 Highlight + Efficient CVPR Award
  • 论文:arXiv:2607.02015
  • 硬件门槛:单张 RTX 3090 即可
  • 速度:约 76 秒生成一个设计
  • 显存占用:约 2.6GB
  • 输出格式:STL-ready(可直接切片打印)

开始前的准备

  • GPU:单张 RTX 3090(24GB)足够,实际占用约 2.6GB,对消费级显卡友好。
  • Python 环境:按仓库 README 配置依赖。
  • 3D 打印机(可选):如果要做成实体,需要一台 FDM/SLA 打印机和对应切片软件(Bambu Studio、Cura 等)。
  • 两张参考图:你想让模型从两个不同视角分别呈现的两个形象(比如正面看是只猫、转 90 度看是只狗)。

项目仓库:https://github.com/zxp555/AutoMIA 论文:https://arxiv.org/abs/2607.02015

第一步:克隆仓库并装依赖

git clone https://github.com/zxp555/AutoMIA.git
cd AutoMIA

按 README 安装 Python 依赖(通常包含 PyTorch、numpy、trimesh 等用于体素操作和 STL 导出的库)。

第二步:准备两张参考图

把你想呈现的两个形象各保存成一张图。建议:

  • 高对比度、轮廓清晰 的剪影或图形效果最好。
  • 简单主体 + 干净背景,避免噪声干扰视角投影匹配。
  • 两张图所表达的"主轴方向"要规划好(哪个是正面、哪个是侧面)。

第三步:运行生成

按仓库 README 提供的入口脚本运行,传入两张参考图路径和体素分辨率等参数。生成约需 76 秒(RTX 3090 实测口径),完成后输出一个体素模型 + STL 文件。

💡 提示: 先用低体素分辨率快速试错,确认两个视角都能识别出目标形象,再升到高分辨率做最终成品。低分辨率迭代成本低,高分辨率出细节。

第四步:导出并 3D 打印

把生成的 STL 文件拖进切片软件(Bambu Studio、Cura、PrusaSlicer 等),按常规流程切片打印。打印出来后,把它放在两面墙各一面镜子的拐角处——这就是镜像错觉最经典的展示方式:每面镜子各呈现一个形象。

应用场景

  • 创意编程 / 装置艺术:把 AutoMIA 接进生成式创意流程,批量制作错觉艺术装置。
  • 3D 打印爱好者:一种全新的可打印艺术品类,输出物本身就是消费品。
  • 视觉设计与品牌物料:实体营销物料、展览装置、互动体验设计。
  • 教学与科普:演示视觉错觉、可微分优化、体素建模的直观教具。

常见问题

  • 生成结果两个视角都识别不出目标形象: 检查参考图——背景太杂、主体对比度太低、视角主轴方向规划混乱是最常见原因。换简单剪蛓图重试。
  • STL 打印失败: 体素模型可能存在薄壁、悬垂或浮空部分,上机前在切片软件里检查并加支撑。
  • 显存超过 2.6GB: 调低体素分辨率;该数值是 RTX 3090 默认配置下的实测口径。
  • 多视角(>2 个形象): 当前版本聚焦双视角镜像错觉,多视角扩展需要参考论文中的方法自行改造。

写在最后

AutoMIA 是那种"小而美"的开源项目:学术上拿到 CVPR 2026 Highlight + Efficient Award,工程上对消费级硬件极友好(单卡 3090、76 秒、2.6GB 显存),输出物直接可 3D 打印成实体。如果你手边有一台 3D 打印机和一张 RTX 3090,把它拉下来跑一次,亲手打印一个"两看皆是"的小雕塑,比读论文有趣得多。

官方资源:

  • GitHub:https://github.com/zxp555/AutoMIA
  • 论文:https://arxiv.org/abs/2607.02015
所有文章

作者

avatar for toolin小编
toolin小编

分类

  • AI产品
AutoMIA 是什么关键事实(官方已披露)开始前的准备第一步:克隆仓库并装依赖第二步:准备两张参考图第三步:运行生成第四步:导出并 3D 打印应用场景常见问题写在最后

相关文章

微信读书 AI Skill:让 AI 读懂你的阅读画像
AI产品

微信读书 AI Skill:让 AI 读懂你的阅读画像

微信读书官方 AI skill 开放 6 项数据查询能力,开源增强版 huashu-weread 通过书架与笔记交叉分析提供个性化推荐和阅读主题演化追踪。

avatar for toolin小编
toolin小编
2026/05/18
Claude Code 大型代码库实战指南
AI教程

Claude Code 大型代码库实战指南

译自Anthropic官方文档,详解Claude Code在百万行代码库中的工作原理、五层扩展点配置和三种成功部署模式。

avatar for toolin小编
toolin小编
2026/05/17
Codex进手机:随时随地指挥AI写代码
AI产品

Codex进手机:随时随地指挥AI写代码

OpenAI Codex进入ChatGPT手机App,支持iOS和Android全量用户,开发者可随时随地审批命令、跨设备控制多台电脑。

avatar for toolin小编
toolin小编
2026/05/17