照片转 3D 模型:一张照片生成 GLB
照片转 3D 模型的流程很简单:给一个物体拍一张照片,得到一个带贴图的 3D 网格,可以旋转查看、下载,并导入 Blender、Unity 或 3D 打印切片软件。结果好不好,照片的影响远大于任何参数,所以本页讲的是照片本身:怎么拍、模型从照片里恢复不了什么、最后能拿到什么。
想直接试? 打开 AI 3D Generator,上传一张照片,跑一次默认的 Pixal3D 任务。新账号有 220 点注册积分,刚好够一次默认任务(详见费用)。
一张照片能得到什么
你上传一张照片,托管的 Pixal3D 通道返回一个 GLB 文件:网格加上 base color、roughness 等 PBR 贴图。可以在页面里预览并下载。
Pixal3D 是 TencentARC 的图片转 3D 模型。用项目自己的话说,它“通过反投影把像素特征显式提升到三维空间”,而不是松散地注入图像特征,所以面向相机的那一面会贴近你的照片(官方仓库)。相机没拍到的部分则不同:那是推断出来的,不是测量出来的。
这就是它和摄影测量的根本区别。摄影测量要围着物体拍几十张重叠的照片,再去测量形状;一张照片的流程换来的是速度,代价是看不见的那一面只是有依据的猜测。如果你手上的是平面插画或渲染图,而不是实拍照片,请看 2D 图片转 3D 模型。
怎样拍出转换效果好的照片
下面五个习惯决定了大部分结果,都不需要摄影棚。
只拍一个主体,完整且居中
只拍一个物体,四周留一点空白。模型只能处理它拿到的像素,所以被裁掉的边角、底座或把手,在模型里依然是断的。相互重叠的物体会让模型分不清一个在哪里结束、下一个从哪里开始。
选略高一点的三分之二角度
正侧面会看不到顶部,正俯视又看不到侧面。从略高处拍的三分之二角度,能在一张图里同时看到正面、一个侧面和顶面,给模型最多的表面信息。
用朴素且有反差的背景
把物体放在白纸、桌面或墙前,颜色和物体拉开差距。杂乱背景会和主体抢注意力,生硬的投影还可能被画进贴图。上游研究代码会先用背景移除模型处理没有 alpha 通道的图片;本站没有公开托管端点的具体预处理,所以干净的背景更稳妥。
光线柔和均匀
阴天的窗边光,或打到白墙再反射的台灯光都不错。避免直闪、高光斑点,以及冷暖混杂的灯光:照片里有什么光,贴图里往往就会有什么光,因为模型分不清是颜料还是反光。
对焦清晰、尺寸足够
对准主体,手持稳定,并让物体占据画面的相当大一部分。模糊和重压缩会变成软塌的几何和噪点贴图。3D pixel 指南列了二十项检查,其中包括主体短边大约 512 px 的下限。上传支持 PNG、JPEG、WebP、AVIF 与 GIF,单张不超过 10 MB。
哪些情况会失败,该怎么办
单张照片重建有已知的薄弱点。工作台本身就提示过:被裁切、被遮挡或光线很暗的主体仍需要手工修整,而另一个模型可能对细长部件有不同的理解。可以这样应对:
| 主体特征 | 通常会发生什么 | 可以试试 |
|---|---|---|
| 玻璃、透明塑料、水 | 透明区域没有表面像素,会变成孔洞或不透明的团块 | 拍一个不透明的替身,或接受大致形状后手工重建透明部分 |
| 镀铬、镜面、亮面漆 | 反光被当成绘制细节,烘焙进贴图 | 在漫射光下拍摄,有偏振镜就用,或喷哑光喷雾 |
| 细长结构:电线、天线、椅子腿、链条 | 部件粘连、变粗或消失 | 预期要在网格编辑器里修;再用 Trellis 2 通道看第二种解读 |
| 严重遮挡:手拿着物体、物体相互重叠 | 被挡住的区域没有像素可投影 | 把物体放在桌面上重拍,前面不放任何东西 |
| 精细的有机细节:毛发、枝叶 | 细节被抹平成实心体积,只剩贴图上的画面 | 把它当作基础网格,细节留在贴图里而不是几何里 |
| 物体背面和底面 | 推断而来,不是看到的 | 用之前先在查看器里看一圈背面 |
请把 GLB 当作需要检查和清理的生成资产,而不是实测扫描件。动手前可以用免费的 GLB Inspector 看看网格和材质数量。
效果好的拍摄对象
桌面上的商品、杯子、鞋、玩具、工具、小家电、手办和摆件通常转换得最干净,因为它们表面实、轮廓清楚、正面明确。宠物和人更难:它们会动、有毛发,也很难在朴素背景前保持不动。以三分之二角度拍下的熟睡宠物可以得到可用的基础网格,但毛发需要自己清理。
屏幕上的画作、游戏截图和渲染图更像平面图而不是实物,请看 2D 图片转 3D 模型。
从 GLB 到你需要的格式
下载的是 GLB。两个免费的浏览器工具可以完成常见的交接,且不会上传你的模型:
如果想对同一张照片再看一种解读,3D AI 指南对比了 Pixal3D 与 Trellis 2 通道,两者都在同一个工作台里运行。
费用
- 注册积分: 每个新账号获得 220 点一次性积分,有效期 30 天。默认的 Pixal3D 任务消耗 220 积分,所以注册赠送刚好覆盖一次默认任务。
- 需要登录。 如果你在登录前先选了照片,工作台会保留它,并在你登录后启动任务。
- 其他设置消耗更多。 Pixal3D 通道按你选的设置消耗 180 到 390 积分,运行前会先显示价格。
- 更多积分: 套餐与积分包见定价页。
谁在运营
pixal3d.ai 是独立运营的托管服务。它通过 Fal 运行开源的 Pixal3D 模型,并在外围提供账号、积分和工具。它不是腾讯官方的研究演示;两者的边界见 AI wrapper 声明。
照片准备好了,就打开 AI 3D Generator 上传。
常见问题
一张照片真的能变成 3D 模型吗?
可以,得到的是一份生成资产:输入一张只含一个主体的照片,输出带 PBR 贴图的 GLB。相机拍到的那一面会贴近原照片;看不到的那一面由模型推断而不是实测,所以请在查看器里检查。
什么样的照片效果最好?
主体完整且四周留一点边距,从略高于主体的三分之二侧面角度拍摄,背景朴素且与主体反差明显,光线柔和均匀,对焦清晰。上传支持 PNG、JPEG、WebP、AVIF 与 GIF,单张不超过 10 MB。
哪些照片容易失败或需要后期修整?
玻璃与透明塑料、镜面与镀铬表面、电线和链条之类的细长结构、被手挡住等严重遮挡,以及毛发或枝叶之类的精细有机细节。这些情况下可供模型利用的表面像素很少,会出现孔洞、部件粘连或细节被抹平。
结果能精确到可以测量或 3D 打印吗?
不能。单张照片给不出真实比例和被遮挡的几何,所以这份 GLB 是生成资产而不是扫描件。你可以用免费的 GLB 转 STL 工具做打印检查,但请先检查并修复网格。
试一张照片要花多少钱?
新账号会获得 220 点一次性注册积分,有效期 30 天。默认的 Pixal3D 任务消耗 220 积分,所以注册赠送刚好够跑一次默认任务。需要登录,Pixal3D 通道按设置不同消耗 180 到 390 积分。
这是腾讯官方的 Pixal3D 演示吗?
不是。pixal3d.ai 是独立运营的托管服务,通过 Fal 运行开源的 Pixal3D 模型,并提供自己的账号、积分和工具。
Related 3D guides and workspaces
- Photo to 3D ModelHow to shoot a photo that converts well, what fails, and what the GLB contains.
- 2D Image to 3D ModelPrepare illustrations, renders, and sprites, and know what the back side invents.
- 3D Pixel: Pixel-Aligned Image to 3DPixel-aligned criteria, source-image checks, and voxel/texel resolution for a GLB.
- 3D AI: AI 3D Model GenerationChoose between Pixal3D, Trellis 2, and Hunyuan Motion before spending credits.
- Image to 3D Model GeneratorPixel-aligned image-to-3D with GLB preview, PBR textures, and motion output.
- AI Image Generator WorkspaceText-to-image, image-to-image, and photo editing in one hosted workbench.
- AI Video Generator WorkspaceSeedance 2.0 text-to-video, image-to-video, and reference-to-video.