照片,变成 3D。 深度感知。即导即用。
免费的照片转 3D 工具。AI 在本机完成深度估计,把画面重建为可交互的浮雕网格或点云,一键导出 GLB、OBJ 或 USDZ——无需上传,无需注册。
从平面照片到可环绕的 3D,全程私密。
没有账号、没有 API 密钥、没有云端渲染。深度模型直接来到你的浏览器。
100% 端侧 & 私密
深度估计通过 WebGPU 在浏览器内完成,并自动回退 WASM。照片永远不会离开你的设备。
真正的深度 AI
Depth Anything V2 Small——先进的单目深度估计模型(约 50 MB,Apache-2.0)——把每个像素映射为真实的场景距离。
两种 3D 表示
浮雕:带原图纹理的深度网格,配以影棚级柔光;点云:顶点取色的三维点阵,清晰呈现结构与景深层级。
到处可用
GLB(内嵌纹理)、OBJ(纯几何)、USDZ(iPhone/iPad 的 AR 快速查看),外加灰度深度图 PNG。
三步完成,零上传。
- 01
添加照片
拖拽、粘贴或浏览。人像、产品、美食、建筑——有清晰景深层次的照片效果最佳。
- 02
AI 估计深度
Depth Anything V2 经 WebGPU / WASM 在本地运行,几秒出结果。首次运行会缓存模型(约 27–50 MB)。
- 03
环绕、调整并导出
拖动旋转、滚轮缩放。调整深度强度、平滑度与精细度,然后下载 GLB、OBJ 或 USDZ。
关于 Depth 3D
一个免费的浏览器工具,把单张照片变成可以环绕、调整并导出的交互式 3D 物件。它为想让画面“立体起来”的人而设计——电商产品图、人像、一餐美食、一栋建筑——也为设计项目需要一个 3D 起步文件、却不想为云端照片转 3D 服务付费或在渲染队列里排队的人。
同一次深度估计会得到两种表示:影棚级柔光下带原图纹理的浮雕网格,以及把景深层级一目了然呈现出来的顶点取色点云。
工作原理
Depth Anything V2 Small(Apache-2.0 授权的先进单目深度网络)通过 Transformers.js 在你的浏览器里运行——支持 WebGPU 时走 WebGPU,其余环境走 WebAssembly。它把每个像素映射为相对场景距离,工具再把这份深度场变成几何:一个沿深度位移并被原图贴肤的细分平面,或从同一深度场采样的点云。导出使用 three.js 标准导出器:内嵌纹理的 GLB、纯几何的 OBJ,以及在 iPhone/iPad 上可直接用 AR 快速查看打开的 USDZ。
诚实的 2.5D——它是什么、不是什么
单张照片不包含相机从未见过的表面信息,因此工具只重建朝向相机一侧的几何——精神上更接近经典的 Facebook 3D 照片,而不是 TripoSR 或 Meshy 那种完整的生成式图生 3D 模型(后者依赖数据中心 GPU,目前也没有可供浏览器运行的量化权重)。物体的背面保持扁平。换来的是速度与隐私:几秒钟出深度、全部在你的硬件上完成,输出的是标准 3D 文件。
获得更好的重建效果
景深分离清晰的照片效果最好:主体明显前于背景、前景与景色分层、略带角度看到的建筑。深度强度控制几何向相机凸出的程度;平滑度在位移前柔化深度场,对噪点较多的翻拍尤其有用;网格精细度用顶点数换保真度,点大小则适配点云观感。灰度深度图可以单独下载,用于其他管线。
限制与要求
模型只下载一次(WebGPU 约 50 MB,WebAssembly 约 27 MB)并由浏览器缓存;之后每张照片只需几秒。Chrome、Edge 等 Chromium 浏览器走 WebGPU 路径;Safari 和 Firefox 在 WASM 上运行,输出一致。特别扁平的主体——文档翻拍、完全正对的墙面——几乎没有可挖掘的深度。网格导出会把照片作为内嵌纹理带走;OBJ 只有几何。
隐私
照片的解码、深度估计与 3D 重建全部发生在浏览器内存里。没有任何上传、排队或服务器存储,没有水印,也没有用量限制。模型缓存之后,离线也能继续使用。