在你自己的电脑上跑

照片生成深度图

拖一张照片进来,几秒钟后拿到深度图。Depth Anything V2 就在这个标签页里跑,照片不离开你的电脑。

Depth Anything V2 Small · WebGPU 档 94 MB,CPU 档 26 MB · Apache-2.0 · 只下一次,之后走缓存

生成深度图

把照片拖到这里

支持 JPEG、PNG、WebP,也可以直接 Ctrl / ⌘ + V 粘贴

手边没有图?拿这两张试:

一次一张,最大 12 兆像素、32 MB;长边超过 2048 px 会先缩到 2048。

流程

  1. 1

    给一张照片

    拖进来、粘贴,或者点按钮选文件。照片在标签页里解码,没有任何一个请求会把它带走。

  2. 2

    等上几秒

    第一次进来要花 26–94 MB 把模型拉下来。之后每次都是纯计算:一张 1280 px 的照片,WebGPU 约 0.3 秒,CPU 约 5.5 秒。

  3. 3

    把 PNG 拿走

    给 ControlNet 或 Photoshop 用 8-bit;要拉曲线、要拿去做位移就用 16-bit;只是想给人看效果就存 GIF。

常见问题

深度图到底能干什么?

主要三类用途。一是 Stable Diffusion 里 ControlNet depth 的控制图,用它可以让重绘保留原片的空间结构,SD WebUI 和 ComfyUI 的 depth 预处理器要的就是这种灰度图。二是做 3D 照片和视差动效,本页的「3D 晃动」就是同一个原理。三是当作按远近划分的选区:假景深虚化、加空气透视、只给背景重新打光。

准不准?数值是什么单位?

没有单位。Depth Anything V2 给的是相对逆深度:值越大表示越近,本页那张街口样例的输出落在 0.00 到 7.3 之间。两张不同照片之间不能直接比大小,这里也量不出米数。在同一张照片内部,前后顺序是可靠的;玻璃、镜面反射和过曝的天空是它最没把握的地方。

照片会被上传吗?

不会。这个页面只从网络上取模型文件,不会往外发任何东西。打开浏览器的网络面板跑一张图看看:模型缓存好之后,请求数是零。也正因为这样,断网之后这个工具照样能用。

16-bit PNG 是给谁用的?

8-bit 只有 256 级,看一看、喂 ControlNet 都够,但一旦拉曲线或者拿它去做几何位移,立刻出现台阶状的色带。16-bit 那份直接来自模型的浮点输出,保留 65,536 级,固定是灰度。Blender、Photoshop 的 16 位模式、After Effects 以及大部分三维软件都能直接读。

为什么边缘有点糊?为什么限制 2048 px?

因为模型本身只看到你照片的 518 像素版本——这是 Depth Anything V2 Small 导出时固定的输入尺寸,再大的图都会被缩进去。超出的部分全靠插值放大,所以一张 6000 px 的深度图并不比 2048 px 的多出细节,只是更吃内存。边缘因此偏软;要让深度边界严丝合缝地贴住原图像素,那叫边缘引导上采样,是 Mac 版在做的事。

浏览器不支持 WebGPU 还能用吗?

能,而且是同一个模型。没有 WebGPU 时页面会改下 26 MB 的 4-bit 版本,用 WebAssembly 在 CPU 上单线程跑。在本页测试用的机器上,1280 × 855 的照片 CPU 需要 5.5 秒,WebGPU 是 0.32 秒。手机走的也是 CPU 这条路,所以手机上下载的是 26 MB 而不是 94 MB。

我要法线图,或者真正的视差视频。

那是 Mac 版 AIDepthForge 的活。一个浏览器标签页不适合跑几分钟的渲染:Mac 版能出法线图、能整个文件夹批量、能按照片原分辨率做边缘引导的深度,导出的是视频而不是一小段 GIF。这个页面只负责「一张照片、马上要结果」。