在你自己的电脑上跑
照片生成深度图
拖一张照片进来,几秒钟后拿到深度图。Depth Anything V2 就在这个标签页里跑,照片不离开你的电脑。
Depth Anything V2 Small · WebGPU 档 94 MB,CPU 档 26 MB · Apache-2.0 · 只下一次,之后走缓存
生成深度图
把照片拖到这里
支持 JPEG、PNG、WebP,也可以直接 Ctrl / ⌘ + V 粘贴
手边没有图?拿这两张试:
一次一张,最大 12 兆像素、32 MB;长边超过 2048 px 会先缩到 2048。
视图
着色
保存
文件直接在这个标签页里写出来,中间没有服务器。
流程
- 1
给一张照片
拖进来、粘贴,或者点按钮选文件。照片在标签页里解码,没有任何一个请求会把它带走。
- 2
等上几秒
第一次进来要花 26–94 MB 把模型拉下来。之后每次都是纯计算:一张 1280 px 的照片,WebGPU 约 0.3 秒,CPU 约 5.5 秒。
- 3
把 PNG 拿走
给 ControlNet 或 Photoshop 用 8-bit;要拉曲线、要拿去做位移就用 16-bit;只是想给人看效果就存 GIF。
如果这是你每天的活
AIDepthForge 是同一件事的 Mac 版:深度图之外还给法线图,可以整个文件夹一起跑,按照片原分辨率出图,3D 视差直接导出成视频。同一族模型,不受浏览器内存上限拘束。
到 Mac App Store 看 AIDepthForge常见问题
深度图到底能干什么?
主要三类用途。一是 Stable Diffusion 里 ControlNet depth 的控制图,用它可以让重绘保留原片的空间结构,SD WebUI 和 ComfyUI 的 depth 预处理器要的就是这种灰度图。二是做 3D 照片和视差动效,本页的「3D 晃动」就是同一个原理。三是当作按远近划分的选区:假景深虚化、加空气透视、只给背景重新打光。
准不准?数值是什么单位?
没有单位。Depth Anything V2 给的是相对逆深度:值越大表示越近,本页那张街口样例的输出落在 0.00 到 7.3 之间。两张不同照片之间不能直接比大小,这里也量不出米数。在同一张照片内部,前后顺序是可靠的;玻璃、镜面反射和过曝的天空是它最没把握的地方。
照片会被上传吗?
不会。这个页面只从网络上取模型文件,不会往外发任何东西。打开浏览器的网络面板跑一张图看看:模型缓存好之后,请求数是零。也正因为这样,断网之后这个工具照样能用。
16-bit PNG 是给谁用的?
8-bit 只有 256 级,看一看、喂 ControlNet 都够,但一旦拉曲线或者拿它去做几何位移,立刻出现台阶状的色带。16-bit 那份直接来自模型的浮点输出,保留 65,536 级,固定是灰度。Blender、Photoshop 的 16 位模式、After Effects 以及大部分三维软件都能直接读。
为什么边缘有点糊?为什么限制 2048 px?
因为模型本身只看到你照片的 518 像素版本——这是 Depth Anything V2 Small 导出时固定的输入尺寸,再大的图都会被缩进去。超出的部分全靠插值放大,所以一张 6000 px 的深度图并不比 2048 px 的多出细节,只是更吃内存。边缘因此偏软;要让深度边界严丝合缝地贴住原图像素,那叫边缘引导上采样,是 Mac 版在做的事。
浏览器不支持 WebGPU 还能用吗?
能,而且是同一个模型。没有 WebGPU 时页面会改下 26 MB 的 4-bit 版本,用 WebAssembly 在 CPU 上单线程跑。在本页测试用的机器上,1280 × 855 的照片 CPU 需要 5.5 秒,WebGPU 是 0.32 秒。手机走的也是 CPU 这条路,所以手机上下载的是 26 MB 而不是 94 MB。
我要法线图,或者真正的视差视频。
那是 Mac 版 AIDepthForge 的活。一个浏览器标签页不适合跑几分钟的渲染:Mac 版能出法线图、能整个文件夹批量、能按照片原分辨率做边缘引导的深度,导出的是视频而不是一小段 GIF。这个页面只负责「一张照片、马上要结果」。