AI 图像深度估计使用教程:本地 Depth Anything 一键生成深度图

AI 图像深度估计使用教程:本地 Depth Anything 一键生成深度图

📁 AI图像👁️ 147 阅读⏱️ 5 分钟阅读🕒 2026/9/14

免费在线 AI 图像深度估计工具,基于 Depth Anything 模型在浏览器本地运行,上传图片即可生成灰度深度图,图片不上传服务器,支持一键下载 PNG。

工具简介

AI 图像深度估计是工具派推出的一款基于 AI 的在线图片分析工具:只要上传一张图片,它就能在浏览器本地运行 Depth Anything 深度估计模型,推断画面中每个像素到相机的远近关系,并生成一张与原图对应的灰度深度图——不同亮度代表不同的相对深度,一眼就能看清场景的空间层次。整个过程全部在你的浏览器里完成,图片不会上传到任何服务器,隐私有保障。生成的深度图可以一键下载为 PNG,广泛用于 3D 重建、景深虚化、AI 绘画 ControlNet 深度控制、AR/VR 场景理解等场景,打开即用、无需安装任何软件。

功能亮点

  • Depth Anything 本地模型:使用业界知名的 Depth Anything 深度估计模型,对人物、建筑、室内外风景等各类场景都有不错的深度推断能力。
  • 纯浏览器本地运行:模型和图片全程在本机浏览器中处理,图片不会上传到服务器,处理私人照片、未公开设计稿也无需担心隐私泄露。
  • 三种上传方式:支持拖拽图片到上传框、直接粘贴剪贴板中的图片、点击选择文件三种方式,操作顺手。
  • 一键生成深度图:上传后点击「开始估计」,原图与深度图并排展示,方便逐像素对比远近关系。
  • 深度图一键下载:生成的深度图可直接下载为 PNG 文件(文件名形如 depth_时间戳.png),可直接用于后续工作流。
  • 模型自动缓存:首次使用需加载约 27MB 的模型文件,加载完成后自动缓存到本地,再次使用几乎秒开。
  • 加载进度可见:模型加载期间页面会显示百分比进度条,心里有数,不用干等。

参数说明

参数 说明 默认值 / 取值范围
上传图片 待估计深度的图片,支持拖拽、粘贴或点击上传 仅支持图片格式(image/*),大小不超过 10MB
开始估计 点击后调用本地 Depth Anything 模型进行深度估计;未上传图片时按钮不可用 无(按钮)
模型加载进度 首次使用时模型下载/加载的百分比进度条,加载完成后自动缓存 0–100%,仅首次或缓存失效时出现
深度图 模型输出的单通道灰度深度图,已做 0–255 归一化,亮度差异表示相对远近 分辨率与模型输出一致
下载深度图 将深度图导出为 PNG 文件保存到本地 文件名 depth_<时间戳>.png

使用步骤

  1. 打开工具页面:顶部是工具标题和简介,中间是上传区域,无需安装任何软件,打开网页即可使用。

AI 图像深度估计主界面:顶部为工具标题与简介卡片,其下为会员提示横幅;中部白色卡片内含虚线图片上传框(支持拖拽、粘贴或

  1. 上传图片:把图片直接拖到虚线框内、或在页面上粘贴剪贴板中的图片、或点击上传框选择本地文件。注意仅支持图片格式,且大小不能超过 10MB,否则会提示错误。

  2. 等待模型加载(仅首次):如果是第一次使用,页面会显示「AI 加载中」进度条,需要下载约 27MB 的模型文件,请耐心等待;加载完成后会自动缓存,以后再用就很快了。

  3. 点击「开始估计」:确认图片已上传后,点击蓝色「开始估计」按钮,按钮会变为「估计中...」状态,稍等片刻模型即可完成整图的深度推断。

  4. 查看并对比结果:处理完成后页面下方并排显示「原图」和「深度图」两张卡片,对照原图观察深度图中不同亮度区域对应的远近层次。

  5. 下载深度图:确认效果满意后,点击深度图下方的「下载深度图」按钮,即可把深度图以 PNG 格式保存到本地,用于后续的 3D、AI 绘画或图像处理流程。

使用技巧

  • 首次加载慢属正常:第一次打开需要下载约 27MB 模型,建议在 Wi-Fi 环境下完成首次加载;之后模型已缓存,刷新页面也能快速就绪。
  • 主体突出的照片效果最好:人物肖像、单个物体、有明显前后景的风景照,深度层次清晰,模型推断最稳定;纯纹理、大面积纯色或抽象图案的深度信息少,效果会打折扣。
  • 深度图是「相对深度」:输出亮度经过 0–255 归一化,表示画面内像素的相对远近关系,并不是以米为单位的绝对距离,适合做视觉层次参考和图像处理掩码。
  • 用于 AI 绘画深度控制:生成的深度图可以直接作为 Stable Diffusion ControlNet(Depth)等流程的控制图,帮助保持构图的空间结构。
  • 配合景深虚化使用:把深度图当作选区/蒙版,在 Photoshop 等工具中对远景区域做模糊,就能模拟大光圈镜头的景深效果。
  • 图片太大先压缩:超过 10MB 会被拒绝上传,过大的图片可以先用工具派的图片压缩工具处理后再上传,速度也更快。

常见问题

Q1:上传的图片会被传到服务器吗?
不会。本工具采用浏览器本地 AI 方案,图片读取和模型推理全部在你自己的设备上完成,图片不会上传到任何服务器,页面上的隐私说明也明确标注了这一点。

Q2:为什么第一次使用时加载很慢?
首次使用需要下载约 27MB 的 Depth Anything 模型文件,页面会显示百分比进度条。下载完成后模型会自动缓存在浏览器本地,之后再用就无需重新下载,速度会快很多。

Q3:深度图里的亮和暗分别代表什么?
深度图是单通道灰度图,模型输出的深度值被线性归一化到 0–255:不同亮度对应不同的相对深度,用来表现画面的远近层次。它反映的是画面内的相对关系,不是绝对物理距离。

Q4:支持哪些图片格式和大小?
支持浏览器可识别的常见图片格式(如 JPG、PNG、WebP 等,即 image/*),单张图片大小不能超过 10MB;上传非图片文件或超限文件时页面会给出错误提示。

Q5:生成的深度图能用来做什么?
常见用途包括:作为 AI 绘画 ControlNet 的深度控制图、制作景深虚化效果的选区蒙版、3D 重建与视差图生成的前期数据、AR/VR 场景的空间理解等。

Q6:点击「开始估计」后失败了怎么办?
请先确认已成功上传图片(按钮在未上传时不可用)。若提示「深度估计失败」,可尝试刷新页面重新加载模型后再试一次,或更换一张主体更清晰、体积更小的图片。