# AI 图像深度估计使用教程：本地 Depth Anything 一键生成深度图

> 来源：工具派（https://gjupai.com） 原文页面：https://gjupai.com/tutorial/ai-depth-estimator-guide

## 工具简介

**AI 图像深度估计**是工具派推出的一款基于 AI 的在线图片分析工具：只要上传一张图片，它就能在浏览器本地运行 Depth Anything 深度估计模型，推断画面中每个像素到相机的远近关系，并生成一张与原图对应的**灰度深度图**——不同亮度代表不同的相对深度，一眼就能看清场景的空间层次。整个过程全部在你的浏览器里完成，图片不会上传到任何服务器，隐私有保障。生成的深度图可以一键下载为 PNG，广泛用于 3D 重建、景深虚化、AI 绘画 ControlNet 深度控制、AR/VR 场景理解等场景，打开即用、无需安装任何软件。

## 功能亮点

- **Depth Anything 本地模型**：使用业界知名的 Depth Anything 深度估计模型，对人物、建筑、室内外风景等各类场景都有不错的深度推断能力。
- **纯浏览器本地运行**：模型和图片全程在本机浏览器中处理，图片不会上传到服务器，处理私人照片、未公开设计稿也无需担心隐私泄露。
- **三种上传方式**：支持拖拽图片到上传框、直接粘贴剪贴板中的图片、点击选择文件三种方式，操作顺手。
- **一键生成深度图**：上传后点击「开始估计」，原图与深度图并排展示，方便逐像素对比远近关系。
- **深度图一键下载**：生成的深度图可直接下载为 PNG 文件（文件名形如 `depth_时间戳.png`），可直接用于后续工作流。
- **模型自动缓存**：首次使用需加载约 27MB 的模型文件，加载完成后自动缓存到本地，再次使用几乎秒开。
- **加载进度可见**：模型加载期间页面会显示百分比进度条，心里有数，不用干等。

## 参数说明

| 参数 | 说明 | 默认值 / 取值范围 |
| --- | --- | --- |
| 上传图片 | 待估计深度的图片，支持拖拽、粘贴或点击上传 | 仅支持图片格式（image/*），大小不超过 10MB |
| 开始估计 | 点击后调用本地 Depth Anything 模型进行深度估计；未上传图片时按钮不可用 | 无（按钮） |
| 模型加载进度 | 首次使用时模型下载/加载的百分比进度条，加载完成后自动缓存 | 0–100%，仅首次或缓存失效时出现 |
| 深度图 | 模型输出的单通道灰度深度图，已做 0–255 归一化，亮度差异表示相对远近 | 分辨率与模型输出一致 |
| 下载深度图 | 将深度图导出为 PNG 文件保存到本地 | 文件名 `depth_<时间戳>.png` |

## 使用步骤

1. **打开工具页面**：顶部是工具标题和简介，中间是上传区域，无需安装任何软件，打开网页即可使用。

![AI 图像深度估计主界面：顶部为工具标题与简介卡片，其下为会员提示横幅；中部白色卡片内含虚线图片上传框（支持拖拽、粘贴或](article/202607/1783999217509_2910.png)

2. **上传图片**：把图片直接拖到虚线框内、或在页面上粘贴剪贴板中的图片、或点击上传框选择本地文件。注意仅支持图片格式，且大小不能超过 10MB，否则会提示错误。

3. **等待模型加载（仅首次）**：如果是第一次使用，页面会显示「AI 加载中」进度条，需要下载约 27MB 的模型文件，请耐心等待；加载完成后会自动缓存，以后再用就很快了。

4. **点击「开始估计」**：确认图片已上传后，点击蓝色「开始估计」按钮，按钮会变为「估计中...」状态，稍等片刻模型即可完成整图的深度推断。

5. **查看并对比结果**：处理完成后页面下方并排显示「原图」和「深度图」两张卡片，对照原图观察深度图中不同亮度区域对应的远近层次。

6. **下载深度图**：确认效果满意后，点击深度图下方的「下载深度图」按钮，即可把深度图以 PNG 格式保存到本地，用于后续的 3D、AI 绘画或图像处理流程。

## 使用技巧

- **首次加载慢属正常**：第一次打开需要下载约 27MB 模型，建议在 Wi-Fi 环境下完成首次加载；之后模型已缓存，刷新页面也能快速就绪。
- **主体突出的照片效果最好**：人物肖像、单个物体、有明显前后景的风景照，深度层次清晰，模型推断最稳定；纯纹理、大面积纯色或抽象图案的深度信息少，效果会打折扣。
- **深度图是「相对深度」**：输出亮度经过 0–255 归一化，表示画面内像素的相对远近关系，并不是以米为单位的绝对距离，适合做视觉层次参考和图像处理掩码。
- **用于 AI 绘画深度控制**：生成的深度图可以直接作为 Stable Diffusion ControlNet（Depth）等流程的控制图，帮助保持构图的空间结构。
- **配合景深虚化使用**：把深度图当作选区/蒙版，在 Photoshop 等工具中对远景区域做模糊，就能模拟大光圈镜头的景深效果。
- **图片太大先压缩**：超过 10MB 会被拒绝上传，过大的图片可以先用工具派的图片压缩工具处理后再上传，速度也更快。

## 常见问题

**Q1：上传的图片会被传到服务器吗？**
不会。本工具采用浏览器本地 AI 方案，图片读取和模型推理全部在你自己的设备上完成，图片不会上传到任何服务器，页面上的隐私说明也明确标注了这一点。

**Q2：为什么第一次使用时加载很慢？**
首次使用需要下载约 27MB 的 Depth Anything 模型文件，页面会显示百分比进度条。下载完成后模型会自动缓存在浏览器本地，之后再用就无需重新下载，速度会快很多。

**Q3：深度图里的亮和暗分别代表什么？**
深度图是单通道灰度图，模型输出的深度值被线性归一化到 0–255：不同亮度对应不同的相对深度，用来表现画面的远近层次。它反映的是画面内的相对关系，不是绝对物理距离。

**Q4：支持哪些图片格式和大小？**
支持浏览器可识别的常见图片格式（如 JPG、PNG、WebP 等，即 `image/*`），单张图片大小不能超过 10MB；上传非图片文件或超限文件时页面会给出错误提示。

**Q5：生成的深度图能用来做什么？**
常见用途包括：作为 AI 绘画 ControlNet 的深度控制图、制作景深虚化效果的选区蒙版、3D 重建与视差图生成的前期数据、AR/VR 场景的空间理解等。

**Q6：点击「开始估计」后失败了怎么办？**
请先确认已成功上传图片（按钮在未上传时不可用）。若提示「深度估计失败」，可尝试刷新页面重新加载模型后再试一次，或更换一张主体更清晰、体积更小的图片。

