Overview
产品概述
Capabilities
核心能力
零样本相对深度估计
在 150 万标注图像和 6200 万以上无标注图像上联合训练,提供强泛化能力的单目相对深度估计,零样本性能优于 MiDaS v3.1。
零样本度量深度估计
支持零样本度量深度估计,效果优于 ZoeDepth,并可通过 NYUv2 和 KITTI 微调取得新的 SOTA 结果。
面向 ControlNet 的深度条件增强
基于 Depth Anything 重新训练深度条件 ControlNet,相比基于 MiDaS 的 ControlNet 获得更好的生成效果。
Use Cases
适用场景
-
01
任意图像的单目深度估计
面向任意图像和任意环境的鲁棒单目深度估计,在多个公共数据集和随机拍摄照片上表现出强大的泛化能力。
-
02
视频编辑中的深度估计
虽然 Depth Anything 本身是图像级深度估计方法,但可应用于视频编辑场景,为视频深度估计提供更好的深度图。
-
03
预训练编码器迁移到语义分割
将 Depth Anything 预训练编码器迁移到 Cityscapes 和 ADE20K 语义分割任务,可取得良好效果。
Integrations
集成能力
ControlNet
提供更好的深度条件 ControlNet,基于 Depth Anything 重新训练,优于基于 MiDaS 的 ControlNet。