← 返回精选动态
精选动态

LocateAnything视觉检测模型

NVIDIA AI 发布 LocateAnything(CVPR2026)

更新于 2026年05月29日 03:51 1 条公开来源

发生了什么

NVIDIA AI 发布 LocateAnything(CVPR2026)

为什么值得关注

并行解码边界框技术显著提升视觉定位效率,对AI机器人和智能体的实时感知能力有重要价值。

信息来源

以下内容来自公开来源,可打开原文继续核验。

01

LocateAnything视觉检测模型

twitter关注列表 2026年05月29日 02:00

NVIDIA AI研究团队在CVPR2026会议上发布了LocateAnything视觉语言检测模型,该模型在HuggingFace上趋势排名第一。模型训练于138M高质量样本,采用并行解码边界框技术而非传统的一次一个坐标方式,提高了定位精度并大幅增加视觉定位和检测的吞吐量。

打开原始来源 ↗
← 返回精选动态