发生了什么
NVIDIA AI 发布 LocateAnything(CVPR2026)
为什么值得关注
并行解码边界框技术显著提升视觉定位效率,对AI机器人和智能体的实时感知能力有重要价值。
信息来源
以下内容来自公开来源,可打开原文继续核验。
01
LocateAnything视觉检测模型
NVIDIA AI研究团队在CVPR2026会议上发布了LocateAnything视觉语言检测模型,该模型在HuggingFace上趋势排名第一。模型训练于138M高质量样本,采用并行解码边界框技术而非传统的一次一个坐标方式,提高了定位精度并大幅增加视觉定位和检测的吞吐量。
打开原始来源 ↗