Signal Brief

Cosmos 3 Super模型发布

NVIDIA AI 发布了 4 步 Cosmos 3 Super 模型,生成图像和视频速度比原版快 25 倍,在 Artificial Analysis 基准中图像到视频(无音频)排名第一,文本到图像排名第二,模型已在 Hugging Face 开源。

twitter关注列表 AK (@_akhaliq) 发布 2026-07-22 收录 2026-07-22 观察

一句话判断

新增了 4 步推理加速技术,速度提升 25 倍,且在基准测试中取得领先,值得试用并关注其架构细节。

核心信息

NVIDIA AI 发布了 4 步 Cosmos 3 Super 模型,生成图像和视频速度比原版快 25 倍,在 Artificial Analysis 基准中图像到视频(无音频)排名第一,文本到图像排名第二,模型已在 Hugging Face 开源。

原始内容

AK (@_akhaliq) 转发了 NVIDIA AI (@NVIDIAAI) 的帖子: The new 4-step Cosmos 3 Super models generate images and video up to 25x faster than the originals, and still rank among the best open-weight models on @ArtificialAnlys. 🥇 #1 for image-to-video (no audio) 🥈 #2 for text-to-image Try them on @huggingface: https://t.co/clK5nFZ0sK ![photo](https://pbs.twimg.com/media/HN127pFW8AAsNvV.jpg) ![photo](https://pbs.twimg.com/media/HN127pDW8AAb5Sa.jpg)

相关动态

02

百度开源 Unlimited-OCR 再登 HuggingFace 前三

百度开源的无限制OCR模型Unlimited-OCR(30亿参数,32K上下文)再次登上HuggingFace总榜第三,被Yann LeCun转发。该模型可一次性解析100页PDF,40页后错误率低于0.11,准确率93%,GitHub Star 1.65万,HuggingFace下载量224万。技术核心是R-SWA机制,能保持恒定KV ...

twitter关注列表2026-07-22#模型发布#开源#技术突破
观察
05

Qwen-Image-3.0 发布

Alibaba Qwen 团队发布了第三代图像生成基座模型 Qwen-Image-3.0。该模型支持高达 4.5k tokens 的长提示词,可实现复杂的布局生成(如报纸、分镜脚本、3x3 信息图),具备 10px 级别清晰的文本渲染能力,并支持 12 种语言和 100 多种艺术风格。

twitter关注列表2026-07-22#模型发布#技术更新#产品发布
观察