一句话判断
重点关注其对复杂布局、长文本理解及嵌套 UI 渲染的生产力突破。
核心信息
Alibaba Qwen 团队发布了第三代图像生成基座模型 Qwen-Image-3.0。该模型支持高达 4.5k tokens 的长提示词,可实现复杂的布局生成(如报纸、分镜脚本、3x3 信息图),具备 10px 级别清晰的文本渲染能力,并支持 12 种语言和 100 多种艺术风格。
原始内容
相关动态
百度开源 Unlimited-OCR 再登 HuggingFace 前三
百度开源的无限制OCR模型Unlimited-OCR(30亿参数,32K上下文)再次登上HuggingFace总榜第三,被Yann LeCun转发。该模型可一次性解析100页PDF,40页后错误率低于0.11,准确率93%,GitHub Star 1.65万,HuggingFace下载量224万。技术核心是R-SWA机制,能保持恒定KV ...
Cosmos 3 Super模型发布
NVIDIA AI 发布了 4 步 Cosmos 3 Super 模型,生成图像和视频速度比原版快 25 倍,在 Artificial Analysis 基准中图像到视频(无音频)排名第一,文本到图像排名第二,模型已在 Hugging Face 开源。
Codex 1000万付费用户推动OpenAI进军企业市场
OpenAI的Codex已突破1000万付费用户,其中大量用户选择Pro层套餐,这直接冲击了Anthropic在B2B和企业市场的收入优势。文章指出,OpenAI正通过Codex向高价值专业客户市场渗透,而Anthropic因竞争压力被迫保留Fable 5在Max层套餐中,这种竞争有望加速Opus 5和Fable 5.5的发布。
Nanbeige4.2 发布 Looped Transformer 和 Agent 模型
Nanbeige 在 ModelScope 发布 Nanbeige4.2 系列,包含一个 28T-token 的 Looped Transformer base 模型和一个 3B 参数的 SFT+RL agent 模型。团队声称在 agent 基准测试上超越 Qwen3.5-9B 和 Gemma4-12B。
AI解决87年雅各比猜想
Levent Alpöge在Anthropic完成对87年前未解决数学猜想的反例发现,证明yaqūjīzé jiāujiàn(雅各比猜想)存在无法恢复单一输入的多项式映射,验证已通过Lean数学形式化检查。与人类研究者相比,AI通过计算数学探索发现此反例,展现数学证明领域AI能力增强。