ModelScope 上线了 Scenema Audio
ModelScope 上线了 Scenema Audio,这是一个 13B 的表达式语音生成模型,支持零样本声音克隆、情绪表演和场景感知音频生成。其描述显示模型可在单次输出中实现情绪连续变化,支持 13 种语言、长文本旁白自动分段与音色一致性,说明语音生成正向更强控制力和更自然的场景化合成演进。
围绕 AI模型 的精选动态、来源摘要和重要性判断。
ModelScope 上线了 Scenema Audio,这是一个 13B 的表达式语音生成模型,支持零样本声音克隆、情绪表演和场景感知音频生成。其描述显示模型可在单次输出中实现情绪连续变化,支持 13 种语言、长文本旁白自动分段与音色一致性,说明语音生成正向更强控制力和更自然的场景化合成演进。
有人基于 xAI 开源的 xai-org/x-algorithm 仓库,逐行追溯源码并整理出一个完整的 X「For You」推荐算法 Wiki,包含 29 个互链页面、5900+ 行源码级分析,并明确给出文件与行号锚点。它说明开源推荐系统已经进入可被系统化拆解和复现的阶段,对理解社交信息流排序、召回、过滤和内容理解模块很有参考意义。
作者在 arXiv 提交名为 Nexus 的多智能体框架,用于结合宏观/微观时间波动并融入上下文进行时间序列预测,展示出比传统模型更强的预测能力。
Daniel Miessler提出9级个人AI成熟度模型(PAIMM),从聊天机器人到主动助手的演进路径,揭示AI从被动回答到主动执行任务的转变趋势,对行业意味着需关注AI主动性与整合能力的发展方向
NBER 研究表明,AI 需求推动数据中心扩张,导致县级就业、工资、收入和房价上升,同时电价也随之提高。
研究揭示 boredom 与 sadism 的关联,对 AI 应用有影响
AI Alliance推出Project Tapestry,一个支持全球协作开发前沿AI模型的开源平台,强调本地控制和长期独立,旨在改变AI开发的集中模式。
本期《Superintelligence》汇集了2026年5月至4月的AI领域重大动态,包括OpenAI 持续工作流的编码代理、DeepSeek V4 对NVIDIA 硬件的挑战、Anthropic 企业部署模式、AI 基础设施竞争(Google TPU、OpenAI 脱离 Microsoft)以及全球 AI 政策风险,覆盖模型发布、产业...
该文章介绍了DAIR.AI发布的最新顶级AI论文,重点展示了Lighthouse Attention技术的创新设计,强调其对长文本理解的提升,并通过实验数据验证了性能改进。对行业而言,这是一项重要的技术突破,推动了AI模型训练效率的优化。
Kyle Hessling 发布 Qwopus3.5-9B-coder,一款 9B 开源模型经 fine‑tuning 后在 HermesAgent‑20 得分 85、ToolCall‑15 得分 100,展示出与更大模型相近的性能并可在普通 16GB 设备上运行。
Citadel 首席执行官 Ken Griffin 表示,AI 代理(Agent)已实现了从几天到几周的工作效率提升,取代了金融硕博士数月甚至数年的工作,标志着 AI 在对冲基金领域的实际应用进入新阶段。
SpaceXAI 表示 Grok V9 基于 1.5T 模型已完成训练,计划在今夏推出,并在后续加入 Cursor 数据进行微调、SFT 和 RL,预计 3-4 周后发布。
Claude Mythos模型在Google Cloud控制台上被发现,预览标签已消失,这可能预示Anthropic准备公开发布该模型。
Claude Mythos被发现出现在Google Cloud控制台,引发其可能公开发布的猜测,并提到其曾被用于构建绕过Apple安全的macOS内核漏洞。
Ant Ling转发LMSYS Org关于Ring-2.6-1T这款万亿参数开源模型的发布,该模型提供高级Agent工作流、可调推理努力以及异步RL训练,现已在SGLang支持。
Ant Ling 转发 Novita AI 帖子,宣布 Ring-2.6-1T 模型开源,在 OpenRouter 上限时 90% 折扣,旨在促进开发者构建大规模智能体工作流。
研究团队开发了一种30B-A3B推理模型,通过逆困惑度课程和强化学习技术在物理和数学奥林匹克竞赛中实现金牌水平表现。
CircleStone Labs与Comfy Org合作发布了Anima-Base v1.0,一个2B参数的文本到图像模型,专注于动漫和插画生成,支持多种分辨率和提示词格式。
ClickUp根据选择的模型(如Claude Opus 4.7、Gemini 3.1 Pro、GPT-5.5)调整了Brain平台的UI交互提示,用户可从下拉菜单中选择不同模型进行对话。
中国移动推出JT-35B-Flash大模型,智能指数提升11分至36,在AA-Omniscience和τ²-Bench评测中表现优异,标志其在AI模型开发中的技术进步