Signal Feed

#AI模型 主题信号第 7 页

围绕 AI模型 的精选动态、来源摘要和重要性判断。

动态列表

01

Signs of introspection in large language models

Anthropic 发布了一篇关于大语言模型内省能力的新研究,使用 concept injection 这种实验方法检验 Claude 模型是否能识别自身内部状态。研究显示,当前 Claude 模型中存在一定程度的内省意识和对内部状态的控制能力,但这种能力仍然高度不稳定、范围有限,且作者明确表示没有证据表明其内省方式或程度接近人类。测试中...

Anthropic-research2025年10月29日 09:20#研究突破#大模型#AI模型
值得跟进
02

The persona selection model

Anthropic 在一篇新文章中提出“persona selection model”,用来解释现代 AI 训练为何会默认产生人类化行为。文章指出,Claude 这类助手在 pretraining 中通过预测海量文本,先学习到各种“persona”,post-training 只是把其中的 Assistant persona 调整得更知...

Anthropic-research2026年02月23日 19:53#研究突破#AI模型#AI安全
观察
03

An update on our model deprecation commitments for Claude Opus 3

Anthropic 更新了 Claude Opus 3 的模型退役安排。该模型于 2026 年 1 月 5 日正式退役,但 Anthropic 继续向所有付费 claude.ai 用户开放,并在 API 上提供申请访问;同时,Anthropic 还为它开设了写作栏目,未来至少 3 个月将每周发布一篇文章。Anthropic 说明,此举是其...

Anthropic-research2026年02月26日 04:02#模型发布#行业动态#AI模型
观察
04

Our First Proof submissions

OpenAI 使用内部模型完成了 First Proof 项目的全部 10 道研究级数学证明题,并于 2026 年 2 月 14 日 0:00 PT 公开了 10 份 proof attempts 及附录中的 prompt patterns 和示例。根据专家反馈,OpenAI 认为其中第 4、5、6、9、10 题的证明尝试“很有可能正确”...

OpanAI-Research2026年02月20日 22:30#研究突破#大模型#AI模型
值得跟进
05

Introducing OpenAI Privacy Filter

OpenAI 发布了 Privacy Filter,一个开源权重的文本 PII 检测与脱敏模型,支持在本地运行,面向训练、索引、日志和审核等隐私工作流。该模型是双向 token-classification 架构,支持最长 128,000 tokens 上下文,总参数量 1.5B、活跃参数 50M,可一次前向推理完成标签判定并用约束 Vi...

OpanAI-Research2026年04月22日 08:00#模型发布#开发者工具#AI模型
观察
06

SpaceX 公布 S-1

SpaceX 于 2026-05-20 提交 S-1 文件,披露最快将于 2026 年 6 月 IPO,并说明 xAI Merger 已于 2026-02-02 生效,xAI 普通股按每 1 股换 0.1433 股 SpaceX 普通股(pre-split)计算,随后 SpaceX 又在 2026-05-04 进行了 5:1 forwar...

twitter关注列表2026年05月21日 08:49#行业动态#基础设施#AI模型
高优先级
07

Cohere 发布 Command A+

Cohere 和 Cohere Labs 发布了开源模型 Command A+,许可证为 Apache 2.0。该模型面向 agentic、多语言和推理密集任务,同时支持图像输入,参数规模为 25B active parameters、218B total parameters,上下文长度为 128K。Hugging Face 页面给出了...

twitter关注列表2026年05月21日 03:22#模型发布#开源#AI模型
值得跟进
08

Hugging Face 发布 Carbon

Hugging FaceBio 发布了名为 Carbon 的一组 genomics models,面向 biotech/biogenomics 场景。Georgia Channing 还给出了配套资源:collection、code、evals 和 tech report,说明该项目已提供模型集合、GitHub 代码、dna-benchm...

twitter关注列表2026年05月20日 00:24#开源#AI模型#开发者工具
观察
09

Google 的 Gemini 3.5 Flash

Artificial Analysis 获得 Google DeepMind 的 Gemini 3.5 Flash 预发布访问,并对其进行了评测。该模型在 Artificial Analysis Intelligence Index 上得分 55,较 Gemini 3 Flash 提升 9 分;在 GDPval-AA 上的 Elo 为 1...

twitter关注列表2026年05月20日 01:52#模型发布#基准测试#AI模型
观察
10

CNA:用神经元定位行为

Nous Research 发布 Contrastive Neuron Attribution(CNA),一种通过对比提示对来定位并消融稀疏 MLP 神经元电路的方法,且不需要训练 sparse autoencoder、不修改权重,也不会降低通用能力基准表现。该方法只用少量能诱发目标行为及其相反行为的对比提示对,找出激活差异最大的前 0....

twitter关注列表2026年05月20日 00:47#研究突破#AI模型#AI安全
值得跟进
11

SenseNova-U1-8B-MoT-Infographic 上线 ModelSc

SenseNova-U1-8B-MoT-Infographic 已在 ModelScope 上线,作为 SenseNova-U1-8B-MoT 的信息图专项变体,采用 Apache 2.0 许可。该模型面向海报、图表、arXiv 风格页面和复杂多栏排版,支持 100+ 种风格与布局;在 BizGenEval 上 hard/easy 为 4...

twitter关注列表2026年05月19日 21:36#模型发布#AI模型#开发者工具
观察
12

上海 AI Lab 开源了 Intern-S2-Preview

上海 AI Lab 开源了 Intern-S2-Preview,一个 35B 的科学多模态模型,宣称在核心科学基准上可匹配万亿参数级的 Intern-S1-Pro,并采用 Apache 2.0 许可。文章还指出它在生物、分子推理、遥感、科学智能体以及数学、通用多模态、指令遵循和 coding agent 等基准上领先开源模型,说明科学任务...

twitter关注列表2026年05月19日 14:16#模型发布#开源#AI模型
值得跟进
13

Cursor 发布了自研编码模型 Composer 2.5

Cursor 发布了自研编码模型 Composer 2.5,并称其在性能评分上已进入与 Opus 4.7 同一区间,最大差距不到 1 分。与此同时,Composer 2.5 的价格大幅低于 Opus 4.7,输入成本约便宜 10 倍、输出成本约便宜 30 倍,意味着代码模型竞争正在从“效果”快速转向“性价比”。

twitter关注列表2026年05月19日 10:02#模型发布#开发者工具#AI模型
值得跟进
14

Odyssey 发布了 Agora-1

Odyssey 发布了 Agora-1,一个多智能体 world model,可支持最多 4 个人类或 AI 参与者在同一实时模拟世界中互动,并提供了一个可试玩的研究预览,示例是多人 GoldenEye 死斗。它的意义在于把 world model 从单人预测推进到共享状态一致性的多人环境,指向游戏、仿真、教育和机器人等更广泛的交互式 A...

twitter关注列表2026年05月19日 03:25#研究突破#智能体#AI模型
观察
15

ArenAI(原 LMArena)给 Qwen3.7-Max-Preview 的内测

ArenAI(原 LMArena)给 Qwen3.7-Max-Preview 的内测排名第13,作者称其为当前版本国模 SOTA;其中数学能力升至总榜第7,编程第10,视觉第16。文章还通过 three.js 绘图案例指出其在空间理解和指令遵循上较 Qwen3.6-Plus 有明显提升,说明 Qwen 新版本在多模态与复杂指令执行上继续增...

twitter关注列表2026年05月19日 03:33#模型发布#基准测试#AI模型
观察
16

HiDream-ai 开源了 HiDream-O1-Image 系列图像生成模型

HiDream-ai 开源了 HiDream-O1-Image 系列图像生成模型,核心版本为 8B,采用 Pixel-level Unified Transformer,不依赖外部 VAE 或独立文本编码器,可支持文本生成图像、图像编辑、主体个性化与版式/长文本渲染,最高分辨率达到 2048×2048。项目还公布了基准结果,Dev-260...

twitter关注列表2026年05月19日 02:03#模型发布#开源#AI模型
值得跟进
17

Cloudflare 安全团队在自家 50 多个代码仓库上测试了 Anthropic

Cloudflare 安全团队在自家 50 多个代码仓库上测试了 Anthropic 的 Mythos Preview,发现它不仅能发现漏洞,还能把多个低危缺陷串成可利用的攻击链,并自动生成、编译和验证利用证明。文章强调,AI 正在把漏洞研究从“找问题”推进到“构造攻击与验证 exploit”的阶段,未来软件安全流程需要围绕更快的发现、修...

twitter关注列表2026年05月19日 00:10#AI安全#行业动态#AI模型
值得跟进
18

Alibaba 的 ModelScope 团队提出并开源了 Diffusion Te

Alibaba 的 ModelScope 团队提出并开源了 Diffusion Templates:一种面向扩散模型的统一插件框架,尝试把结构控制、亮度、颜色、图像编辑、超分辨率等可控能力做成可组合、可复用的组件。团队基于 FLUX.2-klein-base-4B 训练了 11 个模板并公开代码、模型和数据集,意味着扩散生态正从单点技巧走...

twitter关注列表2026年05月18日 21:36#开源#研究突破#AI模型
观察
19

ModelScope 团队发布了 Diffusion Templates:一个统一的

ModelScope 团队发布了 Diffusion Templates:一个统一的可控扩散插件框架,并同步开源了框架、训练代码、11 个模型和约 1.2 TB 的 ImagePulseV2 数据集(17 个子数据集,Apache 2.0)。这意味着可控扩散能力可以以更模块化、可组合的方式迁移到不同底座模型上,降低训练和集成门槛。

twitter关注列表2026年05月18日 21:36#开源#研究突破#AI模型
值得跟进
20

腾讯 Hunyuan 开源了 HY-World 2.0 的完整推理代码和全部模型权重

腾讯 Hunyuan 开源了 HY-World 2.0 的完整推理代码和全部模型权重,这是一个面向 3D 世界重建、生成与仿真的多模态 world model。该系统支持从文本、单张图像、多视图图像和视频生成可编辑、可导入引擎的 3D 世界资产,意味着世界模型正从“生成视频”走向“生成可交互的 3D 内容”。

twitter关注列表2026年05月18日 16:19#开源#研究突破#AI模型
值得跟进