Signal Feed

#基础设施 主题信号第 7 页

围绕 基础设施 的精选动态、来源摘要和重要性判断。

动态列表

01

LongLive 2.0

NVlabs 开源了 LongLive 2.0 仓库,提供长视频生成的基础设施代码、论文、Demo 和模型权重。该版本支持用于 AR training、DMD distillation 和 inference 的 NVFP4 与并行机制,官方给出的推理速度为 45.7 FPS。仓库还支持 multi-shot、sequence paral...

twitter关注列表2026年05月20日 00:02#开源#模型发布#基础设施
观察
02

Claude 在 Code with Claude London 活动中发布了 Cl

Claude 在 Code with Claude London 活动中发布了 Claude Managed Agents 的两项新能力:self-hosted sandboxes(公测)和 MCP tunnels(研究预览)。这意味着企业可以在自己的基础设施或受控云环境中运行代理,并让代理访问私有网络内的 MCP 服务,同时默认套用安全...

twitter关注列表2026年05月19日 15:57#智能体#产品更新#基础设施
值得跟进
03

llama.cpp 为 Qwen3.6 系列加入 MTP(Multi Token P

llama.cpp 为 Qwen3.6 系列加入 MTP(Multi Token Prediction)支持后,本地推理速度显著提升;示例中在 A10G 上,Qwen3.6-27B dense generation 从 25 tok/s 提升到 45 tok/s,提升约 78%。这说明开源本地推理栈在通用硬件上的效率继续逼近可日常使用水平...

twitter关注列表2026年05月19日 03:27#开发者工具#基础设施#开源
值得跟进
04

英伟达开始向 Anthropic、OpenAI、SpaceX 和 Oracle Cl

英伟达开始向 Anthropic、OpenAI、SpaceX 和 Oracle Cloud 交付其首款自研通用 CPU Vera。该 CPU 面向 agentic AI 场景,强调高并发、高吞吐下的调度编排与工具调用,意味着英伟达正在把 AI 基础设施从“只卖 GPU”扩展到覆盖 Agent 运行时的异构计算栈。

twitter关注列表2026年05月19日 10:45#基础设施#AI产业#开发者工具
值得跟进
05

Anthropic 在 Claude Code 文档中推出了 Opus 的 fast

Anthropic 在 Claude Code 文档中推出了 Opus 的 fast mode:保持与标准 Opus 相同的质量与能力,但响应速度提升约 2.5 倍,代价是更高的按 token 计费。该功能处于 research preview,适合快速迭代、实时调试和时间敏感任务,意味着代码助手开始把“低延迟”作为可显式切换的产品能力。

twitter关注列表2026年05月19日 03:18#产品更新#开发者工具#基础设施
观察
06

Browser Use 团队分享了其 Agent Sandbox 基础设施方案:从

Browser Use 团队分享了其 Agent Sandbox 基础设施方案:从 AWS Lambda 迁移到 Unikraft micro-VM,并将整个 agent 运行在隔离沙箱中,通过 control plane 代理 LLM 调用、文件同步和外部访问。文章强调该方案可实现秒级启动、按需休眠、无密钥暴露,并支持本地 Docker...

twitter关注列表2026年05月19日 02:40#智能体#基础设施#开发者工具
观察
07

Cursor 发布了自家编程模型 Composer 2.5

Cursor 发布了自家编程模型 Composer 2.5,主打长任务执行、更强的复杂指令跟随能力,并称在同等水平模型上效率最高可提升 10 倍,且未来一周将把默认可用额度翻倍。官方同时披露该模型基于 Moonshot 的 Kimi K2.5 二次训练,并计划与 SpaceXAI 从零训练一个更大的模型,算力规模达到当前的 10 倍。

twitter关注列表2026年05月19日 01:50#模型发布#开发者工具#基础设施
观察
08

Claude Console 新增 Prompt cache diagnostics

Claude Console 新增 Prompt cache diagnostics,支持在请求未命中缓存时直接查看是哪一段 prompt 发生了变化,以及这次变化消耗了多少 token。对使用缓存优化推理成本、排查上下文变更导致的费用波动很有帮助。

twitter关注列表2026年05月19日 01:59#产品更新#开发者工具#基础设施
值得跟进
09

Anthropic 在 Claude API 中新增了 Cache diagnost

Anthropic 在 Claude API 中新增了 Cache diagnostics(测试版),可通过传入上一条响应的 id 来定位两次请求在模型、system prompt、tools 或消息历史中的首个分叉点。该能力解决了 prompt caching 失效时只能看到 cache_read_input_tokens 下降、却难以...

twitter关注列表2026年05月19日 01:59#开发者工具#产品更新#基础设施
值得跟进
10

Dell 在 Dell Tech World 上宣布

Dell 在 Dell Tech World 上宣布,Dell Enterprise Hub 已接入 Kimi K2.6、DeepSeek V4 Pro、GLM 5.1、MiniMax M2.7 和 DeepSeek V4 Flash,且可一键部署到为 NVIDIA B300 优化的 PowerEdge XE9780。该信息表明企业级 A...

twitter关注列表2026年05月19日 02:07#产品更新#基础设施#行业动态
值得跟进
11

Composer 2.5 基于 Kimi K2.5 构建

Composer 2.5 基于 Kimi K2.5 构建;同时,SpaceXAI 表示正与合作方一起从零训练一个更大的模型,使用约 10 倍总算力,并依托 Colossus 2 的百万级 H100 当量和双方的数据、训练技术,预计会带来模型能力的大幅跃升。 这意味着上游基础模型能力和算力投入仍在快速升级,可能影响后续产品与生态竞争格局。

twitter关注列表2026年05月19日 00:52#模型发布#基础设施#大模型
观察
12

Anthropic 宣布收购 Stainless

Anthropic 宣布收购 Stainless,后者长期为 Anthropic 生成官方 SDK,并提供 SDK、CLI 与 MCP server 工具链。此举表明 AI 竞争正在从模型能力延伸到“让 agent 连接真实软件系统”的基础设施层,连接性与开发者体验正在成为 Claude 平台的重要护城河。

twitter关注列表2026年05月19日 01:13#开发者工具#智能体#基础设施
值得跟进
13

OpenRouter 发布了面向长时程 agent 的一组基础能力

OpenRouter 发布了面向长时程 agent 的一组基础能力,包括多步长循环、成本与步数上限、可恢复状态、实时流式进度、自动重试、语音输入,以及人工审批和自我复核。它说明 agent 从“单次调用”走向“可持续运行的工作流”,对构建可靠的生产级 agent 基础设施有直接意义。

twitter关注列表2026年05月19日 00:00#智能体#基础设施#开发者工具
观察
14

Baidu 在 2026 年一季度实现 AI 业务持续扩张

Baidu 在 2026 年一季度实现 AI 业务持续扩张,Core AI-powered Business 收入超过 136 亿元人民币,同比增长 49%,首次占到 Baidu General Business 收入的一半以上。与此同时,AI Cloud Infra 收入同比增长 79%,GPU Cloud 增长 184%,说明其 AI...

twitter关注列表2026年05月18日 22:05#行业动态#AI产业#基础设施
值得跟进
15

Anthropic CFO 在访谈中披露

Anthropic CFO 在访谈中披露,公司今年第一季度年化营收从 90 亿美元跃升至 300 亿美元出头,并强调算力同时支撑训练、内部研发和外部服务,内部超过 90% 的代码已由 Claude Code 完成。整体上,这说明前沿模型公司的竞争已从单纯模型能力,转向算力调度、研发效率与商业化扩张的系统能力。

twitter关注列表2026年05月18日 13:48#行业动态#大模型#基础设施
高优先级
16

NVIDIA Vera Rubin平台通过与Groq 3 LPX的配合

NVIDIA Vera Rubin平台通过与Groq 3 LPX的配合,解决了Agentic AI在万亿参数MoE模型上的扩展问题,实现了低延迟和高吞吐量。

twitter关注列表2026年05月15日 05:03#智能体#基础设施#AI推理
观察
17

Highlight 重建了其 agentic chat 后端

Highlight 重建了其 agentic chat 后端,采用 Cloudflare Durable Objects 架构,将 P90 TTFT 从 8000ms 优化至 300ms,并为每个 agent 分配独立小数据库以解决并发和性能问题。

twitter关注列表2026年05月16日 00:04#智能体#基础设施#性能优化
值得跟进
18

百度在2026年Baidu Create大会上

百度在2026年Baidu Create大会上,李彦宏提出“每日活跃智能体(DAA)”指标,并展示面向智能体时代的全栈基础设施和AI演化理论。

twitter关注列表2026年05月15日 22:00#智能体#指标创新#基础设施
值得跟进