Signal Brief

模型不是瓶颈,Harness 才是;而 Harness 里最被低估的一层是上下文质量

企业 Agent 应用中,上下文跨散系统导致信息关系无法整合。Glean 提出通过 MCP Gateway 集中构建统一索引 + 知识图谱,将跨系统数据的关联解耦到上下文层,测试中偏好率提升 2.5 倍且节省 30% Token 成本。方案同时通过 Glean 授权层解决了 MCP 级别的零散权限治...

twitter关注列表 meng shao (@shao__meng) 发布 2026-07-27 收录 2026-07-27 值得跟进

一句话判断

身份丰富:Glean 将连接性与上下文工程解耦,175 条企业查询显示 2.5 倍偏好率;注意统一权限治理方案与弱化 AI 角色转移能力

核心信息

企业 Agent 应用中,上下文跨散系统导致信息关系无法整合。Glean 提出通过 MCP Gateway 集中构建统一索引 + 知识图谱,将跨系统数据的关联解耦到上下文层,测试中偏好率提升 2.5 倍且节省 30% Token 成本。方案同时通过 Glean 授权层解决了 MCP 级别的零散权限治理。

原始内容

模型不是瓶颈,Harness 才是;而 Harness 里最被低估的一层是"上下文质量"! 在企业 Agent 应用中,上下文往往散落在十几个系统里(Jira、Confluence、GitHub、Slack……),只能看到单一系统的智能体等于"盲人摸象"! 对 MCP 的关键批评:连通性 ≠ 上下文质量 @Sumanth_077 指出: · MCP 解决的是连接层问题——用统一协议接入所有系统; · 但现成的 MCP 工具各查各的源:Jira 一套 API、GitHub 一套 API,搜索逻辑、索引、排序互不相通,跨系统的信息关系没有任何共享理解; · 结果是:当问题横跨多个系统时,模型被迫在运行时做数据的 join、去重、排序和关系推断。 这不是上下文工程,这是让模型在回答问题之外还要兼职做数据工程。后果是烧更多 token、答案更不准,且每一次查询都在重复付这个代价——"Harness 是连通的,但里面的上下文是碎的"。 Glean @glean 给出的方案:把 join 提前做 解法思路是将运行时的关联计算前置为预计算: · MCP 调用不再直接打到各个源系统的 API,而是经过 Glean 的 MCP Gateway,路由到一个跨全公司数据(100+ 连接器)预先构建好的统一索引 + 知识图谱; · 文档、人、项目、决策之间的关系提前解析好,智能体拿到的是已经完成关联、排序、去重的结构化上下文,而非五个 API 返回的原始碎片。 文中的对比数据:在约 175 条企业查询、相同模型和 Harness 的条件下,Glean 的上下文被偏好的比例是现成 MCP 工具的 2.5 倍,后者平均多耗 30% token。 集中式上下文层顺便解决了治理问题 MCP 规模化后的安全治理是真痛点,文章的方案是让安全随上下文层"自带": · 每次调用继承源系统权限(Jira 里看不到的工单,通过 Gateway 也看不到); · OAuth 走 Glean 的授权服务器,下游凭证不落在宿主机; · 管理员控制工具分发,每次调用都做提示注入和恶意内容检查。 ![photo](https://pbs.twimg.com/media/HOPapfZaEAAzWcr.jpg) > **引用原帖 Sumanth (@Sumanth_077):** > https://t.co/Qd8FqU2E5n > https://x.com/Sumanth_077/status/2081742978079662091

相关动态

01

Kimi开源FlashKDA内核

Kimi团队开源了FlashKDA(基于CUTLASS的Delta Attention内核),在H20上相比flash-linear-attention基线实现了1.72x-2.22x的预填充加速,可作为即插即用后端。

twitter关注列表2026-07-27#开源#技术突破#模型发布
观察
03

Modal推出Kimi K3大模型

Moonshot与Modal合作发布Kimi K3大模型,该模型参数量达到3T级别。Modal通过定制DFlash speculator架构优化,使模型推理速度加快且无性能损失。Modal作为Day 0合作伙伴参与推出,强调该模型为目前合作过的最强大开源模型。

twitter关注列表2026-07-27#AI模型#产品发布#技术突破
值得跟进
04

Kimi K3 开源权重及技术报告

Kimi.ai 开源其最强模型 Kimi K3 的权重和技术报告。Kimi K3 是一个 2.8T 参数的 MoE 模型,支持原生视觉理解和 1M token 上下文窗口,采用新架构使每单位计算智能提升 2.5 倍。同时开源高性能 attention kernels、MoE 通信库和用于规模化运行 agent 环境的基础设施。

twitter关注列表2026-07-27#模型开源#大模型#技术突破
高优先级