Signal Brief

Cloudflare 上线 Workers Cache

Cloudflare 推出 Workers Cache,这是一个位于 Worker 入口点前面的分层缓存,将 Worker 视为源站,缓存其响应以减少重复代码执行。关键设计包括默认两层 Tiered Cache、通过 ctx.props 实现按用户缓存、entrypoint 链独立缓存控制,以及标准...

twitter关注列表 meng shao (@shao__meng) 发布 2026-07-07 收录 2026-07-07 观察

一句话判断

与已知的 Worker 架构不同,Workers Cache 将缓存前置并视为源站,支持 stale-while-revalidate 和按用户隔离,正在使用 Cloudflare Workers 的开发者应阅读原文了解计费变化和集成状态。

核心信息

Cloudflare 推出 Workers Cache,这是一个位于 Worker 入口点前面的分层缓存,将 Worker 视为源站,缓存其响应以减少重复代码执行。关键设计包括默认两层 Tiered Cache、通过 ctx.props 实现按用户缓存、entrypoint 链独立缓存控制,以及标准 HTTP 缓存行为。计费方面,缓存命中只收请求费免 CPU 时间,MISS 正常计费。当前限制包括 Smart Placement 与缓存选址独立、响应大小上限 512MB、框架集成仅 Astro 落地。

原始内容

Cloudflare 上线 Workers Cache https://t.co/7E48Xhro1H Workers Cache 是位于 Worker 前面的分层缓存。当 Worker 已经成为"源站"本身时,CDN 缓存就应该像对待传统源站一样,挡在 Worker 前面吃流量,让 Worker 不必每次都跑。 这是 Cloudflare 架构哲学的一次翻转。2017 年 Workers 诞生时定位是"在缓存和源站前面做请求变换"——加 header、改 URL、A/B 测试。但近两年 Astro / TanStack Start / Next.js / Remix / SvelteKit 都把 Worker 编译成"服务器本身",Worker 即 origin。 此时旧架构的痛点暴露:每个请求都得跑代码,哪怕响应字节级相同。性能够快≠免费——既付延迟,也付 CPU 时间。 Workers Cache 给出了"第三条路"(区别于 SSG 与纯 SSR): · 按需 server-render,把渲染结果缓存起来,TTL 到期再重渲染; · 借助 stale-while-revalidate,连重渲染那一次都不让用户等; · 拿到静态站的速度,又拿到 SSR 的新鲜度,无需框架级 ISR 机制。 五个关键设计 1. 归属 Worker 而非 Zone:一个 Worker 一份缓存,跨 hostname / service binding / workers. dev / 预览 / 多租户共享或隔离;purge 只清当前 entrypoint 2. 默认两层 Tiered Cache:下层在每个 PoP,上层全网聚合;双 miss 才跑 Worker,无需任何配置 3. ctx.props 进 cache key:网关鉴权后把 userId 塞进 props 调后端 cached Worker,按用户天然隔离——把"鉴权"与"按用户缓存"从对立变组合 4. 缓存位于每个 entrypoint 之间:自评"最大解锁":一个 Worker 可写成 entrypoint 链,每段独立开/关缓存、独立 TTL 与 tag,缓存成为程序的一层而非外挂 5. 标准 HTTP 行为:Vary 按 RFC 9110/9111 全量实现;stale-while-revalidate 三段窗口(fresh / stale 后台刷新 / 窗口外才等) 计费要点 · HIT:只收请求费,免 CPU 时间;MISS/BYPASS 正常计费;无独立 SKU、无存储费。 · 隐藏成本:开启缓存后,原本免费的静态资产与 worker→worker 调用会按标准请求率计费(因为每次都要查缓存)。 当前限制 · Smart Placement 与上层缓存分别选址,全 miss 可能跨数据中心两次; · 响应大小临时统一按 Free 档 512 MB; · 框架集成仅 Astro 落地,Next.js / TanStack Start 在路上; · ctx.cache.invalidate()(标为过期而非硬删)待出。 ![photo](https://pbs.twimg.com/media/HMlfgQIaAAANJwd.jpg) > **引用原帖 Cloudflare (@Cloudflare):** > We are launching Workers Cache, a regionally tiered cache that sits directly in front of your Worker entrypoints. Infinitely composable, configured via standard HTTP headers. https://t.co/eBbxHIgUBA > https://x.com/Cloudflare/status/2074117419728007181

相关动态

02

Claude Managed Agents 支持500个技能项目升级

Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。

twitter关注列表2026-07-17#技术更新#产品改进#多模态
观察
03

AI可能替代低质量人工代码工作

作者和Tobi Lutke分析AI代码替代趋势,指出大量低效人力资源可能被AI替代,核心阻力是系统集成问题。认为替代阻力不是技术瓶颈,而是与现有人工工作质量和流程的适配问题。

twitter关注列表2026-07-17#AI#技术更新#分析
观察
04

LiveKit 优化 Gemma 4 31B 性能

LiveKit 在自家推理平台 LiveKit Inference 上部署 Google Gemma 4 31B 模型,在实时语音应用中实现接话延迟比 GPT-4.1 低 5.2 倍(192 毫秒对 1006 毫秒)、成本约六分之一(省 83%)的效果;酒店前台场景测试中任务完成率达 88%,超过 GPT-4.1(73%)和 Gemini...

twitter关注列表2026-07-17#技术突破#产品发布#模型
观察
05

InternVLA-A1.5 发布四个 ModelScope 检查点

InternVLA-A1.5 新模型在 ModelScope 上发布了四个检查点,其中包含 2.69B 参数的基础版本以及 LIBERO、RoboTwin 2.0、DOMINO 的任务特定版本。该模型在六项仿真基准赛中报告了最佳整体成绩,分别为 LIBERO 98.9、LIBERO-Plus 84.8、RoboTwin 2.0 93.2。...

twitter关注列表2026-07-17#技术#模型发布#产品发布
观察