一句话判断
与已知的 Worker 架构不同,Workers Cache 将缓存前置并视为源站,支持 stale-while-revalidate 和按用户隔离,正在使用 Cloudflare Workers 的开发者应阅读原文了解计费变化和集成状态。
核心信息
Cloudflare 推出 Workers Cache,这是一个位于 Worker 入口点前面的分层缓存,将 Worker 视为源站,缓存其响应以减少重复代码执行。关键设计包括默认两层 Tiered Cache、通过 ctx.props 实现按用户缓存、entrypoint 链独立缓存控制,以及标准 HTTP 缓存行为。计费方面,缓存命中只收请求费免 CPU 时间,MISS 正常计费。当前限制包括 Smart Placement 与缓存选址独立、响应大小上限 512MB、框架集成仅 Astro 落地。
原始内容
相关动态
OpenAI Launches Aix Shell Micro
OpenAI 发布了其首款硬件产品 Codex Micro,一款售价 230 美元的桌面控制器,用于管理工作流程。
Claude Managed Agents 支持500个技能项目升级
Anthropic 在Claude 3系列推出2024年2月新特性,实现代理系统技能数量扩展至500项,增强自定义化程度。更新后的API参数文档显示请求头需包含新版本控制标识符v20240201。相较Claude 2的100技能限制,新版本实现10倍扩容空间,核心优化体现在事件触发策略更新与上下文处理模块重构。
AI可能替代低质量人工代码工作
作者和Tobi Lutke分析AI代码替代趋势,指出大量低效人力资源可能被AI替代,核心阻力是系统集成问题。认为替代阻力不是技术瓶颈,而是与现有人工工作质量和流程的适配问题。
LiveKit 优化 Gemma 4 31B 性能
LiveKit 在自家推理平台 LiveKit Inference 上部署 Google Gemma 4 31B 模型,在实时语音应用中实现接话延迟比 GPT-4.1 低 5.2 倍(192 毫秒对 1006 毫秒)、成本约六分之一(省 83%)的效果;酒店前台场景测试中任务完成率达 88%,超过 GPT-4.1(73%)和 Gemini...
InternVLA-A1.5 发布四个 ModelScope 检查点
InternVLA-A1.5 新模型在 ModelScope 上发布了四个检查点,其中包含 2.69B 参数的基础版本以及 LIBERO、RoboTwin 2.0、DOMINO 的任务特定版本。该模型在六项仿真基准赛中报告了最佳整体成绩,分别为 LIBERO 98.9、LIBERO-Plus 84.8、RoboTwin 2.0 93.2。...