一句话判断
值得阅读原文,获取内部视角对AI安全风险与开放模型实际使用的独特见解。
核心信息
前Anthropic员工Noah Lebovic改变观点,认为开放模型已足够强大,例如Opus 4.6和GLM 5.1/5.2在渗透测试中表现优于Anthropic模型。他观察到恶意行为者仍使用Claude Code或Codex订阅,而非开放模型,并爆料Anthropic的GTM人员通过大额合同降低安全限制,导致开放模型更可靠且不易受限制。
原始内容
相关动态
From Human-Centric to Agentic Code Review: The Impact of Different Generations of Generative AI Technology on Review Quality
GitHub 上 207 个项目的 102 万条拉取请求研究显示,逐步或快速采用 AI 代理可将审查时间缩短 2.5 至 4.5 天/KLOC,而早期大量使用 LLM 审阅未带来显著效率提升,且 AI 审阅导致审阅气味在 78% 至 94% 的请求中出现,高于人工审阅的 69% 至 76%。
Human Capital, AI, and Labor Commoditization
一项研究分析AI对自由职业市场的影响,发现在ChatGPT后,AI暴露岗位中人力资本信号重要性下降7.8%,价格信号重要性上升1.1%,导致需求向更廉价工人转移,支持AI使这些工人更可替代的观点。
DeepSeek 暂停第二轮融资
DeepSeek reportedly paused its second fundraising round targeting a valuation near $74B, after raising about $7.4B in June. The pause is partly due to Liang Wenfeng's fru...
中国监管AI伴侣
中国出台新规限制AI伴侣服务,要求提供商遏制操控性依恋、识别过度依赖并提醒用户对话对象为AI;数据表明每日情感聊天减少对人类支持的10.3%;同时禁止向未成年人提供虚拟伴侣或亲属。
Grok 4.6 两周内发布,参数性能提升
Elon Musk 预告 SpaceXAI 的 Grok 4.6 模型将在两周后发布,基于 2T 参数(上一代 1.5T),预计性能超越 Kimi K3;同时 Grok 4.7 将在四周后发布。