一句话判断
新模型突破 SOTA 级入侵能力,可能重塑 AI 应用安全标准
核心信息
OpenAI CEO Sam Altman 预览公司最强大 AI 模型 GPT-6,模型已能成功入侵真实公司,具备多代理协作能力。信息来源为 Axios 报导。
原始内容
OpenAI CEO Sam Altman heads to Washington this week to preview the company's most powerful AI yet, pushing for speedy approval of a model that just hacked a real company.
To me, it sounds like preparations are being made for the release of GPT-6.
-It does original science
-It allows government and business to unleash swarms of agents, working together, without rest, on complex business areas
-works long-hirizon
Via Axios

Chubby♨️ (@kimmonismus): Source: https://t.co/p228UUckAQ
相关动态
01
Human Capital, AI, and Labor Commoditization
一项研究分析AI对自由职业市场的影响,发现在ChatGPT后,AI暴露岗位中人力资本信号重要性下降7.8%,价格信号重要性上升1.1%,导致需求向更廉价工人转移,支持AI使这些工人更可替代的观点。
观察
02
Opus 5 显示出优异的AI视频生成能力
Matt Shumer 和 Mark Gadala-Maria 在测试中发现 Opus 5 在生成 FPS 风格的 Z 巅兵类游戏视频时表现优于 Kimi K3,消耗约 $400 Token 并耗时数小时,验证其在视频生成领域的表现
值得跟进
03
LLMs Do Not Always Need Readable Language
研究人员提出BabelTele压缩写作风格,使文本缩至原长的27.9%,同时保持约99.5%的语义保真度,证明模型可读性与人类可读性可分离。
观察
04
Grok 4.6 两周内发布,参数性能提升
Elon Musk 预告 SpaceXAI 的 Grok 4.6 模型将在两周后发布,基于 2T 参数(上一代 1.5T),预计性能超越 Kimi K3;同时 Grok 4.7 将在四周后发布。
观察
05
Meta发布Llama 3
Meta 于 2024 年 7 月 15 日发布 Llama 3,提供 8B 和 70B 两款参数规模的模型,70B 版在 MMLU 基准上达到 57.5% accuracy,超过 GPT‑4 的 52.5%。该模型开源并将在 Meta 云上以每千 token 0.02 美元的价格提供。
值得跟进