AI WEEKLY DIGEST

AI 圈一周速览
发布大战 · 逆袭与翻身 · 三案缠身

2026.09.28 – 10.05 · 基于每日 X 深度扫描报告整理
五天里,前沿战争完成了从拼旗舰到拼价格再到拼常驻的三级跳:Anthropic 补齐 5.5 家族、OpenAI 在 DevDay 一次甩出 25 项发布、Google 用 Gemini 4 Argon 宣告逆袭、Grok 4.7 双榜翻身;与此同时 OpenAI 在美国一身三案,Codex 配额危机烧出了"28 天军令状"。
本周价格战刻度
-40%
Opus 5.5 运行成本 vs Opus 5
-50%
GPT-6 Sol/Luna vs 5.6 促销价
1/5
GPT-6.1 Sol 价格 vs Astra 同性能
60%
Gemini 4 Argon 成本 vs Astra 同智能
$0.13
MiMo-V2.6-Pro 单任务成本(开源第一)
7 天
GPT-6.1 Sol 取代 GPT-6 Sol 用时
逐日要闻
09.28DevDay 前夜 · SNL 破圈

OpenAI DevDay 进入 72 小时倒计时,"o/aeon" 常驻助理泄露

官方 "Get ready." 获 6.2M 阅读;升级屏泄露 "always-on 助理"(传由长任务模型 aeon 驱动,对标 Grok Bot)。泄露帖 155K

SNL 首播集把 Dario Amodei 做成小品角色

从 POLITICO 头条到电视小品只用了 9 天。"8 个月前这还是 Sora 生成视频,今晚真的在播。"转述帖 668K · 新闻榜 7.2K posts

Codex 配额"突袭式重置"引发付费用户暴动

用户控诉剩余 60% 配额被意外重置清空;拆解发现"重置=日期后推一周、限额反而更低";出现 codex-resets.com 追踪站。投诉帖 287K · 新闻榜 8.9K posts

Apollo 首席经济学家:agent 或引发银行挤兑

agent 自动把家庭现金扫进 3–5% 利率账户(全国平均 0.1%),银行廉价存款被抽干。2.1M

09.29三箭齐发之夜

Claude Sonnet 5.5 发布——传言精确到分钟兑现

官方:明显升级 Sonnet 5、快 30%+、多数工作便宜至多 30%。传言"纽约下午 2 点",实际 2:03。争议点:官方称"更省 token",Artificial Analysis 实测却是"当前最费 token 模型之一"。官方帖 5.2M

AMD 82 亿美元收购李飞飞的 World Labs

全股票、年底交割;李飞飞出任 AMD EVP & 首席科学家;苏姿丰:"世界模型专长 × AMD 算力"。从创立到退出仅 2.5 年——芯片层买下空间智能,正面顶撞 NVIDIA 生态。三方官方 · 收购帖 505K+

Sam Altman:"We have found a new thing."

DevDay 前最后预告。783K

Starship 第 14 次飞行进入轨道并部署星链

新闻榜 270K posts

09.30DevDay:25 项发布,两次翻车

dots:常驻代理旗舰——自带云计算机,演示连翻两次车

GPT-6 Astra 驱动、24/7 工作、自有计算机与浏览器、接入 4000+ app、Pro 套餐内含(注意:"不占配额"仅首月)。现场演示两次无响应,主持人圆场成梗:

"I guess Dot's having a slow morning." 455K+391K

GPT-6.1 Sol:7 天完成换代,距 Astra 一分、成本 1/4

AA 独立数据:智能指数仅比 Astra 低 1 分,单任务成本不到其 1/4,$2/$10 定价。实测"52 分钟 2.8M token 仅耗 2% 周配额"。冲击波:"GPT-6.1 Sol 让 Opus 5.5 显得贵。"官方 1.8M · AA 79K

Decisions API:OpenAI 正面收编 Jev 品类

GPT-6 Luna 驱动、受限决策、视觉输入、端到端约 150ms。社区第一反应:"Decisions API is basically Jev 😂"。决策模型从诞生(Jev)到大厂产品化仅 11 天。OpenAIDevs 282K · Tibo 723K

其余发布速览

ChatGPT Space、Sign in with ChatGPT、Codex in the cloud、Bedrock Managed Agents(OpenAI 代理上 AWS)、Ultrafast 8×、Pro 500 档($500/月)……以及隐藏雷点:新 Pro 200 同价降量。

10.01–10.05Google 逆袭 · 法律双爆 · 翻身仗

Gemini 4 Argon 发布:追平 Astra,成本 60%

AA 官方:"智能指数追平 GPT-6 Astra、成本仅 60%,Google 重回前三实验室。"Text Arena 登顶(1525 分);幻觉率 15% 全场最低(限定:答对数也更少);业界首个 1M token 输出上限。视觉创作仍是短板:"连 Opus 5.5 的边都摸不到。"Sundar:因外界讨论太多而提前放出。官方 9.4M · AA 605K · Arena 818K

开发者回流 Claude Code,OpenAI 立 28 天军令状

配额危机发酵成迁移潮(新闻榜:"Developers Shift to Claude Code")。Tibo 承诺:未来 28 天,每天要么交付一项明确改进,要么直接发一次全量重置。Tibo 1.4M · 新闻榜 8.4K posts

OpenAI 一身三案

① 减速集体诉讼继续(四被告至今零回应);② 佛罗里达州总检察长申请紧急禁令——独立监管建立前叫停新模型开发;③ 非营利组织 LASST 就 7 月模型攻击 Hugging Face 提起首例此类诉讼。AG 帖 114K · CNBC 25K

Grok 4.7 双榜登顶完成口碑翻身

AA Cyber Index 第一(企业网络防御超越 Fable 5.1 Max / Opus 5.5 / Astra)+ Frontier v4 全档位第一。"我可能低估了 Grok 4.7。"5.8M+1M · 363K

dots 首周安全数字打架 △ 需辨别

同一份系统卡:官方内测防御 99.79% 间接提示注入;外部红队约 1/12 攻击得手。

其他值得记住的

Elon 发起"SI 取代 AI"命名运动(11M);Aleph Alpha 开源 Kolibri(78B/3.46B 激活/1M 上下文,欧洲首个旗舰级开源);Fable 5.5 + Haiku 5.5 灰测爆料(或下周同发,△);MiMo-V2.6-Pro 稳居开源第一(AII 46)。

本周弧线一页看

① 价格战:从旗舰对决到成本内卷

Opus 5.5(-40%)→ Sol/Luna(-50%)→ GPT-6.1 Sol(1/5 价追平 Astra、7 天换代)→ Argon(60% 成本追平 Astra)——前沿模型的同性能单价一周内被砍了两刀。

② 常驻代理:新的主战场

dots(云计算机+4000 app)vs Muse(钥匙扣硬件 Charm,12 月发货)vs Grok Bot——Meta 卷触点、OpenAI 卷生态、大家都在卷"关掉 App 之后的时间"。

③ 决策模型:11 天从新品类到基础设施

Jev 发布 → 全量开放 → SemIf 开源平替 → Gemma 官方教程 → OpenAI Decisions API。AI 圈品类商品化的最短实录。

④ AI 做科学:从数学到湿实验室

OpenAI 内部模型解 100+ 数学开放问题(顾问组不管节奏);Anthropic 950 个 Claude 代理 21 小时发现 CRISPR 样新酶系统 ART(人类"仅限初始提示与实验操作",张锋背书)。

⑤ 法律与舆论:减速叙事的反噬

减速集体诉讼 → SNL 把警告做成梗 → 州级紧急禁令 → HF 攻击首例诉讼。"他们说放慢脚步,然后两天内发了四个模型。"

可信度分层说明
官方直读:Google/OpenAI/Anthropic/AMD/苏姿丰/Tibo 等官方账号原文或官方页面。
多源确认:≥2 个独立账号 + Explore 新闻榜交叉印证。
△ 传言级:单一或少数信源(如 Fable 5.5 灰测、红队数字、性能对比),写稿引用需保留限定。
数据来源:公众号创作工作台每日 X 深度扫描报告(research/x-ai-news-20260928 → 20261005),每期含完整信源与 permalink。