海外三巨头同周上新:Fable 5.1、Gemini 3.8 Flash、GPT-6 Astra 跟你有什么关系
📍 认识 AI · 本周时事 · 相关:现在 AI 圈在卷什么 · Claude 5 速查 · 大厂 AI 大合并周(国内篇)

周二、周三、周四,一天一家
Section titled “周二、周三、周四,一天一家”上周国内三巨头「拆墙合并」(那篇在这),这周轮到海外三巨头发新模型,而且排得像商量好的:
- 9 月 1 日(周二):Anthropic 发布 Claude Fable 5.1,同时发布一个带更少「锁」的兄弟版本 Claude Mythos 5.1
- 9 月 2 日(周三):Google 发布 Gemini 3.8 Flash,六周内第三个 Flash
- 9 月 3 日(周四):OpenAI 发布 GPT-6 Astra,号称「一代人的跨越」
同一天国内也有一条小新闻:智谱把大模型套餐搬上了天猫,在淘宝就能下单。放在文末一起说。
这篇还是按「跟你有多大关系」的顺序讲:先讲大趋势,再逐家拆,最后按人群说该做什么。
先看懂:这一轮卷的不是「更聪明」
Section titled “先看懂:这一轮卷的不是「更聪明」”三家发布会的 PPT 里都有一堆跑分,但把细节放一起看,真正的变化在三个词上:
| 卷什么 | 三家各自的动作 |
|---|---|
| 更便宜 | Anthropic 把「缓存读取」降价 75%;Google 新模型促销价打五折到年底 |
| 更能干活 | 三家都在强调「长任务」「自己操作电脑」——也就是本站一直讲的 Agent(智能体) |
| 带锁出厂 | Anthropic 的 Mythos 只给审核过的机构;OpenAI 把 Astra 定为最高一级网络安全风险、分批放;Google 的 Flash Cyber 只给受信测试者和政府 |
打个比方:同一台发动机,出厂时装了不同的限速器。 普通人买到的是限速版,专业机构经过审核才能拿到解限版。这是 2026 年 AI 发布的新常态——模型太强,厂商开始用「谁能用」来管风险,而不只是「能不能做」。
第一家:Anthropic 的 Claude Fable 5.1
Section titled “第一家:Anthropic 的 Claude Fable 5.1”一句话:同样的价格,更强的能力,外加一个大幅降价的角落。
- 价格不变:每百万 token 输入 $10、输出 $50,跟 Fable 5 一样
- 缓存读取降 75%:从 $1 降到 $0.25。官方估算,典型任务整体便宜约 25%,让 AI 自己跑长任务的场景最多省约 45%(这是厂商口径,实际看你的用法)
- 能力:官方说是「目前最强的编程和知识工作模型」,而且开中低档「努力程度」时,效果就能追平上一代 Fable 5,但花的钱少得多
「缓存读取」是什么?你反复让 AI 看同一份资料(比如一个大项目的代码、一份长合同),它第二次起「重读旧资料」的那部分叫缓存读取。类比:复印件打 2.5 折,原件价格不变。 用 Claude Code 这种一直在同一个项目里干活的工具,绝大部分 token 都是「重读」,所以省得最多。
谁能用、怎么开
Section titled “谁能用、怎么开”按本站惯例,先说事实(来源:Anthropic 帮助中心,2026-09):
| 你的套餐 | 能不能用 Fable 5.1 |
|---|---|
| 免费版 | 不能 |
| Pro($20 / 月) | 不含在套餐里,要另外买「用量额度」按量付费 |
| Max | 含在套餐里,但最多用掉你每周额度的一半,而且它消耗额度比其他模型快 |
| Team / Enterprise | 高级席位同 Max,标准席位同 Pro |
| API(程序接口) | 按上面的单价计费 |
两个细节值得知道:
- Claude Code 里默认开「High」档努力程度,网页版默认「Medium」——网页版更省,但也更「省着想」。想调,在发送按钮旁边的模型菜单里改
- Claude Code 要升到 2.1.255 以上才能选它。终端里敲
claude update就行(出错怎么办那篇有升级排雷)
Mythos 5.1 是什么
Section titled “Mythos 5.1 是什么”跟 Fable 5.1 是同一个模型,只是「锁」更少。 面向网络安全防御和生命科学研究,目前只对经过审核的美国机构开放。普通人不用惦记,知道这个名字就行——以后新闻里出现「Mythos」,指的就是这个解限版。
顺带一提,Anthropic 这次把误判也收紧了:安全类的「误拒绝」少了 60%,模型现在可以用来找软件漏洞(但不能写攻击代码)。
Claude 用户本周要知道的两件事
Section titled “Claude 用户本周要知道的两件事”这两件跟新模型无关,但正好撞在同一周,本站读者里用 Claude 的人不少,一起说了。
① 9 月 14 日起,Claude Code 的周额度会变。 5 月到 9 月 13 日一直有个「周额度 +50%」的促销;9 月 14 日促销结束,官方同时把标准周额度永久提高 25%。算一笔账:原来 100,促销期 150,14 日起变 125——比原来多,但比你现在用的少 17%。适用 Pro / Max / Team 和老的按席位企业版;5 小时额度不受影响;只影响 Claude Code,网页版聊天不变。习惯了促销期用量的人,下周开始把轻活挪去便宜模型(怎么省钱那篇的方法都适用)。
② 有人的 Claude 账号被「偷用」了,做一次检查。 9 月 1 日前后,Anthropic 给一批用户发了邮件:有人用常见的「信息窃取」木马,从受害者电脑里偷走浏览器的登录状态,然后用他们的账号消耗额度、甚至触发自动充值。注意,这不是猜密码,也不是绕过验证码——是你已经登录的那个「会话」被整个复制走了,所以改密码和开二次验证都拦不住。官方的处理是强制下线、删掉绑定的卡。如果你发现「额度刚恢复就莫名其妙用光了」,八成就是这个。
自查四步(来自官方建议):
- 先给电脑做一次杀毒,清干净再登录
- 改你注册 Claude 用的邮箱密码,把其他设备都登出,开二次验证
- 浏览器里存过的银行、公司、云服务密码,一起换掉;存过卡的看一眼账单
- 以上做完,再把付款方式加回去
这条的原则本站早写过:什么能发给 AI,什么不能——账号本身也是要保护的东西。
第二家:Google 的 Gemini 3.8 Flash
Section titled “第二家:Google 的 Gemini 3.8 Flash”一句话:轻量款一直更新,旗舰款迟迟不出。
- 这是 Google 六周内的第三个 Flash(上一个是 8 月的 3.7 Flash),官方称是「目前最强的推理和编程模型」,编程能力提升最明显;而上一代旗舰 Pro 从年初到现在没有更新
- API 促销价:每百万 token 输入 $0.75、输出 $3.75,到年底;原价是 $1.50 / $7.50
- 免费路径:在 Google AI Studio 里可以免费聊,API 也有免费额度(有限流);但 Gemini 手机 / 网页应用里要 Pro 或 Ultra 订阅才能选到它
- 同时发布的 Gemini 3.8 Flash Cyber 专做漏洞发现和修补,只给受信测试者和政府
对普通人的意义:Flash 这个档位已经卷到「便宜 + 够用」了,如果你是开发者、想找一个便宜的模型接进自己的小工具,它是这周最值得试的一个。给 Agent 配工具那篇讲过怎么接。
第三家:OpenAI 的 GPT-6 Astra
Section titled “第三家:OpenAI 的 GPT-6 Astra”一句话:最响的名字,最难用上的模型。
- OpenAI 总裁的原话是「一代人的跨越」,把 AI 「完全带进 AGI 时代」——听听就好
- 官方跑分:电脑操作、浏览网页、软件工程、网络安全、科研全部第一;几个数学和推理基准直接「刷满」。全是厂商口径,第三方独立评测还没出来
- 实际能感觉到的:ChatGPT 操作电脑的速度快了近一倍,能自己做文档、表格、PPT;配套的 Codex(OpenAI 的编程工具)同步升级
- 怎么用:这是 OpenAI 第一个被自己定为「最高一级网络安全风险」的模型,所以分批放——9 月 3 日先给部分企业客户,9 月 4 日给 ChatGPT Pro($100 / $200 每月)用户,$20 的 Plus 要再等,免费版还没说法
- 背景数字:用了超过 10 万块 GPU 训练,「史上最大规模」;而且是第一个大量由上一代模型参与训练的模型
国内读者的现实:ChatGPT 的门槛没变,该翻的还得翻,该付的海外账单还得付。它对你的意义更多是「知道天花板在哪」,真要用,Claude Code / 豆包 / ChatGPT 怎么选那篇的结论没变。
国内这边:大模型上淘宝了
Section titled “国内这边:大模型上淘宝了”9 月 2 日,智谱在天猫开了官方旗舰店,卖的是 GLM Coding Plan 订阅套餐(基于 GLM-5.3),个人版 Lite 每月 118 元起,支持月付 / 季付 / 年付,也有团队席位。套餐适配 20 多款主流 Agent 工具——包括 Claude Code 和 Codex。
这条新闻的意思是:大模型正在从「技术产品」变成「话费套餐」——不用找官网、不用研究 API,淘宝搜店名下单。对本站走国内路线的读者,这是继 DeepSeek 之后又一个能接进 Claude Code 的国产选项,价格按月算,比按 token 算更好预算。(据智东西报道,Kimi、MiniMax 也在往电商平台走。)
三家 API 价格一览(截至 2026-09)
Section titled “三家 API 价格一览(截至 2026-09)”给开发者和记账党的一张表,单位:美元 / 每百万 token。
| 模型 | 输入 | 输出 | 备注 |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | 缓存读取 $0.25(降 75%) |
| Claude Opus 5 | $5 | $25 | 主力旗舰 |
| Claude Sonnet 5 | $3 | $15 | 介绍价已于 8 月底到期 |
| Gemini 3.8 Flash | $0.75 | $3.75 | 促销价到年底,原价 $1.50 / $7.50 |
| GPT-6 Astra | — | — | 分批开放中,价格以官网为准 |
| DeepSeek V4 Pro | 分时 | 分时 | 高峰 / 低谷两档,见涨价那篇 |
这一周对你意味着什么
Section titled “这一周对你意味着什么”- 只用手机、只用免费版的:三家新模型你一个都用不上,也不用急——豆包、DeepSeek 照旧,等它们下放到免费档再说
- Claude Pro 用户:Fable 5.1 不在你套餐里,别被「New」标签骗了;记住 9 月 14 日的额度变化;做一次账号安全自查
- Claude Max 用户:可以选 Fable 5.1,但它吃额度快、最多用掉一半,重活再上;Claude Code 记得
claude update - 用 Claude Code + 国产模型的:多了智谱天猫套餐这个选项,按月付、接法一样
- 开发者:Gemini 3.8 Flash 的促销价是这周最便宜的旗舰级选项;Fable 5.1 只在「反复读同一批资料」的场景才真便宜
- 想尝鲜 GPT-6 的:没有 $100 以上的 ChatGPT 套餐就先别惦记,等 Plus 档开放再看第三方评测
本站一贯的提醒放最后:「一代人的跨越」「目前最强」「刷满」全是厂商口径。 新模型先拿来省钱、拿来玩,正经生产的活,多留一手。
- Claude 5 家族怎么选、价格怎么算 → Claude 5 速查
- 额度不够用怎么省 → 怎么省钱:Claude Code 成本控制实战
- 账号和数据安全的原则 → 什么能发给 AI,什么不能
- 国产模型接进 Claude Code → Claude Code + DeepSeek 配置详解
- 上周国内三巨头的动作 → 大厂 AI 大合并周
- 全景图 → 现在 AI 圈在卷什么