Claude 5 速查:新家族怎么选、价格怎么算、旧习惯怎么改
📍 AI 求职速查 7/7 · 上一篇:← 工程与商业八股

为什么要专门一篇
Section titled “为什么要专门一篇”2026 年 7 月起,Anthropic 的模型线完成了一次大换代:Claude 5 家族(Fable 5 / Opus 5 / Sonnet 5)陆续到位。这次不是常规升级——价格档位、模型定位、几个老用法全变了。
网上大量教程还停在 4.x 时代。这一篇把 2026-08 的最新格局压成速查表:选型、价格、迁移三件事,十分钟对齐。
家族全员一张表
Section titled “家族全员一张表”| 模型 | 定位 | 上下文 | 输入价* | 输出价* |
|---|---|---|---|---|
| Claude Fable 5.1 | 全新旗舰档,最强推理和长任务(2026-09-01 上市,取代 Fable 5,同价;缓存读取降到 $0.25) | 1M | $10 | $50 |
| Claude Opus 5 | 主力旗舰,复杂工程和深度活 | 1M | $5 | $25 |
| Claude Sonnet 5 | 速度智能平衡,日常主力 | 1M | $3** | $15** |
| Claude Haiku 4.5 | 最快最便宜,简单任务 | 200K | $1 | $5 |
*每百万 token,美元。**Sonnet 5 上市时的介绍价 $2 / $10 于 2026-08-31 到期,2026-09-01 起按 $3 / $15 标准价计费(Anthropic 已确认这是长期定价)。
三个值得注意的点:
- Fable 5 是个新档位——历史上第一次出现”比 Opus 更高”的层级。日常用不到它,但面试聊模型格局要知道它的存在。
- Opus 5 跟上代 Opus 4.8 同价——升级不涨价,官方明说是”直接替换”(drop-in)的升级。
- 全家上下文都是 1M(Haiku 除外)——“哪家上下文长”这个老对比维度已经拉平了,比拼焦点转向推理质量和价格。
选型速答(面试 + 实用两用)
Section titled “选型速答(面试 + 实用两用)”Q:什么任务用什么模型?
| 任务 | 选 | 一句话理由 |
|---|---|---|
| 分类、打标签、格式转换 | Haiku 4.5 | 快 + 价格是 Opus 的 1/5 |
| 日常写码、文档、总结 | Sonnet 5 | 平衡点,标准价 3/15 |
| 复杂重构、深度分析、长程任务 | Opus 5 | 旗舰主力,该花的钱别省 |
| 最难的推理、超长自主任务 | Fable 5.1 | 顶配,按需上(Pro 套餐不含,Max 最多用一半额度) |
万能答法:“默认 Sonnet 起步,难题升 Opus,批量简单活降 Haiku——按任务难度弹性换挡,不是从一而终。“(这个答案在面试里比报一个固定模型名高一个段位。)
成本心算题(面试常考)
Section titled “成本心算题(面试常考)”Q:用 Opus 5 处理一份 10 万 token 的文档,输出 5 千 token,多少钱?
心算公式:输入 token 数 ÷ 100万 × 输入单价 + 输出同理
- 输入:0.1M × $5 = $0.50
- 输出:0.005M × $25 = $0.125
- 合计约 $0.63(四块五人民币)
记住两个锚点就够:Opus 5 = 5/25,Sonnet 5 = 3/15——输出永远是输入的 5 倍价,心算超快。
从 4.x 过来,四个旧习惯要改
Section titled “从 4.x 过来,四个旧习惯要改”这部分是给自己接过 API、或简历上写过”调用过 Claude API”的人——面试官如果懂行,可能就考这个。
1. “思考预算”没了 → 改用”努力档位”
Section titled “1. “思考预算”没了 → 改用”努力档位””4.x 时代控制模型思考深度用 budget_tokens(给思考设 token 预算)。Claude 5 上这个参数直接报错——换成了 effort(努力档位):low / medium / high / xhigh / max 五档,像洗衣机档位一样选强度。
2. 采样参数没了 → 改用提示词引导
Section titled “2. 采样参数没了 → 改用提示词引导”temperature(随机度)这类采样参数在新旗舰上不再接受。想要输出多样化?直接在提示词里说(“给我 4 个风格迥异的方向”)。“调参”时代结束,“说清楚要什么”时代开始。
3. 预填回答没了 → 改用结构化输出
Section titled “3. 预填回答没了 → 改用结构化输出”老技巧”预填 AI 回答的开头逼它输出 JSON”(prefill)在新模型上报错。正规做法:用 output_config 里的 JSON schema(结构化输出),模型保证按你给的格式返回——更稳,还不用写正则去抠。
4. 思考默认开着 → 预算要留头寸
Section titled “4. 思考默认开着 → 预算要留头寸”Opus 5 起,不写任何配置,模型默认就带思考(4.x 是默认不思考)。注意 max_tokens 上限是”思考+回答”一起算的——老代码里掐得很紧的 max_tokens,迁移后可能回答说一半被截断。给上限留出思考的余量。
面试加分句(背三句走)
Section titled “面试加分句(背三句走)”- “Claude 5 的代际变化不只是更聪明,是API 语义变了——采样参数和思考预算被 effort 档位取代,说明厂商在把’调参’收敛成’意图表达’。”
- “全家 1M 上下文拉平之后,长上下文不再是卖点,是标配——选型看的是单位智力价格。”
- “Fable 5 开了一个新先例:旗舰之上还有旗舰——说明推理能力的商业分层还在往上探,预算规划要按’任务价值’而不是’一律用最好’。”
这一篇的核心信息
Section titled “这一篇的核心信息”模型格局每半年洗一次牌,速查表的价值就是”快速重新对齐”。
具体型号名、具体价格都会过时(本文数据截至 2026-09),但两个心法不会过时:按任务难度弹性选模型;成本 = token 量 × 单价,永远心算得出来。抓住不变的,更新会变的。
你现在的项目/公司里,有没有”从一而终只用一个模型”的浪费?算一笔账,可能就是你下次周会的亮点。
- 想让选型知识落地 → 怎么省钱:成本控制实战
- 想看 Claude 干活的实际水平 → 真实案例区
牛学板块导航
Section titled “牛学板块导航”- 上一篇:← 工程与商业八股
- 本板块:AI 求职速查
- 1/7 Prompt 工程八股
- 2/7 数据与评估八股
- 3/7 RAG 八股
- 4/7 Agent 编排八股
- 5/7 协议与上下文八股
- 6/7 工程与商业八股
- 7/7 Claude 5 速查(就是这一篇,板块完结 ✅)
速查系列由真实招聘题反推整理。发现新考法?发邮箱 hi@niuxue.org 帮你加进来。