打开 Claude 的模型下拉框,你大概率会愣一下。

Fable 5、Opus 4.8、Sonnet 4.6、Haiku 4.5,下面还挂着两个灰扑扑的 Opus 4.7 (Legacy)、Opus 4.6 (Legacy)。

image-20260611211756624

六个名字,没一个说人话。

谢谢 Anthropic,让我这辈子学会了俳句(haiku)、十四行诗(sonnet)、作品(opus)、神话体系(mythos)、寓言(fable)这几个原本打死也用不上的英文单词。而且实在太快了——2026 年 5 月 28 日悄咪咪上线 Opus 4.8,6 月 9 日 Fable 5 就接着砸了下来。名字一个比一个文艺,普通用户却越看越懵:这下拉框里六个选项,我到底点哪个?

先说结论:这堆名字不是版本号,是”分量”。 Anthropic 用文学体裁给模型起名,体裁越宏大,模型能扛的活儿越重、也越贵。把它想象成你手底下一支干活的队伍——有人跑腿快、有人靠谱、有人是天花板专家。选模型,就是派活儿。

这篇就把这六个名字、外加刚出生的 Fable 5,用小白也能听懂的话讲明白,最后再给一套省 token 的实战打法。

01、先破除一个误会:不是越新越好

很多人第一反应是”那肯定选最新最贵的 Fable 5 啊”。

打住。这是用 Claude 最容易踩的坑。

这些模型不是手机系统更新,新的覆盖旧的;它们更像一个工种齐全的团队,同时在岗。 让一位顶级专家去回你”今天天气怎么样”,他答得又慢又贵,体验还不如一个跑腿的实习生秒回。

模型选型的底层逻辑只有一句:杀鸡别用牛刀,但砍树也别拿水果刀。 活儿多重,就派多大分量的人。

那怎么知道谁分量大?名字早就写在脸上了——只是用了文学的暗号。

02、名字背后的”隐藏说明书”

Anthropic 这套命名,藏着一条由轻到重的线。把体裁拆开,你就拿到了一张说明书:

Haiku(俳句)——日本俳句,5-7-5,总共 17 个音节,讲究用最少的字说清一件事。对应到模型,就是最快、最便宜、最省的那一档,每秒能吐上百个 token。跑腿、分类、信息提取、翻译、总结这类”一句话能交代清”的活,交给它。

Sonnet(十四行诗)——14 行的固定格律,既有结构又有发挥空间。它是那个”什么都能干、又不至于太贵”的主力队员。日常写代码、写文案、做问答、跑常规 Agent,默认用它基本不会错。

Opus(作品 / 巨作)——一部完整的大作品。这是原本那一档里的天花板,擅长难推理、长链路、需要”想很久”的硬骨头。复杂分析、多步骤 Agent、卡了半天的疑难,才轮到它出场。

到这,如果故事停在 Opus,命名还算工整。但 Anthropic 显然不满足于”诗”,它往上又叠了一层——

Mythos(神话体系)Fable(寓言)

从俳句到神话,体裁的分量肉眼可见地往上窜:俳句是 17 个音节的小品,神话是一整套创世叙事。Anthropic 用这个跳跃,明示了一件事:Mythos 这一档,是架在 Opus 之上的全新能力级别。(其中 Mythos 5 只对少数审核过的机构开放,我们普通人能摸到的,是它套上安全壳之后的版本——Fable 5。)

这里插一句吐槽:能把”挑个 AI 模型”搞成需要先补一节文学课,也是没谁了(建议官方附赠英语四级词汇表)。但平心而论,比起隔壁清一色 GPT-5、Gemini 2.5 这种冷冰冰的版本号,Anthropic 这套名字至少把”分量”这件事讲明白了。

回到正题:那个最新、最唬人的 Fable 5,到底是个什么物种?

03、Fable 5:一个自带”风控”的天才顾问

Fable 5 是 Anthropic 第一次把 Mythos 级别的能力对公众开放。按官方说法,它在几乎所有测试基准上都是当前最强,软件工程、知识工作、视觉、科研全面领先,而且任务越长越复杂,它甩开其他模型的差距就越大。

听起来无敌,对吧?但它身上挂着一个别人没有的东西:安全护栏。

Anthropic 自己也知道这玩意太强,放出去有风险。所以他们给 Fable 5 装了一层分类器:一旦你的问题踩到网络安全、生物、化学、模型蒸馏这些高危区,它不会自己答,而是把请求转给次一级的 Opus 4.8,并提示你”已经发生了切换”。这个护栏调得偏保守,平均不到 5% 的会话会被触发。

打个比方:Fable 5 是你刚高薪请来的天才顾问,本事最大,但合同里写死了”涉及敏感领域必须转交合规同事”。 大多数活儿他亲自上,碰到雷区自动甩给 Opus。

成本上它也最贵:每百万 token 输入 10 美元、输出 50 美元,正好是 Opus 4.8 的两倍。它最对得起这个价的地方,是那种”以前的模型根本扛不下来”的超长、超复杂任务。

还有个时间点要划重点:6 月 22 日之前,Fable 5 在 Pro、Max、Team 等订阅里免费随便用;6 月 23 日起会从这些套餐撤下,改成按额度计费,之后再逐步恢复成标准功能。 想白嫖的,趁这几天。

Fable 5 与 Opus 4.8 能力对比图

04、那两个灰色的 (Legacy) 是啥?

下拉框最底下,Opus 4.7、Opus 4.6 后面跟着个 (Legacy),像被打入了冷宫。

Legacy = 上一代旧款,留着不删,主要为了”稳定”。

道理很实在:有人把工作流、提示词、甚至代码里的模型名都焊死在某个旧版本上,贸然换新版,输出风格一变,整条流水线可能就抖了。Anthropic 留着这些旧款,就是给这批人一个”先别动”的退路。

对小白来说,结论一句话:除非你有明确理由要复现旧结果,否则别碰 Legacy,直接用当代那几个。

05、小白到底怎么选?照着这张表派活

理论讲完,上硬货。把你的需求对号入座:

你要干的活派谁上为什么
翻译、分类、提取信息、简单总结、批量跑量Haiku 4.5最快最便宜,大材小用反而亏
写代码、写文案、问答、常规 Agent(拿不准时的默认项)Sonnet 4.6能力和成本最平衡,九成的活它都接得住
难推理、长链路、卡很久的硬骨头、深度分析Opus 4.8当代 Opus,贵但扛得住复杂
超长、超复杂、别的模型直接做不完的任务Fable 5当前最强,代价是最贵 + 偶尔触发护栏
想复现某个旧版本的老结果Opus 4.7 / 4.6 (Legacy)仅此一个理由

一句话记忆法:不确定就先用 Sonnet,嫌它不够聪明就往上抬,嫌它太慢太贵就往下降。

九成情况,Sonnet 4.6 就是你的最优解。真正需要 Opus、Fable 上场的硬任务,远比你想象的少。

06、省 token 实践:别让博士去拧螺丝

聊到这,就绕不开钱和额度的问题了。

不管你是订阅党(Pro / Max,模型越重,吃你的对话额度越快)还是 API 党(直接按 token 烧钱),省 token 的核心思路完全一样:

省 token 的第一原则,从来不是少说话,而是别让博士去拧螺丝。 把活儿派给”刚好够用”的最便宜模型,本身就是最大的一笔省钱。

先看价目表,感受一下差距(每百万 token,输入 / 输出):

模型输入输出相对 Opus
Haiku 4.51 美元5 美元便宜 5 倍
Sonnet 4.63 美元15 美元便宜约 40%
Opus 4.85 美元25 美元基准
Fable 510 美元50 美元贵 1 倍

Haiku 和 Fable 之间,差了整整 10 倍。同样一句”帮我把这段话翻成英文”,用 Haiku 还是用 Fable,效果几乎没差,账单却差一个数量级。

给所有人的三条

  1. 默认 Sonnet,按需升降。 别一上来就顶配。这一条做到位,比后面所有技巧加起来还省。
  2. 简单活儿坚决下放 Haiku。 分类、提取、翻译、格式整理,Haiku 完全够,还快。
  3. 长对话适时开新窗。 在 App 里,对话越长,模型每轮都得把前面所有历史重新”读”一遍,token 越烧越多。话题切换了,就果断开个新对话,别让它背着几万字的旧包袱跑。

给 API 进阶党的两条干货

如果你是拿 API 搭流水线的,还有两个能砍掉一大截成本的官方机制:

  • 提示词缓存(Prompt Caching): 系统提示、长文档、工具定义这些每次都重复发的内容,缓存起来,命中缓存的部分能便宜约 90%。重复的上下文越多,省得越狠。
  • 批处理(Batch API): 不急着要实时结果的任务(批量打标、离线分析),走批处理,所有 token 直接打五折。

把这套组合拳打全:Haiku 跑预处理 → Sonnet 当主力 → 只有真·硬骨头才喊 Opus / Fable,再叠上缓存和批处理。同样的活,账单能差出好几倍。

写在最后

绕了一大圈,其实选型这事简单到可以压成一句话:按分量派活,不确定就 Sonnet,简单就 Haiku,难才 Opus,极难才 Fable。

名字会一直变。今天是 Fable,明天指不定又冒出个更唬人的体裁,逼着我们再背一个一辈子用不上的英文单词。但有件事永远不会过时——真正省钱省心的,从来不是追最新最贵的那个,而是把对的活儿,交给对的人。

俳句也好,神话也罢。看懂了名字背后的分量,这几个单词,你这辈子还真就用上了。

2026-06-11-claude-cover-235