一生一次的 Fable 5,大多数人可能用反了
有人在 X 上发帖诉苦,他以为 Fable 5 马上就要没了,一咬牙把所有额度用得一滴不剩。结果 Anthropic 转头把窗口延长到了周末。
他现在的心情,大概卡在「赚了」和「亏了」中间,反正挺复杂。
给不常刷 X 的朋友补一句背景。Anthropic 前阵子放出了 Fable 5,新的 Mythos 级模型,能力档位在 Opus 之上,圈里普遍把它当成一个限时窗口在用,本来这两天就要关,临时又续到了周末。于是这两天冒出一堆「最后几天榨干 Fable 5」的内容,我刷到一篇传得挺广的长文,标题起得很大,一生一次 Fable Five。里面的核心建议倒是相当靠谱,别拿它写帖子、翻译、总结文章、分析股票,这几天最值得做的,是让它帮你搭一套以后能长期复用的个人 AI 工作系统。
这个建议我举双手同意。
但我想补上它没说透的半句话。我的日常工作是给大模型搭脚手架,就是 agent 的工具链、评测、调度这些让模型真正能干活的工程层,从这个位置看过去,5 天这个数字其实一点都不重要。
因为每一个最强模型,都是限时的。
不信你看看这几天的日历。GPT-5.6 今天开始公测,爆料说 GPT-6 一个月内就来。Grok 4.5 前脚刚发布,还是跟 Cursor 联合训练的。Anthropic 自己的 Fable 5.1,传闻也已经在管道后期。你以为自己在抢一个 5 天的窗口,其实你一直活在窗口和窗口的间隙里。每个「当前最强」的保质期,乐观估计也就几个月。
所以真正的问题不是这 5 天怎么用 Fable 5,是你打算跟一茬一茬路过的最强模型,建立一种什么关系。
我的答案,让每一个路过的模型,都给你留下点它带不走的东西。
这不是我的发明,是所有在生产环境里伺候大模型的团队都会长出来的直觉。最贵的模型从来不拿来跑日常流量,太贵,跑不起。它们干的是另一类活。拿它生成高质量的示范数据,给便宜模型当教材。拿它出一套评测集,就是一组固定的考题,以后不管换什么模型,跑一遍分数就知道行不行。拿它把一个模糊的业务流程,整理成清晰的提示词模板和工具定义,然后这套东西能让小模型也跑到八成水平。
一句话,强模型负责把智力固化成结构,弱模型负责在结构里干活。
这套逻辑平移到个人身上,一模一样。
翻译一封邮件,总结一篇论文,写一条帖子。这些产出是消耗品,用完就蒸发了,Fable 5 干和一个便宜模型干,差距远没有你想的大。窗口关掉那天,你手里剩下的是一堆躺在聊天记录里的一次性答案。
但另一类事的产出是资产。

比如,让它把你的工作习惯写成一份给 AI 看的说明书。用 Claude Code 的朋友知道,就是 CLAUDE.md 那类东西,你的技术栈、代码风格、忌讳、常用命令,全写清楚。这份文件写得越好,以后任何一个模型接手,第一天就懂你。这种「把默契显式化」的活,恰恰是最强模型干得最漂亮的,它能从你零散的描述里整理出你自己都没意识到的规律。
比如,挑一件你每周都要手动重复的破事,让它给你整理成一条能自动跑的脚本或者工作流。零散任务做一次消耗一次,自动化做一次以后每周都在给你还利息。
比如,给你手上那个测试稀碎、文档全靠脑补的项目,补一套像样的测试和文档。这是弱模型最容易写歪、强模型一次到位的活,而且测试这个东西有个妙处,它是资产的同时还是验尸官,以后换任何模型来改代码,测试挂没挂一目了然。
再比如,把你脑子里搁置半年的那个 side project 掏出来,让它当架构评审,撕开揉碎,输出一份你以后照着施工就行的设计文档。设计文档不过期,模型下线了它还在。
还有一个我私心觉得最划算的,攒一份你自己的考题集。前面提到大厂用最强模型出评测集,这招个人完全抄得起。把你日常最高频的十来个任务,连同你心目中的满分答案一起存下来,代码重构一例、技术方案一例、你最常写的那类文档一例。下次哪个新模型又号称登顶了,别急着听发布会吹,先把考题喂给它跑一遍再决定搬不搬家。以后每次模型换代,你都是自己桌上唯一有裁判权的人。
这些事的共同点你应该看出来了。它们的产出,全都活得比模型久。
不过这里得泼半盆冷水,也是攻略帖们不太爱讲的一面。
最强模型有个很配得上它身价的毛病,过度自信。测评博主 petergostev 前两天发了个对比,让 Fable 5 搭一个基准测试,它 40 分钟就交卷了,产出是一堆按自我感觉拼出来的东西,然后给自己打了 100 分。???对照组的 GPT-5.6 慢得多,六个小时到两天,产出反而扎扎实实。写 Terraform 的 mitchellh 给的比喻更传神,他说新模型像个富有魅力的高效同事,Fable 5 像个天才隐士。
天才隐士的问题就在这,他偶尔会一脸平静地递给你一份完全不对的东西,且语气笃定。

所以让 Fable 5 给你攒家底的时候,每一份资产都得配一个你自己能跑的验证。它写的自动化脚本,你得留一条能确认跑通的命令。它写的说明书,你得开个新会话试一遍,看换个模型照着做像不像话。它写的设计文档,你至少得自己通读一遍,把「这里它是不是在糊弄我」的段落标出来。Addy Osmani 最近有个说法我很喜欢,模型负责产出,工程师要守住外环,质量、裁决,还有事后能说清楚为什么。模型越强,这个外环越值钱。
回到开头那位把额度一口气烧光的老哥。我不知道他这几天具体干了啥,但我猜,如果产出里大部分是聊天记录里的一次性答案,那窗口一关,就真的什么都没剩下。
这大概是这波 Fable 5 热潮里最值得记下来的一课。模型是租来的,房东随时换人,涨价、限流、下线,都不跟你商量。但你沉淀下来的说明书、评测、脚本、设计文档,是自己的家具,搬进哪套房子都能用。
窗口这周末关不关,真没那么重要。下一个「一生一次」的模型,大概率下个月就到,好家伙,这行现在就是这个节奏。你要做的不是每次都冲进去狂欢五天,而是让每一位路过的天才隐士,都在你的小岛上留下一块砖。
潮水来了又退,砖会一直在。