Anthropic 的设计品味被逆向开源了,连自家模型的默认审美都要防
Anthropic 家设计工具的系统提示词,被人逆向出来挂上了 GitHub。MIT 协议,随便商用,不用署名。20 章正文加 14 个技能文件,你可以原样贴进 GPT 或者 Gemini 的 system prompt 里,让竞争对手的模型照着 Anthropic 的品味做设计。
仓库叫 claude-design-system-prompt,作者 Trystan-SA。这个周末我把 README 和其中几个技能文件从头翻了一遍,越翻越觉得这东西不太像一份泄露文档,更像一本写给 AI 看的设计教材。想跟你唠唠里面几个真正值钱的地方。
先交代下背景。Claude Design 是 Claude.ai 里的设计工具,你描述需求,它直接产出可交互的 HTML 页面。逆向系统提示词这件事在圈里不算新鲜,各家聊天机器人的提示词基本都被扒了个遍,但大多数扒出来就图一乐,看看有什么彩蛋。这份不一样,作者把它整理成了可以直接复用的工程资产,目录清晰,持续维护,最近一次更新还专门针对新一代模型重新校准了措辞。这个待遇,一般开源项目都未必有。
为什么值得看,因为它攻击的问题你八成亲眼见过。让 AI 生成一个落地页,闭着眼都能猜到长什么样,紫粉渐变的 hero 区,按钮文案前面一个 🚀,卡片是圆角 12 像素再加一条 4 像素的彩色左边框,字体 Inter 一把梭。单看不丑,但千篇一律。README 里管这个叫 AI slop,姑且译成 AI 垃圾审美。它给出的判词我觉得挺准,一份设计如果看起来和一百个别的 AI 产出没区别,那它就没能成为你的设计。
这份提示词的解法,不是加一句「请设计得好看一点」,而是把整套设计纪律拆成 20 章写死。每个元素都要挣到自己在页面上的位置,不许有填充物。敢于承诺一个色板和一种调性,而不是什么流行用什么。无障碍那章要求 WCAG(Web 内容无障碍指南)、语义 HTML、键盘导航、focus 状态全部到位。还有一章叫尊重媒介,要求用真的 CSS Grid、真的 oklch() 颜色(一种对人眼感知更均匀的颜色表示法,调亮度不会把色相带跑)、真的可交互原型,不许拿静态截图糊弄事。
真正让我觉得有点子牛逼的,是 14 个技能的组织方式。它们分成三类,生产、提取、审查。生产类里有开工提问协议、无品牌时先定审美方向、低保真线框一次出三个变体这些。提取类负责从现有产品里抽设计 token 和组件清单。审查类有五个,无障碍审计、层级节奏审查、交互状态补全、AI 味检查,最后一个 polish-pass 当总门禁。技能之间还能串链,README 给的从零起步流程是,提问,定审美方向,线框图,可交互原型,最终打磨,一路串下来。

我日常的工作就是给大模型搭这种脚手架(业内叫 harness,就是让模型真正能干活的那层工程),看到这个结构的第一反应是,这不就是一条 CI 流水线嘛。审查类技能就是给品味写的 lint 规则,polish-pass 就是合并前的最后一道检查。设计品味这种向来说不清道不明的东西,被拆成了流水线上一个个可执行的工序。
其中 ai-slop-check 这个技能文件值得单独说说。它把「一眼 AI」的视觉套路一条条列成了检测规则,写法跟静态检查器的规则文档几乎一样。渐变那条,默认用平色,检测对象是彩虹渐变和紫粉、橙粉这类网红双色渐变。emoji 那条,默认一个都不要,🚀 Get Started 和 ✅ 这种按钮前缀 emoji 全部拆掉,真需要图标就换 Heroicons 或者 Phosphor 这种正经图标库。卡片那条最损,直接把 border-radius: 12px 加 border-left: 4px solid 这个组合写进了检测样例,旁边注明,这是 AI 默认卡片。
但最绝的是第 9 条规则,它检测的对象,是 Anthropic 自家模型的默认审美。
奶油色背景,衬线体大标题,赤陶色和琥珀色做点缀。你要是常用 Claude 生成页面,对这套配色多半眼熟,模型在没有明确指示的时候就爱往这个方向跑。等于官方的设计提示词里,专门写了一条规则防着自家模型的品味。好家伙,连亲儿子都不能惯着。
这条规则背后还有个挺硬核的技术原因。新一代模型把采样温度这个参数直接去掉了(temperature,以前用来控制输出随机程度的旋钮,调高了模型就放飞)。过去你想要视觉多样性,把温度调高让模型随机发挥就行。现在随机性没了,README 里写得很直白,视觉变化必须来自每个变体的显式规格,而不是随机性。想要四个不同方向的设计稿,就得把四个方向的背景色值、强调色值、标题和正文字体一组组写清楚,还规定四个方向不许共享同一个色板家族。多样性从一个超参数,变成了一份说明书。

整个 README 里我读得最认真的其实是模型校准那一节,讲这份提示词为什么要跟着模型换代重写。新一代模型(文档里点名 Fable 5 和 Opus 4.7 之后的系列)按字面执行指令,上个时代的提示词技巧会集体翻车。写「至少问 5 个问题」,它真的每次都问满 5 个,哪怕前 3 个就够了。写「CRITICAL: YOU MUST」,它过度触发,把强调当铁律。写「只报告重要问题」,它字面理解,把没把握的发现全静默吞掉,审查等于白做。所以新版提示词把配额全改成了条件描述,什么情况下该做什么,大写命令全删了,审查环节改成先全量报告并附上置信度和严重度,过滤留到聚合阶段再做。
说实话这一节我看得心有戚戚。我手上维护的提示词里就有不少上个时代的遗产,各种 IMPORTANT 和 YOU MUST 层层加码,都是当年跟不听话的模型搏斗留下的疤。模型一换代,行为整个变形,排查半天才发现不是模型坏了,是提示词太凶了。提示词跟代码一样,是要跟着运行时版本一起维护的,这个道理很多团队到现在还没接受。这个仓库等于把一次完整的跨代迁移过程摊开给你看,光这一节就值得收藏。
有一说一,逆向出来的东西没法保证和官方原件一字不差,作者自己也老老实实只说 reverse-engineered。但我觉得这事不太要紧,它的价值不在于是不是原件,在于整套方法论自洽,而且你今天就能用。贴进任何支持 system prompt 的模型,Claude、GPT、Gemini、本地 ollama 跑的开源权重都行。仓库里甚至给 Codex 单独维护了一个变体,考虑到它没有子代理能力,把并行审查改成了顺序审查。这个细心程度,比很多商业产品的文档都强。
如果你不想啃完 20 章,只想薅一个最小可用的东西,我的建议是两个。先拿 ai-slop-check 当审稿员,把你手头现成的页面丢给它过一遍,看能查出几条,这个过程会有点扎心但很清醒。然后看 frontend-aesthetic-direction,这个技能文件翻来覆去强调一件事,从零画高保真而不先承诺审美方向,是通往 AI 模板审美的最快路径。先想清楚三个形容词再动手。这条规则,我怀疑对人类设计师同样成立。
这几年大家一直在争 AI 到底有没有品味,争到最后往往变成玄学互搏。这个仓库给了一个挺工程师的回答,品味说不清,但纪律写得清。20 章提示词没有一章在教模型什么是美,全在讲什么不许做、什么条件下做什么、做完了谁来检查。有点像 unix 世界那句老话,完美不是没有东西可以加,而是没有东西可以删。审美这种玄学落到工程里,就是一条条挣到自己位置的规则。
所以回到开头那个画面。Anthropic 的设计品味,此刻正在被竞争对手的模型一字一句地执行。但我倒不觉得他们亏了什么,护城河从来不是那两百行提示词,是写出这两百行之前,踩过的所有坑。