今天刷新 GitHub 页面时看到:Hallmark 的星数是 27,052,fork 1,378。而六个星期前的 7 月中旬,它还只有 5,000 星左右。一个"设计技能"项目,六周涨了两万多星,连续几周挂在 GitHub 周榜前列;昨天(8 月 25 日),作者 Hassan El Mghari——Together AI 的开发者体验负责人——关于"去掉 AI 应用廉价感"的演讲视频刚被传到 B 站。哔哩哔哩
如果你用 Claude Code、Cursor 或 Codex 做过页面,大概率被同一种体验折磨过:不管需求是什么,出来的都是同一个模板换了文案——紫色渐变 hero、三张等宽功能卡、居中大标题、Get Started 按钮。知乎业内管这叫 AI slop,“AI 味”。Hallmark 就是来治这个的。我把它的 README、SKILL.md、57 道 slop 闸门和 ROADMAP 通读了一遍,又对照知乎、小红书上这一个多月的讨论,聊聊它到底值不值得装、怎么用、边界在哪。
先说清楚:Hallmark 治的是"结构",不是"配色"
很多人以为 AI 味是配色问题,调调渐变就好了。Hallmark 的判断恰恰相反:AI 生成的 UI 视觉各异,但结构雷同——不管哪个模型,都吐 hero → 3 features → CTA → footer 的同一节奏,结构同质化才是真正的指纹。知乎
这不是 prompt 没写好的问题。“有创意”“不一样"对模型来说是连续概念,没有逻辑边界,你喊得越凶,它越往训练数据里出现频率最高的答案靠。知乎Hallmark 的解法很有工程味:不和 AI 谈艺术,把"请自由发挥"换成"在这些选项里,挑一个没用过、且满足规则的”。
具体是三层机制。
第一层:21 套主题 + 一条隐藏的 custom 分支。默认从 21 套命名主题里选;只有当需求明确带着创作意图(点名品牌色、给出多种氛围词)时才触发 custom 分支,从零设计调色板和字体。社区不少文章写的还是"20 套主题",当前版本实际是 21 套加 custom。

第二层:slop-test 闸门清单。README 写"fifty-seven",现行 slop-test 文件里编号闸门是 1 到 57 道,但它的自我批判章节又自称"fifty-eight-gate review"——官方自己都没把数字对齐,大概率把输出前自我批判也算了一道。每道闸门都要求答案是"否":展示字体是不是 Inter/Roboto/Poppins?有没有紫到蓝的渐变(包括渐变文字)?有没有三等分图标卡?有没有用 transition-all?hover 是不是统一 scale-105?占位文案里有没有 Jane Doe、Acme、Nexus?命中任何一条,打回重做。
第三层:输出前自我批判。先给六个轴(理念、层级、执行、具体性、克制、多样性)打 1-5 分,任何一轴低于 3 分先返工,最后把六个分数以注释形式盖在代码顶部,下一次运行时能读到、避免重复同一个弱点。
此外还有一本"排重账本":每次生成后往项目根目录写 .hallmark/log.json,只保留最近 20 条,每条只记 4 个基因(骨架/风格/饰品/需求),下次生成先读它。连续两次生成,必须在"底色亮度带/标题字体/强调色相"这几条离散轴上至少有一轴突变,否则判为同质化直接打回。"不一样"从一种感觉,变成了一道可计算的硬规则。知乎

它为什么爆:星数曲线替你对过了
日期 | 星数 | 记录来源 |
|---|---|---|
2026-07-14 | 约 5,075 | 知乎拆解文,GitHub Trending,日增 800+ |
2026-07-20 | 约 14,000 | 知乎专栏,一周新增 9,000+ |
2026-08-08 | 21,400 | 小红书视频笔记 |
2026-08-23 | 约 26,500 | 小红书笔记 |
2026-08-26 | 27,052 | GitHub API 实时(今日) |
社区讨论密度也对得上:知乎 7-8 月至少 11 篇相关文章,从安装教程到 skill 机制拆解到前后实测;小红书至少 18 条笔记,有人拿普通 Codex 和装了 Hallmark 的 Codex 做了两轮 A/B 对比。小红书而这个项目出自 Together AI——7 月 1 日刚以 83 亿美元估值完成 8 亿美元 C 轮的开源推理公司,客户名单是 Cursor、ElevenLabs、Suno 这批 AI 应用层公司,恰恰是最需要"让 AI 产品看起来不廉价"的人。知乎知乎他们把审美问题做成可审计的工程规则,某种程度上是顺理成章。
安装与四个动词:多数人装完只用了十分之一
安装一行命令:npx skills add nutlope/hallmark,重跑即更新。手动装也行:Claude Code 把 SKILL.md 和 references 目录拷到 ~/.claude/skills/hallmark/;Cursor 把 SKILL.md 正文(去掉 frontmatter)放进 .cursor/rules/hallmark.mdc;Codex 放 ~/.codex/skills/hallmark/ 或项目级 .codex/skills/hallmark/。
但 Hallmark 不只是"帮我做个页面",它有四个动词:
默认动词:新建页面,自动选主题、跑全部闸门。

hallmark audit 目标:只给现有页面打分,对着反模式清单输出整改清单,不动一行代码——适合给存量老页面做体检。
hallmark redesign 目标:扔掉结构,保留文案、信息架构和品牌,重建视觉层——适合救已经上线但"一眼假"的页面。
hallmark study 截图或 URL:从你欣赏的设计里提取"DNA"(宏观结构、字体搭配、颜色锚点),还能输出可移植的 design.md;拒绝像素级抄袭,也拒绝付费模板网站。
最被低估的是 study。提升审美最现实的路径,是找几个你真心觉得好的网站,让 Hallmark 提取 DNA,再用这套 DNA 建自己的页面。作者在演讲里给的建议也是同一件事的另一半:建一个灵感截图库当 prompt 参考,把偏好写进 AGENTS.md,每次只提 1-2 个功能需求。哔哩哔哩
三个边界,装之前想清楚
第一,它治标不治本。21 套主题本身是一套新模板,只是比 AI 默认输出有品位。知乎等全网都装了 Hallmark,“Hallmark 味"就是下一个 AI 味。作者自己也想得很清楚,ROADMAP 里把"受控的不完美”(手工肌理、受控抖动的排版)列为下一代方向。

第二,更新停了一阵。最后一次代码 push 停在 8 月 6 日,目前有 41 个 open issues。规则机制照常用,但别指望短期有新功能,踩坑先翻 issues。
第三,人群明确。它适合用 AI 编程助手做前端的人,不适合纯手写代码的团队,也不解决"一劳永逸"的审美问题。Hallmark 给的是下限(不丑、不假),上限(有辨识度)仍然取决于你喂给它的审美输入。
值得继续观察的信号
ROADMAP 里有几样东西值得盯着。
hallmark variant——同一需求并排产出三个结构不同的版本,专治"不知道还能更好所以接受第一版"。
图表规范——AI 生成的图表同样是重灾区,彩虹配色加 3D 甜甜圈,Hallmark 计划把数据可视化也纳入闸门。
brand-first 流程——从一段产品描述生成整套品牌体系并锁进 design.md,一页一页接着建。感兴趣的可以给仓库点 watch。
一句话总结:正在用 AI 做页面的人,Hallmark 值得花 5 分钟装上——安装成本一行命令,收益是每次出的页面至少不再"一眼假"。但记住它是地板,不是天花板。