UI UX Pro Max 深度评测:12.7 万 Star 的设计 skill,192 套配色全过 WCAG,中文关键词却 0 命中

用过 Claude Code 写页面的人都见过同一种丑:紫粉渐变、千篇一律的圆角卡片、emoji 当图标。这不能全怪模型——设计规则散在几百篇博客、几十份设计规范里,它不知道该照哪一套下手。

有个开源 skill 干脆把这件事做成了数据库:192 个行业的配色与设计推理、79 种可检索的 UI 风格、119 条 UX 准则,全部固化成本地 CSV,再配一个纯 Python 的检索引擎。项目名叫 UI UX Pro Max,12.7 万 Star,MIT 协议。

我在沙盒里把它整个拆开跑了一遍:30 次设计系统生成、160 个自带测试、全量 192 套配色的对比度验算,以及 10 个中文关键词的命中测试。结论比”又一个热门 skill”复杂一些。

它是什么:把设计规则做成可检索的数据库

一句话定位:给 AI 编码助手(Claude Code、Cursor、Codex、Copilot、Windsurf 等 19 个客户端)装一个本地设计智库。你正常提需求”给我做个 SaaS 落地页”,它自动触发,先查库生成整套设计系统,再写代码。

架构上是三层:

  • SKILL.md(约 16KB):Agent 读的行为契约,规定 10 个优先级类别、什么情况必须查库、什么情况必须跳过;
  • CSV 数据层:14 个数据文件,行业、风格、配色、字体、图表、动效、UX 准则、22 个技术栈的规则;
  • search.py 引擎:4,031 行 Python,只用标准库,不装依赖、不发网络请求,用 BM25 排序 + 条件规则做推荐。

跑一条命令就能看到它的核心产物——search.py "beauty spa" --design-system 会输出八段结构:页面模式(Section 顺序 + CTA 位置)、风格(含性能成本与无障碍风险标注)、完整十六进制配色(含 CSS 变量名)、字体搭配(含 Google Fonts 导入链接)、关键动效、明确的反模式清单、以及交付前自检表。

我逐文件数了一遍行数,和官方口径对照:

数据 官方口径 我实测
行业配色 / 设计推理 192 / 192 192 行 / 192 行
UI 风格 79 可检索(50 活跃) 88 行(50 活跃 + 29 补充 + 9 弃用)
字体搭配 / UX 准则 74 / 119 74 行 / 119 行
技术栈 / 栈内规则 22 / — 22 个文件 / 1,260 行
图表 / 落地页模式 / 图标 25 / 34 / 105 25 / 34 / 105

没有注水。这点值得说一句:同类项目里,”宣称 100+ 工具、实际能跑的只有三成”是常态,这里每一个数字都对得上。

实测:数据是真功夫,工程链路是另一回事

一、470 毫秒,且逐字节可复现

我连续生成 30 次设计系统,总耗时 14.1 秒,平均 470 毫秒一次,全部在离线沙盒里完成。同一参数跑两遍,输出文件逐字节一致——因为它是确定性检索,不是让模型自由发挥。对流水线来说是好事:同样的需求,今天和明天给出的配色不会漂移。

二、自带测试全过

这是我最看重的一项。我直接跑仓库自带的测试套件:

160 passed, 7936 subtests passed in 30.47s

另外 validate_data.py 校验 12 个领域文件 + 22 个技术栈文件 + 推理表,全部 OK。一个”数据即产品”的项目,能把数据校验和测试做到这个程度,是它 12.7 万 Star 里最扎实的那部分。

三、61% 的文件永远不会被打开

我把 SKILL.md 和 README 里文档化的 18 条命令全跑一遍,并用一个 open() 钩子记录脚本读过的每个文件:

  • 技能安装目录共 73 个文件 / 3.41 MB;
  • 全部文档化命令加起来只打开 17 个文件(1.34 MB,39% 的字节);
  • 剩下 56 个文件、2.07 MB,脚本从不打开——其中 31 个是测试脚本和它们的夹具,会被一起装到用户磁盘上(npm 包里的 assets/scripts/tests 是 23 个文件、307 KB)。

这不是我一家之言。9 月 3 日有位开发者提交了一份 200 次运行的审计(issue #484),测得 82% 的文件从不被触及,还顺带发现 --design-system静默忽略 --stack 参数。维护者 9 月 6 日合并了修复,只修了第一条:我在当前主分支上实测,现在会打印一行 note: --stack nextjs is ignored in --design-system mode

但这里有个更现实的坑,见下一条。

四、中文关键词,一个都查不到

数据层全是英文关键词。我拿 10 个中文词直接查,结果是这样的:

查询词 命中 英文对照 命中
玻璃拟态 / 深色模式 0 glassmorphism / dark mode 1 / 1
落地页 / 仪表盘 0 landing page / dashboard 1 / 2
金融科技 / 电商 0 fintech / e-commerce 0 / 1
美容院 / 医疗 0 beauty spa / healthcare 1 / 1

中文查询返回的不是”空值”,而是明确的 count: 0——引擎会提示”这不是匹配到了空字段,是查询没命中数据库”。更实际的影响在设计系统模式:"美容院 落地页" 落到通用兜底(Minimalism & Swiss Style + 蓝色 #2563EB),而 "beauty spa" 给出的是 Soft UI Evolution + 粉色调 #EC4899。

但这不等于中文用户用不了。 真实链路里是 Agent 读英文的 SKILL.md,它自己会把你的中文需求翻成英文关键词再去查——中文圈已经有大量教程和实测(知乎、腾讯云社区、CSDN、B 站,还有一个 1.4k Star 的第三方中文教程站)。真正会踩坑的是”手敲中文命令当 CLI 用”的人。

五、192 套配色,全部通过 WCAG

我把 192 套配色的所有关键配对算了对比度(正文前景/背景、按钮主色/按钮文字、强调色/文字),违规 0 套——全部达到 4.5:1。这解释了它为什么敢把”对比度 4.5:1″写成第一条铁律。

顺带一个有意思的数字:192 套里 32 套(17%)主色落在紫粉色相区间,主要集中在 AI 产品、创意机构、美妆、游戏这些品类。而它的推理表里有 14 个行业明确把”AI 紫粉渐变”写进反模式清单——我逐一核对,这 14 个行业自己的推荐配色都不是紫粉。规则和它自己给的结果,内部是自洽的。

六、版本链路:npm 上停着一个月前的代码

它的 CLI 走 npm,这里有两处实打实的问题。

第一,主包一个月没发新版。 ui-ux-pro-max-cli 最新版 2.15.0 发布于 8 月 13 日,而仓库主分支已经走到 9 月 10 日。仓库里有两个未关闭的 issue(#451、#457)说明原因:8 月 18 日起发布流水线因 NPM_TOKEN 被拒而失败,”自 2.15.0 之后什么都没发出去”。我把 npm 包下载下来实测:npm 版至今仍在静默忽略 --stack,主分支已修的那个提示,装 npm 包的用户拿不到。上周仍有 12,882 次下载。

第二,有个 1 月的旧包还挂在 npm 上。 老包名 uipro-cli 停留在 2.2.3(2026 年 1 月 29 日),每周仍有 4,162 次下载;装它的人会遇到 --global 报错的 bug(issue #215,3 月 29 日开的,21 条评论至今未关)。README 里明写”旧包已废弃,不要用”,但 npm 上并没有把这条路堵死。

还有个小的:官网 uupm.cc 至今写着 57 种风格 / 95 套配色 / 8 个技术栈——数据已经涨到 79 / 192 / 22 了。开源核心之外它还有付费版(品牌、Logo、CIS、演示文稿设计),但官网没有公开价格页。

它和同类比,适合谁

市面上”治 AI 味”的设计 skill 大致两条路线:

  • 提示词/规则路线:taste-skill(84k Star)和 hallmark(28k Star,Anti-AI-slop)走的是这条路——把审美纪律写成规则塞进 Agent。轻、灵活,但覆盖面和一致性取决于模型当场发挥。
  • 数据工程路线:UI UX Pro Max 是这条路——先查库、再生成,配色/字体/对比度有确定答案。

适合:独立开发者、后端转前端、MVP 阶段要快速做出”不像 AI 生成”的界面的人;以及需要一套可复用的设计 token(它能 --persist 把设计系统落成 MASTER.md + 页面覆盖文件,下次直接读文件)。

不适合:已有成熟设计系统的团队(它的建议会和你的品牌规范打架);只做后端/DevOps 的人(技能自己也会跳过);以及期待”它直接替代设计师”的人——它解决的是”下限太低”的问题,不是”上限”。

结论

值得一试,而且是我近期读过的 Agent Skill 里工程底子最厚的一个:数据不注水、测试全过、配色真的过 WCAG、离线可复现。它的短板不在能力,在”发货”——npm 包落后一个月、旧包名还在分流、包体里塞着用户永远用不到的测试脚本,以及一套只认英文的关键词库。

装的时候认准新包名:npm install -g ui-ux-pro-max-cli && uipro init --ai claude。看到 uipro-cli 请绕开,那是 1 月的版本。

如果你也在用 Agent 写前端,可以顺便看看我们评测过的 Pi Agent(10.4 万 Star,默认只给模型 4 个工具)和 ECC(25.5 万 Star 的 Agent 工程纪律系统),都是同一类问题的不同解法。

关注 AI商业快讯,每天一篇 AI 热点深度解读。

发表评论