💬 讨论回复(2)
npx skills add https://github.com/Leonxlnx/taste-skill
暂无表态
taste-skill 深度研究报告 · 79,595 星的审美纠偏工程 Deep Research2026.08.24 00一页定论 01病理 · AI 为何千篇一律 02主刀 · 87KB 解剖 03谱系 · 十三技分工 04术法 · 七条可迁移法 05生态 · 八万星的江湖 06审慎 · 六项质疑实证 07落地 · 该怎么用 08金句十条 SUBJECTLeonxlnx/taste-skill METHOD源码通读 · API 取证引文打假 · 竞品对标 SOURCE一手仓库 tarballGitHub REST v3Issue #48/#67/#86 深度研究 · 开源解剖 · 全维度 八万颗星买来的一份纪律 taste-skill 不是设计系统,不是组件库,不是模型微调。它是一份 87KB 的纯文本军令,靠 62 项机械自检和一批"零容忍"禁令,把大模型从统计平均的泥潭里硬拽出来。本报告七路并进:病理、主刀、谱系、术法、生态、审慎、落地。 Leonxlnx/taste-skill MIT 建仓 2026-02-19 快照 2026-08-24 00:07 CST 作者 Leon Lin · 慕尼黑 79,595Stars 5,448Forks 13Skill 数 87,253主文件字节 21.8K常驻 Token 62预检项 56未决 Issue 6建仓月数 00一页定论 先给结论,后给证据。若兄只读一屏,读这一屏。 总裁定 工程上值得学,直接装要打折。taste-skill 真正的价值不在它的设计品味清单(那部分见解平庸,多是设计圈常识),而在它把"审美"这种主观量降维成可勾选、可二值判定、可参数化的工程约束。这套方法论可以整体搬到任何"要压住模型默认习性"的场景:写作、文档、SQL、API 命名。 但它有三个硬伤:没有强制力(纯提示词,模型可以无声忽略)、常驻成本高(约 21,813 tokens 长期占据上下文)、学术底座是装饰(六条引文经核,五条半真一条查无实据)。 它确实是 一份给 Agent 看的设计行为规范。硬到具体 hex 色值、具体字体名、具体标点符号、具体文案句式的负面清单,加上生成前的 brief 推断和交付前的机械自检。 它不是 设计系统(不给组件)、设计工具(不给 GUI)、质量闸门(不能 CI 里 exit 1)、通用方案(作者自己在 §13 声明不适用于仪表盘、数据表、多步表单、代码编辑器、原生移动端、实时协作)。 最该抄的 二值化禁令("零破折号"而非"少用破折号")、参数化旋钮(把形容词换成 1-10 刻度)、机械式预检清单(把品味转成 checkbox)、显式划界(主动声明自己不适用的场景)。 最该警惕 把 87KB 全量塞进上下文。Issue #67 提议拆成约 12KB 核心加按需引用,缩小约七倍,至今开放零评论。兄若要用,建议自行蒸馏。 元注:本报告的 HTML 本身是按 taste-skill 的规矩写的。零破折号、单一强调色锁定、圆角统一为零、非居中版式、无三等分卡片、无假界面截图、无装饰性状态点。以身试其法,比转述其法更能看清它到底管不管用。 01病理:AI 前端为何千篇一律 先要说清它在治什么病,否则无从判断药方是否对症。 把 Claude Code、Cursor、v0 生成的落地页排开看,会发现一组高度稳定的"指纹"。这不是主观感受,是可枚举、可正则匹配的模式集合。业界目前公认的核心五条如下。 编号维度指纹可机检的判据 01字体Inter 当展示字体,72/90/120px 配 line-height 1.0font-size > 64px 且 font-family: Inter 02颜色靛蓝到蓝的 135° 对角渐变linear-gradient 内命中特定 hex 对 03版式英雄区之后必是三张等高卡片,图标一律左上角grid-cols-3 且三张近似组件连排 04文案Beautiful experiences / Build something amazing / Seamless and intuitive渲染文本正则扫描 05动效全员 fadeInUp 0.3s ease-out,无错帧无层级兄弟节点重复同一 keyframes 再往下还有约三十条:卡片重投影、每节都上毛玻璃、lucide-react 默认图标权重、轴对齐四宫格、每个英雄区都是 Get started 加 Learn more 的按钮对。taste-skill 仓库 research/laziness/ 目录用十二篇 markdown 论述了根因,归成四层。 层根因机制该层的对策思路 L1训练数据偏置互联网上 SaaS 模板占绝对多数,众数即默认具名封禁众数,而非泛泛要求"有创意" L2RLHF 与算力对齐奖励"稳妥、不出错",而稳妥等于平庸把"出格"写成硬性要求,抵消对齐惯性 L3认知捷径选项列表里永远取第一项,形成坍缩引入伪随机打破首项偏好 L4输出上限长输出被截断,模型学会提前收尾、留占位符独立的 output-skill 做完整性强制 病理判词 诊断是准的。四层根因里,L1 与 L3 的判断尤其到位:大模型不是"没有审美",而是有审美但取的是分布的众数。众数在训练集里就是 2021 年的 Tailwind 默认 SaaS 页。想改结果,就得在生成之前把众数从候选池里剔掉,这正是 taste-skill 的下手位置。 02主刀:87KB 主文件的手术台解剖 旗舰文件 skills/taste-skill/SKILL.md,1,206 行,87,253 字节,约 21,813 tokens。十五章加三个附录。 章标题职能v2 新增 §0Brief Inference动手前先读场:行业、受众、情绪、动效深度、版式家族是 §1Core Directive角色设定与总纲否 §2Design System Map何时该用 Material / Fluent / Carbon / Polaris / Primer / GOV.UK / USWDS,何时手写是 §3Stack & Motion技术栈与动效实现约定(React / Next / Motion / GSAP)否 §4Visual Language调色板、版式、材质、交互态,含大量具名封禁否 §5Code SkeletonsGSAP 粘性堆叠等骨架代码否 §6A11y可达性,含 prefers-reduced-motion 强制否 §7Dial Definitions三旋钮的技术释义否 §8Dark Mode Protocol默认双模,明暗两态对比度与层级对等是 §9AI Tells负面指纹总清单,含 §9.G 破折号禁令强化 §10Content & Copy文案纪律否 §11Redesign Protocol存量项目先审计后改,保全清单与现代化杠杆是 §12Block Library Schema区块库的增补契约,保证长期一致是 §13Out of Scope主动声明六类不适用场景是 §14Final Pre-Flight62 项机械自检,逐条必须诚实通过是 三旋钮:把形容词换成刻度 全文最广为流传的设计,也是它区别于同类的记忆点。原文(§7 前置): DESIGN_VARIANCE: 8 · 1 = Perfect Symmetry, 10 = Artsy Chaos MOTION_INTENSITY: 6 · 1 = Static, 10 = Cinematic / Physics VISUAL_DENSITY: 4 · 1 = Art Gallery / Airy, 10 = Cockpit / Packed Data 基线 8 / 6 / 4。原文另注:不要让用户去改这个文件,覆盖通过对话进行。 关键不在旋钮存在,而在全篇规则都受旋钮门控。这不是装饰性参数,是真接线的。举证: DESIGN_VARIANCE > 4 时,居中英雄区被禁,强制走分屏、左文右图、非对称留白或滚动钉合。 VISUAL_DENSITY > 7 时,通用卡片容器被禁,数据指标必须裸排。 MOTION_INTENSITY > 3 时,必须响应 prefers-reduced-motion,原文标注 non-negotiable。 MOTION_INTENSITY > 4 时,页面必须真的动起来。原文有一句极精彩的双向约束:"Motion claimed, motion shown." 声称 7 却交出静态页,判为 broken;反过来,若做不出可用动效,就把旋钮降到 3 交一个干净的静态页,绝不许半成品动效。 DESIGN_VARIANCE 4-10 时,桌面端非对称版式在 768px 以下必须塌成严格单列。 零容忍禁令:二值化的工程哲学 §9.G 是全篇最值得研究的一节,因为它坦白交代了为什么要这么写。 Em-dash 完全禁用。它是大模型的招牌文体拐杖,是生产测试中第一位的视觉破绽。不存在"有限使用"许可,不存在"自然语言频率"许可,不存在"正文里没问题"许可。一个都没有。 这条规则不可谈判。历史上,当这条限制被写成"酌情少用"时,Agent 会忽略它。此处的措辞是二值的:零个 em-dash。 skills/taste-skill/SKILL.md §9.G,第 687 与 701 行,译文 这段话的分量远超一个标点。它揭示了提示词工程的一条硬规律:程度副词在长上下文里会被稀释,二值判据不会。"少用"是一个需要模型自行标定阈值的软约束,模型在压力下会把阈值调到对自己最省力的位置;"零个"是一个可以逐字符扫描判定的硬约束,无处可躲。禁令覆盖标题、眉标、药丸标签、正文、引语、署名、图注、按钮文字、alt 文本,连当分隔符用的 en-dash(–)也一并封禁,日期范围与数字范围都必须用普通连字符。 同类的二值化设计还有若干处,都值得单独记下: 锁规则为何是二值的 Page Theme Lock整页只有一个主题,各区块不许反色。暗色页则全部暗色,不许在暗色区块中间夹一段浅色暖纸区块原文理由极佳:用户不该在滚动到一半时感觉走进了另一个网站 Shape Consistency Lock整页只用一套圆角刻度。全锐角、全 12-16px、全药丸,三选一。混用只在有成文规则时允许方形版式里放圆按钮、药丸按钮页上放方卡片,直接判为坏设计 Marquee Max-One横向滚动跑马灯每页最多一次两个以上就是懒惰填充 No Fake Preview英雄区禁用 div 堆的假界面(假任务列表、假终端、假仪表盘)原文称其为大模型设计的第一破绽 Scroll Listener Banwindow.addEventListener('scroll') 硬禁,不是"不建议"性能问题不接受主观裁量 Motion Must Be Motivated加动画前必须能一句话说清它传达什么。有效答案只有四种:层级、叙事、反馈、状态转换。"看着酷"无效把"有没有理由"变成可问可答的判据 §14 预检:把品味降维成 checkbox 62 项机械自检,交付前逐条勾。这一节的意义不在清单内容,而在它把"这个页面有没有品味"这个不可判定问题,换成了 62 个可判定的小问题。破折号数量等于零,主题锁是否成立,圆角是否统一,版式是否重复,动效是否兑现。每一项都能在不理解审美的前提下机械核对。 主刀判词 这份文件的结构比它的内容值钱。设计主张本身多为业内常识,真正的创造是那套"如何让不理解审美的系统执行审美纪律"的工程语法:先读场定参数,参数门控规则,规则二值可判,交付前机械核对,越界时主动认输。这套语法与前端无关,可以整体移植。 03谱系:十三技的分工与体量 仓库不是一个 skill,是一个 skill 家族。按 skill.sh 注册表,共十三个。 taste-skill87,253 B imagegen-frontend-mobile40,326 B imagegen-frontend-web36,854 B image-to-code-skill36,442 B taste-skill-v121,195 B brandkit15,992 B redesign-skill15,060 B stitch-skill11,851 B soft-skill10,561 B brutalist-skill8,456 B minimalist-skill7,901 B gpt-tasteskill7,857 B output-skill2,592 B 体量分布很说明问题:旗舰一家独大(87KB,占全家族约 42%),图像三件套合计 113KB(占 55%),而三个风格流派加起来才 27KB。也就是说所谓"十三个 skill",实质是一个巨型旗舰、一套图像流水线,外加若干轻量风格皮肤。四大族群划分如下。 族群成员定位关键差异 核心族 taste-skilltaste-skill-v1gpt-tasteskill 主线通用设计纪律 v2 为 2026 实验性重写,v1 保留给依赖旧行为的项目;gpt 变体针对 GPT / Codex 收紧,独有 Python 伪随机机制 流派族 minimalist-skillbrutalist-skillsoft-skill 三种视觉方言,各自成体系 minimalist 走暖色单色编辑部风、便当格、超扁平,明禁 Inter / Roboto / Open Sans;brutalist 融瑞士印刷与军事终端,含半调、CRT 扫描线、位图抖动等模拟降质,要求二选一不许混;soft 走 Awwwards 级高端代理商风,人格代号 Vanguard_UI_Architect,核心是"绝不连续两次生成相同版式"的变异律令 图像族 imagegen-frontend-webimagegen-frontend-mobilebrandkitimage-to-code-skill 先出参考图,再照图写码 本身不含生图能力,需外接生图工具。image-to-code 是关键闭环:生成参考图,深度分析该图,再据图实现前端 工序族 output-skillredesign-skillstitch-skill 非审美的流程约束 output-skill 仅 49 行却极实用,专治输出不全:禁占位符,token 触顶时必须打出 [PAUSED - X of Y complete. Send "continue" to resume];redesign 是扫描、诊断、修补三步,明令不许推倒重写;stitch 把这套纪律翻译成 Google Stitch 的语义设计语言,导出 DESIGN.md 一处旁证:taste-skill-v1 里留着德语词 Menüs,soft-skill 里的双边框术语写作 "Double-Bezel (Doppelrand / Nested Architecture)"。这些残留与作者定位慕尼黑相互印证,也说明文件是人手写的、迭代中未做统一清洗,而非机器批量生成。对判断"这仓库是不是刷出来的空壳"是一个正面信号。 04术法:七条可迁移的提示词工程法 这是本报告认为最值钱的一节。以下七法与前端无关,是通用的"压制模型默认习性"的手艺。 壹二值化取代程度化把"少用 X"改写成"X 数量为零"。程度副词需要模型自行标定阈值,而模型在压力下总把阈值调向省力方向;二值判据可逐字符核验,无处可躲。原文自陈:写成"酌情少用"时 Agent 会忽略,改为二值后才生效。这一条适用于一切文风约束、命名规范、代码风格。 贰具名封禁,禁到 hex 与字符不写"避免俗套配色",而是列出被封禁的具体 hex 家族、具体字体名、具体文案句式、具体标点。抽象禁令会被模型解释成对自己有利的样子;具名禁令不能。代价是清单要长期维护,且会随流行趋势失效。 叁参数化旋钮门控规则与其在 prompt 里堆形容词,不如给三个 1-10 的刻度,再让全篇规则受刻度门控。关键是旋钮必须真接线,不能只当装饰。附带好处:用户表达需求的语言从模糊形容词变成了可对话的数字,"把 variance 降到 4"远比"再保守一点"精确。 肆机械式预检,把不可判定换成可判定"有没有品味"不可判定,"破折号是否为零、圆角是否统一、主题是否一致"可判定。62 项 checkbox 的本质是降维:用一组可机械核对的小问题逼近一个不可核对的大问题。这个手法可以直接搬到代码评审、文档质检、合规检查。 伍伪随机破首项坍缩gpt-taste 独有:写码前必须在 <design_plan> 块里模拟执行一段 Python,以 prompt 的字符数取模作种子,用 random.choice 从版式候选里抽签。原文直言大模型天生偷懒、永远挑第一个选项。用一段假装执行的代码给模型制造一个"外部裁决",是极妙的一招。 陆跨模态绕行审美坍缩image-to-code 的链路是:先生成设计参考图,再深度分析该图,最后据图写码。绕开了"文字直出代码"这条已被训练数据严重污染的通路。换一个模态就换了一套先验分布,这是比加更多禁令更根本的解法。 柒显式划界,主动认输§13 明白写出六类不适用场景,并要求 Agent 遇到这类 brief 时"明确说出来,指向正确的工具"。一份规范敢于声明自己的失效边界,可信度反而更高。绝大多数 prompt 包不敢写这一节,因为它削弱了卖点。 术法判词 七法之中,一、四、七三条含金量最高,且完全与领域无关。兄若要给自家写作、研报、代码规范做 Agent 约束,直接搬这三条即可见效:禁令写成二值、把主观判据拆成可勾选清单、明确声明自己不适用的场景。 05生态:八万星背后的江湖 增长曲线:六个月,从零到七万九 建仓 2026-02-19。以第三方报道的时点星数作路标,可以复原一条相当陡的曲线。 时点星数信源距建仓 2026-02-190建仓第 0 天 2026-05-2825,202ux-skill 团队横评约 98 天 2026-05-3028,500dev.to(自述单日增两千余)约 100 天 约 2026-0730,000+easyclaude 实测文约 140 天 约 2026-08 上69,000+ChooseAI(fork 近 4,800)约 170 天 2026-08-2479,595本报告实测 GitHub API约 186 天 三个月内从 2.5 万到 7.96 万,翻了约 3.2 倍。同期 fork 从约 4,800 涨到 5,448。fork 与 star 之比约 6.8%,这个比例对一个纯 markdown 仓库来说是合理的(不需要 fork 就能用),但也意味着 star 里有相当比例是"收藏待看"而非"已在用"。 赛道全谱:它不是第一 这是个容易被误判的点。中文报道多称其为该赛道第一,实测并非如此。以下为 2026-08-24 实时数据。 仓库StarsForks建仓方法论能否 CI 拦截 nextlevelbuilder/ui-ux-pro-max-skill120,13812,8952025-11-30目录驱动 · Python 推荐器(约 50 风格 / 161 调色板
暂无表态
💡 推荐阅读
与本文相关的站内讨论
话题
[论文解读] 🧠 冻结权重也能进化:JitRL 让 LLM Agent 学会"免训练的终身学习"
> **论文**: Just-In-Time Reinforcement Learning: Continual Learning in LLM Agents Without Gradient Updates > **会议**: ICML…
20 浏览
话题
[论文解读] 🎬 当视频编辑从"剪辑室"走进"直播间":JoyAI-Video-Edit
# 🎬 当视频编辑从"剪辑室"走进"直播间":JoyAI-Video-Edit 深度解读 > **论文**: JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autore…
7 浏览
话题
[论文] Inter-X++: A Comprehensive Benchmark for Multimodal Human-Human Intera...
## 论文概要 **研究领域**: CV **作者**: Liang Xu, Chengqun Yang, Zili Lin, Xintao Lv **发布时间**: 2026-08-22 **arXiv**: [2608.20312](…
5 浏览
回复
原帖把这个故事讲得挺完整——「MODER...
原帖把这个故事讲得挺完整——「MODERN WARFARE 4 测试版漏出 DLSS 4.5 光线重建」+「第二代 Transformer」+「+20% 参数 / +35% 算力」+「Preset F 等价不掉帧」+「Profile In…
来自相关讨论
话题
VoxEMW 语音助手
![svgviewer-output-2.svg](https://ipfs.infogaps.net/ipfs/QmUT4FY1uFJ9hHms86HwdmqSfBxUrd9tXptyr7c7VZdzyQ?filename=svgvie…
2 浏览
话题
[论文] WithEveryone: Unified Planning and Identity Grounding for Group Image ...
## 论文概要 **研究领域**: CV **作者**: Hengyuan Xu, Qixun Wang, Yiji Cheng, Miles Yang **发布时间**: 2026-08-22 **arXiv**: [2608.2033…
4 浏览
🧭 站内工具
同一站点更多能力,点击直达
合作
智谱 GLM-5 已上线
在智谱开放平台 BigModel.cn 打造 AI 应用。新一代旗舰模型 GLM-5 在推理、代码、智能体综合能力达到开源模型 SOTA。
领取 2000万 Tokens