多彩编程 多彩编程MZPH · CODE BLOG
ARTICLE DETAIL

文章详情

深耕前端与后端开发技术的一线实战笔记与踩坑复盘。

如何检验蒸馏效果?写作蒸馏器.skill的6项质量自检清单

如何检验蒸馏效果?写作蒸馏器.skill的6项质量自检清单 如何检验蒸馏效果写作蒸馏器.skill的6项质量自检清单【免费下载链接】writing-dna-skill写作蒸馏器.skill蒸馏复刻任意写作风格的 agent skill | Writing DNA Distiller - distill and recreate any writing style as an agent skill项目地址: https://gitcode.com/gh_mirrors/wr/writing-dna-skill写作蒸馏器.skill英文名writing-dna-skill可以把任意账号或作者的写作风格蒸馏成一套可复用的 Writing DNA——涵盖语言、结构、选题、素材、认知框架与视觉风格六个层次。蒸馏完成只是第一步真正决定「像不像」的是发布前逐项核对的 6 项质量自检清单 为什么蒸馏完成后还要自检很多人蒸馏完就急着让 AI 开写结果常遇到三种翻车现场「读着像但想法不像」只复刻了表层语言认知框架是空的「整合文档塞不进上下文」Writing-DNA.md写成了十万字小作文agent 读了也记不住「结构模板只有一种」模板只有访谈类换一篇短评就露馅问题通常出在蒸馏阶段就偷了懒。好消息是SKILL.md 第五节「质量标准」已经把验收标准写成了可勾选的清单照着核对即可。写作蒸馏器质量自检6项标准速览| 序号 | 检查项 | 合格标准 | 对应产物 | | - | - | - | - | | 1 | AI 盲测复刻 | 评分 ≥ 7/10 |Writing-DNA.md| | 2 | 结构模板覆盖度 | ≥ 3 种内容类型 |文章结构模板.md| | 3 | 核心命题含金量 | ≥ 3 条非显而易见 |写作视角与认知框架.md| | 4 | 元数据覆盖率 | ≥ 80% 语料文章 |_meta/目录 | | 5 | 视觉分析完整度 | 配图、排版、色彩三维度 |视觉风格指南.md| | 6 | 整合文档篇幅 | ≤ 4000 字 |Writing-DNA.md|下面逐项展开每项都给出「怎么查、查什么」的具体方法。第1项AI 盲测——不看原文能写出 7 分以上的文章吗这是整个清单里最重要的一项相当于蒸馏效果的「期末考试」。操作方式找一个没读过该作者任何文章的人或让 AI 只读Writing-DNA.md根据这份文档写一篇该风格的新文章再和原文放在一起盲评。合格线评分 ≥ 7/10——不仅文字像视觉呈现也像。不达标怎么办语气像但观点不像 → 回查 L3-L5 认知框架是否提炼到位框架像但语感不像 → 回查 语言DNA.md 的词频、句长、标点记录是否完整看着不像 → 回查 L6 视觉风格分析盲测的原理在 SKILL.md Step 7 中有明确定义给任何一个没读过该账号的人读完下笔能写出 70 分的近似风格文章。第2项结构模板至少覆盖 3 种内容类型打开 文章结构模板.md数一下按内容类型分了几套模板。合格标准覆盖该作者至少 3 种内容类型例如访谈类、深度分析类、短评类各一套。常见误区只按出现频率最高的体裁做模板。某作者 80% 是访谈模板却只有访谈类——一旦要写短评agent 只能瞎猜开头和收束方式。自查要点每套模板是否写清了开头 hook 类型、正文架构、转折方式、结尾处理模板里的字数区间如「引题段 150-300 字」是否来自真实统计而非拍脑袋第3项认知框架提炼出至少 3 条「非显而易见」的核心命题打开 写作视角与认知框架.md检查 L5 层的核心命题列表。合格标准至少 3 条且每条都「非显而易见」——即读者不看几篇原文根本猜不到。判断方法遮住原文只读命题。如果一条命题像「该作者喜欢用数据说话」这是看第一篇就能得出的含金量不足如果是「该作者只在争议发酵 48 小时后切入且永远从系统视角而非当事人视角开刀」这才是真正蒸馏出来的认知。这一层解决的是「怎么想」缺失时文章就会「文字像但灵魂空」。第4项元数据覆盖至少 80% 的语料文章统计_meta/目录下的元数据条数与raw/原文总数。合格标准覆盖率 ≥ 80%。元数据是后续词频统计、结构归纳和原文筛选的基础SKILL.md Step 2 明确写着「不可跳过」。字段可对照 example.schema.json 检查重点核对article_type内容类型和topic_tags主题标签两个字段——后续按体裁挑选 5 篇最接近原文时全靠它们。第5项视觉分析覆盖配图、排版、色彩三个维度打开 视觉风格指南.md逐项确认三个维度是否都有实质内容| 维度 | 应包含的分析内容 | | - | - | | 配图策略 | 图文比、图片类型分布、图片功能分类证据型/演示型/数据型等 | | 排版格式 | 字号层级、加粗频率、段落长度节奏、分隔方式 | | 色彩使用 | 彩色文字场景、背景色块、整体色调倾向 |特别注意按 SKILL.md 的跨层原则分析时必须抽样 5-10 篇文章逐张打开图片看内容——很多账号的截图是论证链的一部分只看文字会漏掉承重结构。第6项Writing-DNA.md 控制在 4000 字以内打开最终的 Writing-DNA.md看字数。合格标准单文档 ≤ 4000 字。为什么卡字数原文在 SKILL.md 里给了直白的解释——「过长 没蒸馏干净」。整合文档是压缩后的结论如果还写不短说明分层产物里没消化的东西都被塞进了总入口agent 每次写作都要吞下冗余上下文稳定性反而下降。超标的处理把细节放回对应的分层产物语言、结构、认知、视觉总入口只留约束与优先级。自检通过之后写作与去 AI 味6 项全部打勾才算拿到「写作许可证」。正式写作前还有两道工序写作前必读让 agent 读完全部蒸馏产物四份分层产物 Writing-DNA.md再从raw/挑 5 篇体裁、题材最接近的原文通读读完要能说出这 5 篇的共同语感再动笔。具体流程见 SKILL.md 第六节。写完之后去 AI 味用仓库内置的 skills/lieflat-less-ai-tone/SKILL.md 清理成稿中的 AI 痕迹。注意一个优先原则蒸馏产物与去 AI 味规则冲突时以蒸馏产物为准——目标作者本来就爱用破折号就不该按通用规则删掉。如果自检时还需要核对仓库整体状态可参考 docs/release-checklist.md 的发布前检查清单想先看看目录组织长什么样可以看 examples/format-only/README.md 里的纯格式示例。写在最后蒸馏的本质是把「风格」这个模糊感受拆成可以被记录、执行和检查的规则。6 项清单检查的正是这件事有没有做扎实AI 盲测验证整体效果覆盖度检查验证没有偏科字数上限验证是否真「蒸」过了。照着清单逐项打勾你的 Writing DNA 才能稳定复刻出 7 分以上的风格文章 ✍️【免费下载链接】writing-dna-skill写作蒸馏器.skill蒸馏复刻任意写作风格的 agent skill | Writing DNA Distiller - distill and recreate any writing style as an agent skill项目地址: https://gitcode.com/gh_mirrors/wr/writing-dna-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表