All skills
cat-xierluo avatar

/de-ai-polish

@6113db6

检测并修订中文文章正文中的模板腔、姿态腔、隐藏排比、分析型例证同构、重复语义骨架、假排名、固定节拍和其他 AI 化表达,同时保护作者事实、既有标题层级、必要功能性列举、法律术语、Markdown 图片与既有声音。文章完成初稿后、用户要求“去 AI 腔/更像真人/按作者样本改写/检查排比或口吻”时必须使用;无作者样本时只做最小清理,不得凭空注入第一人称、比喻、短句金句或经历,也不得借去 AI 之名重做文章结构。

Use this Skill: https://skilld.dev/gh/cat-xierluo/legal-skills/de-ai-polish

This session only. Nothing lands on disk.

CHANGELOG.md

≈9.7k tokens on demand. Your agent reads this file only when SKILL.md points to it.

Changelog

[3.2.6] - 2026-08-04

文档完善

  • 仓库停用 Cloud Plugin Marketplace 后,安装说明改为 legal-skills monorepo 直接使用/复制与 subtree 独立仓库两种渠道;不改变正文修订规则和评测合同。

修复

  • 将本机私有 VoiceAnchor 从 references/ 迁移到被 Git 忽略的 assets/local-voice-anchors/;本机 config.json 支持命名 anchor 与 default_voice_anchor_id,但默认项只在用户明确选择 local_anchor 后生效,不改变无样本清理行为。
  • 新增候选外“论证脊柱账本”:逐项保护源稿中的核心区分、因果中间环节、例外、比较、风险分布和多个放大因素;上位摘要不能替代唯一机制,每项必须在最终稿有可定位落点。
  • 关系证据卡新增“关系本身的源稿锚点”。A 与 B 各自有材料不再足够;同一处原文必须同时提到两端或明确用同一个具体变量约束两端,必要推论不得新建时间顺序、程序路径或共同目标。
  • 末节人工复扫改为逐段标注 JUDGMENT / MECHANISM / CONSEQUENCE / SUMMARY,只允许一个 SUMMARY,阻断解释价值与责任后又用同一组名词压缩结论。

回归来源与验证状态

  • v3.2.6 在同一篇真实文章、同一份私有 VoiceAnchor 上完成无旧输出上下文的隔离前向:确定性边界 12/12,图片 14/14、标题 5/5、Protected Spans 22/22,VoiceAnchor 新增长连续重合、风格回归均为 0;语义骨架原始候选 9 个,其中功能性导航 6 个、普通正文硬计数 3 个,无相邻复唱,末节 1 个。
  • 独立断言评审为 10/10。第二部分保留六类实质信息,只使用源稿明示的付款/保密共同变量;没有补造违约到管辖的程序链或知识产权与解除的继续/退出关系。论证脊柱中的风险分布、中间层取信、三类法律放大因素和流畅性推迟复核均有最终落点。
  • 三稿匿名盲评为 v3.2.6 91 分、v3.2.3 88 分、v3.2.5 81 分,v3.2.6 首次超过此前正文质量基线。优势来自关系纪律、论证脊柱和单一末节总结;取舍是自然度单项 16/18,仍略低于 v3.2.3 的 17/18,部分转场还有说明书感,不宣称所有人味维度均已超过旧版。
  • 单元回归 4 + 7 + 9 项及 quick_validate.py 通过,git diff --check 无异常。指令稳定性静态审查识别 3 个 checker、6 条硬约束,Harness 已知失效模式为 0;因缺少候选外签名硬约束基线,正式稳定性状态仍为 NOT_VERIFIED(ISG-006)。

[3.2.5] - 2026-08-04

修复

  • 将语义骨架的“扩大召回”与“硬删除配额”分离:所有候选继续进入报告,紧跟“第 N 层/种/步”等显式导航的说明项标记为 functional_navigation_item,不再因分类本身整齐而计入普通正文阈值。
  • 普通正文门禁改为全文最多 6 个、单节最多 2 个,并新增相邻同功能候选最多 1 个、最后一节最多 1 个;继续阻断第二部分连续复唱和结尾多轮收束,但不强迫每一节只剩一个限制句。
  • 明确禁止“为了过门禁而摘要化”:有独立对象、判断来源、条件、机制和后果的段落应保留;功能性导航的豁免也不覆盖五项都落到同一句“仍需人类判断”的同义收束。
  • 新增功能性导航五项回归样本;语义门禁结果同时报告原始候选、硬计数候选、导航候选、相邻重复和末节计数。

回归来源与验证状态

  • v3.2.4 同文前向稿确定性边界 12/12,机器语义候选由 v3.2.3 的 9 个降至 4 个,空间隐喻回归为 0;独立断言仍为 8/10,其中人工把“五种形态”各自的错位机制也计入同一能力边界家族。
  • 匿名盲评以 87.0 对 82.4 选择 v3.2.3。v3.2.4 虽在结尾、映射谨慎度和隐喻节制上更好,却把有对象、条件和后果的论证压成分类摘要,作者判断来源与段落动力变弱。
  • 新门禁对 v3.2.3 仍因普通正文 7 个、第二部分相邻复唱和末节 2 个而阻断;对 v3.2.4 记录原始 4 个、硬计数 2 个并放行。v3.2.5 前向稿断言 9/10,三稿盲评 88 分,高于 v3.2.4 的 86 分但低于 v3.2.3 的 93 分;功能导航误伤已修复,论证脊柱与关系来源仍需继续处理。

[3.2.4] - 2026-08-04

修复

  • 能力—限制骨架召回扩大到省略 AI 主语的“措辞完整、填入空白、规则复述、建议自洽、格式规范”等隐式能力端,并补充“欠缺/尚有距离”等限制形式。
  • 公众号评论的单节集中度阈值由 2 收紧为 1,避免结尾连续用“初稿易得—判断不转移—律师负责”多轮收束。
  • 新增 NO-REPEATED-SPATIAL-ACCESS-METAPHOR:入口、门槛、进入、回到内部、穿透、退场等同一空间图式跨三段出现即阻断,中心概念只保留一至两处必要解释。

回归来源与验证状态

  • v3.2.3 确定性边界 12/12,匿名盲评以 89.1 对 84.9 选择 v3.2.3,第二部分关系层首次完整通过;但独立人工断言仍为 8/10。
  • 人工评审把措辞完整、填空、规则复述和建议自洽识别为同一能力边界家族,保守计数至少 9 组;旧门禁仅报 4。另有门槛/进入/内部空间隐喻跨段复用和一处“偏差承受压力”的搭配问题。
  • v3.2.4 前向稿将机器语义候选降至 4 个且空间隐喻回归为 0,但独立断言仍为 8/10;匿名盲评以 87.0 对 82.4 选择 v3.2.3。单节只留一个候选导致正文摘要化,v3.2.4 不作为完成版本。

[3.2.3] - 2026-08-04

修复

  • 排除“都属于风险、都要结合具体合作、都需要判断、都发生在履行或偏离阶段”等宽泛同类项;只有源稿明确共享具体变量,或一端改变另一端的解释、效果、顺序,才算可写入的关系。
  • 语义门禁新增“必须、另一项工作、难点在于、只对应”等能力边界逃逸形式;对 v3.2.2 前向稿的召回由 5 恢复到 10,覆盖独立人工评审指出的 8 处候选。
  • style_regression_gate.py 新增 NO-COMPRESSED-APHORISM-EVASION,阻断把反复出现的能力边界压成“工具走到边界/退场,留下判断与责任”等短金句。
  • 明确通用主题词和反复出现的核心概念不得作为出现次数锁定的 Protected Span;误选后应从源稿重建快照,不能为通过门禁机械补回重复。
  • 新增 NO-ABSTRACT-ENTRY-METAPHOR,阻断把“入口顺滑”换成“更低的入口/低摩擦入口”的同义逃逸,要求直接写启动成本和实际动作。

回归来源与验证状态

  • v3.2.2 确定性边界 12/12,三稿匿名盲评以 90.4 分胜过 v3.1.0 的 81.9 分和 v3.2.1 的 78.6 分,证明过程泄漏修复、段落推进与总体发表感已有实质改善。
  • 独立人工断言仍为 8/10:第二部分补造“违约责任—解除条件”的共同关系;人工识别至少 8 个能力—责任骨架,结尾又出现压缩式双金句。v3.2.2 因此不作为完成版本。
  • v3.2.3 的新增单元回归和历史失败稿复检已通过;新一轮前向正文质量保持 NOT_VERIFIED,待隔离运行和独立评审完成。

[3.2.2] - 2026-08-04

修复

  • 修复 v3.2.1 把候选外信息写进读者正文的回归:关系证据卡、材料充足度、源稿导航、扫描范围和评测结论只能约束处理方式,不能成为正文解释。
  • scripts/style_regression_gate.py 新增 NO-EDITORIAL-PROCESS-LEAKAGE 与 NO-FRAMEWORK-STARTER,阻断“按源稿导航”“材料不足以相连”“不是若干项检查任务”和“先承认一个前提”等已知伪影。
  • 语义骨架门禁扩大到“规范外观/完整初稿/生成速度 + 判断尚待/无对应关系/责任未消失”等隐式形式;公众号评论硬阈值收紧为全文 5 个、单节 2 个,脚本失败不得由报告中的人工归并覆盖。

回归来源与验证状态

  • v3.2.1 同文前向运行的确定性边界为 11/11,独立人工断言为 8/10;匿名盲评以 8.2 对 7.9 小幅选择 v3.2.1,决定性优势是第二部分没有补造源稿外关系。
  • v3.2.1 的自然度仍明显落后于 v3.1.0:正文出现“源稿”“导航仍保留”“材料不足”等编辑现场语言,且人工识别的能力—责任骨架超过 5。旧语义门禁只召回 3 个,属于假阴性。
  • 扩大后的门禁在 v3.2.1 输出召回 11 个、v3.1.0 输出召回 14 个并同时阻断;过程泄漏门禁在 v3.2.1 输出检出 5 段,另检出 1 处框架启动语。v3.2.2 前向正文质量在新一轮匿名比较完成前保持 NOT_VERIFIED。

[3.2.1] - 2026-08-04

修复

  • 修复 v3.2.0 的关系层扩写回归:每组关系写入正文前必须建立双端源稿锚点;模型自身的法律常识、行业惯例和合理推测不再被视为作者材料。
  • 明确禁止为连接分析例子新增源稿没有的交易联系、履行地点、付款里程碑、程序路径、经营限制、技术使用后果或其他审查变量;材料不足时压缩列举或标记 AUTHOR_MATERIAL_NEEDED。
  • 增加判断强度不升级规则:Voice 校准不得把保留、可能性、条件和未知改成更强裁断、普遍频率或必然后果。
  • 扩大语义骨架召回到省略 AI 主语的“生成/词面/初稿/外观 + 只完成/不能/还要 + 核验/判断/责任”变体;同时检查全文总量和单节集中度,避免只统计显式“AI 可以……但……”造成假阴性。

新增

  • 在 references/expression-transformations.md 新增关系证据卡,记录拟写关系、两端源稿锚点、依据类型、判断强度和停止决定。
  • 新增隐式能力—边界骨架回归 fixture;语义门禁回归增至 3 类,完整深层门禁回归增至 6 项。

回归来源与验证状态

  • v3.2.0 同文前向运行的机器边界为 11/11,但独立人工断言仅 7/10;v3.1.0 基线为 10/10。匿名盲评以 8.6 对 7.9 选择 v3.1.0。
  • v3.2.0 失败不是因为六项信息遗漏或标题越界,而是为关系层补入源稿外审查条件和后果链、提高判断语气,并在结尾换词重复能力—责任结论。
  • 扩大后的语义门禁对匿名获胜稿召回 9 个原始候选且通过(各节不超过 3、全文不超过 12);对失败稿召回 13 个并阻断(两节各 4),修复了旧启发式只报 2 个的假阴性。
  • v3.2.1 前向正文质量在新一轮匿名比较完成前保持 NOT_VERIFIED。

[3.2.0] - 2026-08-04

改进

  • 将“功能性列举”拆成两类:分类、步骤、责任分配和需逐项核对的内容继续保护;只用于共同证明一个判断的多个例子改按条件、相互作用、冲突、时间、审查或责任关系组织。
  • 明确分析型例证不得被自动扩成等长、同功能、同收束方式的“一是、二是……”段落;源稿没有关系材料时压缩列举,不通过虚构场景制造自然感。
  • 增加跨段、跨节语义骨架复扫,识别只换词却反复表达“工具能完成表层任务,但人的判断、经验或责任仍不可替代”的结构。
  • 保持 v3.1.0 的标题冻结边界:上述重组只发生在正文内部,不新增、删除或调整二级、三级标题。

新增

  • 新增 scripts/semantic_repetition_gate.py,按段召回明显的能力—限制—判断/责任骨架;阈值用于触发人工回读,不把正则命中冒充语义真值。
  • 新增 scripts/voice_anchor_copy_gate.py,比较源稿、最终稿与作者样本,只阻断改写后新增的长连续重合;默认输出仅含位置、长度和哈希,不回显私有短语。
  • 新增 5 项确定性回归,覆盖换词后的语义骨架重复、单次功能性边界、样本新增复刻、合规转述及源稿已有重合豁免。

当前验证

  • 新增 5 项单元回归通过;语义骨架门禁在上一轮两份真实输出中分别召回 14 和 15 个候选段,确认能够捕获原有词面扫描遗漏的跨节重复。
  • VoiceAnchor 门禁放行 v3.1.0 候选,并阻断 v3.0.0 基线中的一处新增长连续重合;默认输出未暴露对应短语。
  • 同文 v3.1.0/v3.2.0 前向 A/B 尚在执行,正文改善结论在完成盲评前保持 NOT_VERIFIED。

[3.1.0] - 2026-08-04

改进

  • 收紧 Skill 职责边界:只处理既有标题框架内的正文语言与段落表达;二级、三级及其他 Markdown 标题的写作、层级和导航调整交给 WeChat Article Writer 等上游写作流程。
  • 明确内部段落功能标注、临时分组和风险归类不得直接写成成稿标题;隐藏列表应在原有小节内通过合并、承接、因果、时间或场景重组处理。

新增

  • 新增 scripts/heading_preservation_gate.py,对改写前后的 ATX 标题行逐行核对,阻断标题新增、删除、改名、升降级和重排。
  • 新增标题保护正反例,覆盖“只改正文”放行,以及新增三级标题、修改标题文字、改变标题层级三类越界行为。

门禁边界

  • 标题门禁只证明标题行未变,不评价原有标题体系是否合理;标题本身存在模板腔时只在报告中标记,不由本 Skill 直接修订。

验证

  • 6 项单元回归通过;标题正例允许只改正文,新增三级标题、改名和升降级三个反例均被阻断;静态 Harness failure audit 无 finding。
  • 对同一篇真实公众号文章分别运行 v3.0.0 基线与 v3.1.0 候选:两版都保留 5 行原标题且未新增 H3;候选的差异在于该行为由 Skill 自身的主动门禁保证,而非只依赖任务提示。
  • 独立断言验收为候选 7/8、基线 6/8;匿名正文盲评以 8.6 对 8.3 选择候选。两版仍有第二部分六段同构和跨章节“AI 可以……但/却/仍不能……”语义骨架,尚不能声明正文问题已经全部解决。
  • 本轮只有单篇、每版单次运行,执行时长和 token 数据为 NOT_VERIFIED;跨题材稳定性仍需后续样本验证。

[3.0.0] - 2026-08-04

核心变更

  • 将去 AI 目标从“禁词清理+默认个人风格注入”改为“作者证据+段落功能+最小充分改写”。无作者样本时进入 cleanup_only,不再强制加入第一人称、生活比喻、对话感或短句金句。
  • Voice Calibration 从句长、词选等七个表层维度扩展到十维,新增认识来源、不确定性形态和段落动力;关键判断可使用作者证据卡,缺少材料时标记 AUTHOR_MATERIAL_NEEDED,不得编造真情实感。
  • 明确区分功能性列举与修辞性排比:分类、步骤、职责和“五层/五种”等结构默认保护;禁止把“一是、二是、三是”改成“最典型、最容易、也容易”等隐藏列表和假排名。
  • 保护列举形式时同步复核分类尺度;两套“N 分法”粒度错位或被强行一一对应时标记 STRUCTURE_REVIEW,未经授权不擅自重建理论。

新增

  • 新增本机私有 VoiceAnchor 机制:个人样本统一存放在 references/local-voice-anchors/,由项目 .gitignore 排除;公开 Skill 不再收录个人样本、作者 profile 或 anchor 注册表。
  • 新增 references/pollution-patterns.md,把 7 类污染和高风险模式从 SKILL.md 拆出,降低主指令上下文负担。
  • 新增修复伪影复扫:检查隐藏列表、替换口癖、强加口语/比喻/短句、虚构经历、anchor 复刻和专业结构误伤。
  • 新增 scripts/style_regression_gate.py 及正反例,阻断已知假排名组合并允许功能性五层列举。

改进

  • 重写 references/expression-transformations.md:从固定替换句库改为删除、合并、补足机制、恢复结构和基于作者材料重建等操作目录。
  • 重写 references/sentence-rhythm-guide.md:删除“长句—长句—短句点睛”等节奏配方,改为按事实、判断、机制、边界和过渡等段落功能判断节奏。
  • run-plan.json 和评分回执升级到 schema v2,显式记录 voice_mode 与 voice_anchor_id;新增 VOICE-MODE-DECLARED-BEFORE-REWRITE 主动门禁。
  • voice 模式下的评分检查新增 no_repair_artifact,总分不得抵消隐藏列表、虚构作者材料或样本复刻。

门禁边界

  • style_regression_gate.py 只证明未命中已知假排名组合,不证明全文没有 AI 腔;段落功能和作者证据仍需 Agent 通读。
  • 本机私有 anchor 只在用户明确选择且文件存在时启用;缺失时回退到 cleanup_only 或请求重新提供样本,不得假装已经读取。

[2.2.0] - 2026-07-25

新增

  • 新增 scripts/delivery_gate.py:改写前绑定 scene、作者样本使用状态、Protected Spans 与源稿,交付前复核真实最终稿和评分回执。
  • 为 SCENE-DECLARED-BEFORE-REWRITE、PROTECTED-SPANS-PRESERVED、QUALITY-SCORE-GATE-PASSED 建立稳定 constraint ID、主动 checker、正例、变异例和历史反例。
  • 新增 3 组自动回归,覆盖图片整行、场景声明、Protected Span 改写、评分阈值和快照后计划变化;已完成三轮隔离重复执行。

改进

  • 场景判定不再只是自然语言步骤:必须在改写前写入 run-plan.json,即使没有额外 Protected Span 也要显式记录空数组。
  • 评分回执必须绑定最终稿 SHA-256、scene、五维得分、总分及 voice profile 检查;总分或单维门槛不满足时返回非零退出码。
  • 前向验收发现旧评分文档把精炼度写成 /1.0、其余维度按 /2.0,且示例总分无法由分项复算;现统一为五维各 0-2 分并直接相加,硬阈值集中到 config/quality-score-rubric.json,快照同时绑定 rubric hash。
  • 稳定性合同由 1 个 checker / 1 项硬约束扩展为 2 个 checker / 4 项硬约束,skill-lint assess 当前仅剩候选外基线 ISG-006。

门禁边界

  • checker 能证明场景和保护项在改写前声明、Protected Spans 原样保留、评分步骤及既有阈值执行;不能证明 LLM 给出的主观分数绝对准确。
  • 三轮 deterministic 回归不等于正式 agent 质量评测。没有冻结候选 commit、真实写作 golden 和候选外签名基线前,不声明 INSTRUCTION_STABILITY_VERIFIED。

[2.1.0] - 2026-07-24

新增

  • 新增 scripts/protected_markdown_gate.py,在改写前对 Markdown 图片所在整行生成不可覆盖的 manifest,并在最终交付前校验原文、顺序、数量和 SHA-256。
  • 新增机器可读指令稳定性合同与正例、删除、改写、重排、部分保护等回归样本,约束 ID 为 PRESERVE-MARKDOWN-IMAGE-LINES。

修复

  • scripts/fix_punctuation.py 改为在任何标点转换前保护图片所在整行,不再只保护 ![]() 语法片段。
  • 覆盖 URL 含嵌套括号、同一行有前后文本、连续多图和引用块图片等边界场景。

门禁边界

  • 图片行删除、移动、改写或数量变化时 checker 返回非零退出码;默认没有例外。用户明确授权修改图片行后,必须以授权后的源稿重新建立快照,不得绕过 checker。
  • 当前合同已可由 skill-lint 识别并执行图片保护正反例;尚未建立外部签名基线,也未完成全部软约束的三轮真实产物验证,因此不得声明整体 INSTRUCTION_STABILITY_VERIFIED。

[2.0.1] - 2026-06-23

改进

  • 补齐 Voice Calibration 的样本使用边界:只使用用户提供或确认可用于本次任务的作者样本,不主动抓取或推测私人样本。
  • 明确 Voice Calibration 只学习表达特征,不冒充作者身份、不复制样本原句或高辨识短语、不引入样本事实。
  • 在 Step 7 与 references/quality-scoring.md 增加 voice profile 附加门禁:profile 明显偏离、反例复现、样本复刻或事实污染均需回炉 Step 4/5。

文档完善

  • 更新 references/personal-style-guide.md:新增“样本与身份边界”“匹配门禁”,并将提取步骤改为先确认样本边界。
  • 更新独立 README 与发布索引口径,补齐 Voice Calibration 与 v2.0.1 版本同步。

[2.0.0] - 2026-06-22

核心变更:Voice Calibration 改造 Step 5

问题背景:v1.x 的 references/personal-style-guide.md 是单一参考样本提炼出的静态特征清单,把"这个作者的习惯"当成了通用规则。Step 5 注入风格只能套抽象正向特征,缺少"从任意目标作者样本提取声音"的可操作流程——当用户想让改写贴近某个具体作者(如自己、某位律师)时,无能为力。(注:样本使用边界、参考样本与实际改写对象的对应关系等更细节的限定,在 v2.0.1 才补齐——v2.0.0 阶段尚不要求"样本必须来自目标作者本人"。)

新增

  • Voice Calibration 流程(references/personal-style-guide.md):
    • voice profile 七维度:句长分布 / 词选层级 / 段落开头习惯 / 标点习惯 / 口头禅与过渡 / 观点密度 / 语气倾向
    • 提取步骤(通读 → 逐维填 profile → 标记反例 → 产出声音画像)
    • author profile 可填模板
  • Step 5 两条路径:有作者样本 → 走 Voice Calibration 提取 voice profile 并匹配(样本优先);无样本 → 用默认正向特征。

变更

  • references/personal-style-guide.md 原有 8 节特征重新定位为"无样本时的默认 voice",加版本记录 v2.0;比喻、句式统一标注为示例(来自参考样本,非必须复现的通用规则)。

保持不变

  • Protected Spans、场景分流、评分门禁(v1.5.0)不动。
  • 7 类污染类型学(v1.4.0)不动;三轴分离仍是观察项。

[1.5.0] - 2026-06-22

核心变更:Protected Spans + 场景分流 + 评分门禁接入

问题背景:v1.4.0 之前,去 AI 味对所有文本用同一种力度,且没有显式保护法律写作中必须原样保留的范围(法条、当事人全称、程序术语等),容易误改;同时 references/quality-scoring.md 已有 5 维评分但未接入 workflow,改写质量缺乏交付门禁。

新增

  • 启动闸门:场景判定:工作流程开头先判场景(法律文书 / 公众号·公开评论 / 口语·即时回复 / 通用),场景决定改写力度、Protected Spans 宽度和重点扫描的污染类。法律文书场景默认保留正式语体与程序术语。
  • Protected Spans(禁改项先划):Step 1 通读时同步划定必须原样保留的范围(法条与司法解释编号、当事人·机构·律所全称、程序术语、直接引语与引证、合同条款编号、数值·日期·比例·金额、URL 与文书编号)。Step 2-4 不得触碰;宁可多保留,不可误改。
  • Step 7:交付前评分门禁:把 references/quality-scoring.md 的 5 维评分(自然度 / 节奏感 / 专业度 / 个性度 / 精炼度,总分 10)提升为强制门禁。总分 < 7.0 或单维度硬伤(自然度 < 1.5 / 个性度 = 0)必须回炉 Step 4 重修;法律文书场景下专业度 < 1.5 即回炉。

变更

  • references/quality-scoring.md 新增"作为交付门禁使用"节:明确何时评、回炉阈值、场景调整;并引入"直接度""信任读者"两个辅助视角(不新增维度,仅作评分检查点)。
  • 中性化历史版本记录中的外部规则来源表述(v1.0.0 CHANGELOG 条目与 quality-scoring.md v1.0 版本记录),与"不写借鉴归属"口径对齐。

保持不变

  • 7 类低 AI 污染类型学(v1.4.0)不动;三轴分离(Tier/档位/scope)作为观察项,待类型学实战检验后再定。
  • 原有 17 类检测细则、Step 1-6 工作流核心、句式重构原则、标点修正脚本继续保留。

[1.4.0] - 2026-06-22

核心变更:低 AI 污染类型学

问题背景:既有规则按具体禁用模式罗列,召回足够细,但执行 review / fix 时容易变成“逐词替换”。writing-reviewer v0.9.1 已把低 AI 污染归纳为 7 类来源,适合反向回灌到 de-ai-polish,让检测先判断问题来源,再查具体清单。

新增

  • 7 类低 AI 污染类型学:
    • 姿态污染:评价自己、讨好读者、摆作者姿态
    • 模板污染:固定句式替代真实判断
    • 语义稀释:模糊词、程度副词和大词冲淡信息
    • 节奏污染:排比、短句、断句形成机器节奏
    • 概念污染:黑话、隐喻、口号或专业词制造高级感
    • 过程泄漏:AI、调研、协作或写作过程暴露给读者
    • 格式污染:列表、粗体、引用块、引号等格式包装替代正文表达
  • 工作流调整:Step 2 从“词汇层扫描”前置为“类型归纳 → 词汇层扫描 → 结构层扫描 → 清单复核 → 向上溯源”。
  • 与 writing-reviewer 对齐:de-ai-polish 负责细粒度去 AI 与修稿,writing-reviewer 使用同一类型学输出 review finding。

保持不变

  • 原有 17 类检测细则继续保留,作为具体命中规则。
  • 原有句式重构原则、个人风格注入和标点修正流程继续保留。

[1.3.0] - 2026-05-31

核心变更:实战验证后的规则扩充与改写指导强化

问题背景:在"法律人为什么要研究 AI"文章的实际检测中,发现多条遗漏模式。部分模式在 v1.2.0 已有规则框架覆盖,但缺少具体变体和实战指导,导致检测时仍然遗漏。同时,改写环节(Step 4)的指导过于抽象,Agent 倾向于同义词替换而非句式重构。

变更

§1 对比句式扩充:

新增变体 示例
能力限定式对比 可以让人清醒,但不能替人看见未来
双重否定变体 不在于...也不在于
加强变体 远不只是("不只是"的加强形式)
肯定宣言 **这是提前移动自己的观察位置**(省略否定前缀,本质同否定宣言)
工整对称对比 低水平效率...高水平效率(常出现在引用块中)

新增改写指导:否定宣言和肯定宣言可直接删除"这不是"/"这是"前缀,保留核心内容。

§6 工整排比扩充:

新增「疑问词排比」子类:

  • 能不能...能不能...能不能...
  • 怎样...怎样...怎样...
  • 如何...如何...如何...
  • 越...越...越...(长级联)

§7 AI 过渡语扩充:

  • 这也是为什么(结论倒装式过渡)
  • 从一开始就(时间绝对化框架)

§9 导语式口癖扩充:

  • 更大的变化在于、更实质的变化是、更X的是/更X的在于

频次红线扩充:

  • 新增 更容易(与 很容易 同属模糊频次修饰)

Step 2 新增热点区域提示:

检测时重点扫描三类热点区域:

  • 节标题(标题中的"不在X""只是Y"常被忽略)
  • 加粗行和引用块(AI 倾向把最工整的对比句放在此处)
  • 段落首句和末句(过渡语和总结句的高发位置)

Step 4 改写指导强化:

新增「同义词替换是无效改写」原则,附具体对照表:

  • 窄→局限(无效) vs 换句式(有效)
  • 这不是我理解的 X→不是我关注的 X(无效) vs 我关注的角度不太一样(有效)
  • 越...越...级联→越...越...(无效) vs 拆成短句(有效)

[1.2.0] - 2026-05-31

核心变更:检测方式从正则匹配改为 Agent 通读

问题背景:在实际使用中发现,正则/grep 匹配只能覆盖已知模式的精确形式,会遗漏大量语义等价但形式不同的变体。例如「不在…而在」作为「不在于…在于」的缩写形式未被检测到,「表面上X,实际Y」作为「看似X,实则Y」的变体也未被捕获。工整排比、同义循环等问题更是无法通过正则识别。

变更

工作流重写(Step 1 & Step 2):

  • Step 1 明确要求「必须完整通读全文」,禁止仅通过正则/grep 完成检测
  • Step 2 改为「先通读 → 再对照清单 → 向上溯源」三步法
  • 新增禁止条款:「禁止仅用 grep/正则匹配清单关键词然后声称检测完成」

总则新增核心原则声明:

  • 明确「清单是参考框架,不是穷举清单。检测必须以 Agent 通读全文为主」

新增检测规则

规则 内容
分离式对比 这不是X。这是Y。 — 把「不是…而是」拆成两句,本质相同
否定宣言 这不是X 作为段落开头或独立断言(「这不是想象」「这不是追热点」)
缩写形式对比 不在.*而在 — 「不在于…在于」的缩写形式
同义循环 不同词反复表达同一语义场(窄/小/平/浅),短距离超过 3 次即为 AI 词汇贫乏

频次红线扩展

新增以下词汇/结构到频次红线(全文出现超过 2 次即视为 AI 程式化):

  • 真正、不只/不只是、更像/更像一个/更像一种、很容易

模板家族溯源扩展

向上溯源原则新增维度:对比句式→递进结构→程式化转折→工整排比→程度副词堆叠→否定宣言→分离式对比→同义循环

[1.0.3] - 2026-04-21

触发机制优化

问题背景:de-ai-polish 虽已内置完整检测规则,但在实际使用中未能稳定触发。表现为 de-ai-polish 描述过于简略,未明确强制触发条件,Claude 依赖"想起来才用"而非"每次必用"。

变更

description 强化:

  • 明确标注 **必须触发** 条件
  • 规定文章经写作流程完成初稿后、输出给用户之前,必须调用此 skill
  • 明确禁止"先输出再说"、"凭感觉省略检测"等做法

文档完善

  • 2026-04-22:按独立仓库 README 新规范重写首页,补充典型去 AI 腔场景、检测范围、安装方式、使用边界、核心设计、关键文件入口、Legal Skills 关联项目导流、作者联系入口和微信二维码

[1.0.2] - 2026-04-20

规则修补 - 程度副词堆叠 + 戏剧化感受词

新增规则

规则 内容
程度副词堆叠结构 很+形容词/动词、非常+形容词/动词、有很X的感觉 三类结构检测
戏剧化感受词 震动、震撼、触动、眼前一亮 等AI式大词检测与改写

规则修补 - 补充检测变体与通用模式

背景:在对《git驱动的ai协作》文章进行de-AI-polish时,发现大量AI化表述未被初始规则识别,原因是规则只覆盖了字面形式,未覆盖变体和通用模式。

新增总则

  • 模板家族溯源原则:遇到未在清单中直接列出的表述时,判断其是否属于已知模板家族的变体
  • 频次红线原则:越来越、其实、往往、看起来等词在全文出现超过2次即视为程式化
  • 连续重复原则:同一强化词在相邻句子中连续出现即应视为AI痕迹
  • 结构机械感自检:三项具体自检标准

规则扩充

规则 原覆盖 本次新增
对比句式 不是...而是... 看起来像...、越来越像...、更像是...
程式化连接词 首先/其次/但是/因此 当然、更麻烦的是、说到这里
绝对化表述 其实(特定结构) 单独出现的其实、泛化程度副词有很强的体感
工整排比 既要...又要... 依赖人去X、去Y、去Z、换个X、换个Y、接个Z、是A、是B、是C、既是A、也是B、也是C
递进结构 我越来越... 无主语越...越...递进(越学Git,越有...)
导语式口癖 更关键的是 更麻烦的是、说到这里

[1.0.0] - 2026-02-11

首个正式版本 - 系统化整合 AI 写作检测规则

  • 新增规则整合:系统化整理 24 种 AI 写作检测规则,整合到现有章节中
    • 扩展 5 个现有章节,新增 1 个独立章节
    • 新增质量评分系统(5 维度,总分 10)

新增检测规则

  • 过度强调意义:作为.*的体现/证明、标志着.*关键时刻、凸显/强调/彰显其重要性
  • 虚假范围:从.到.(无意义的大范围)
  • AI 词汇库:深入探讨、强调、凸显、彰显、持久的、增强、培养、获得、相互作用、复杂/复杂性、格局、织锦、宝贵的、充满活力的
  • 肤浅分析表述:突出/强调/彰显…、确保…、反映/象征…、为…做出贡献、培养/促进…
  • 同义词循环:短距离内使用多个同义词指代同一事物
  • 系动词回避:作为/代表/标志着/充当 [一个]、拥有/设有/提供 [一个]
  • 谄媚语气:好问题!您说得完全正确!、这是一个很好的观点
  • 模糊归因:行业报告显示、观察者指出、专家认为、一些批评者认为
  • 知识截止免责声明:截至 [日期]、根据我最后的训练更新、虽然具体细节有限/稀缺
  • 协作交流痕迹:希望这对您有帮助、当然!、一定!、您说得完全正确!、请告诉我
  • 公式化展望:尽管其…面临若干挑战…、尽管存在这些挑战、未来展望、下一步
  • 过度强调知名度:被.*多家媒体报道、受到.*广泛关注、拥有超过.*粉丝
  • 内联标题垂直列表:- 用户体验: 用户体验通过新界面得到显著改善
  • 表情符号和粗体过度使用:🚀 启动阶段:、OKRs、KPIs

新增功能

  • references/quality-scoring.md:质量评分系统
    • 自然度、节奏感、专业度、个性度、精炼度(5 个维度)
    • 总分 10 分,9.0-10 分为优秀,7.0-8.9 分为良好,低于 7.0 分需重新修订

规则编号调整

  • 原 12-14 规则重新编号为 13-15(因新增了规则 12)

[0.4.0] - 2026-01-25

重大变更 - 基于真人写作样本的风格注入增强

  • 新增"人味"表达的正向特征:基于用户范例文章分析
    • 开头的真实感(个人感受/具体场景/平实判断/意外转折)
    • 弹性表达的适度使用(保留空间感)
    • 口语化的正确边界(有分寸 vs 过度随意)
    • 幽默感的自然融入(自嘲/意外/反常识)
    • 对比的自然表达(避免AI式对比)

新增

  • 核心原则总结:
    • 真诚感 > 模板化
    • 有分寸 > 随意化
    • 保留空间 > 封死结论
    • 自嘲 > 炫耀

优化

  • 从"去除AI腔"扩展到"注入人味"
  • 提供正向的风格特征示例
  • 增强技能的实用性

[0.3.0] - 2026-01-24

重大变更 - 个人风格注入

  • 新增功能:在去AI化基础上,可选地注入个人风格
    • 新增 Step 5:注入个人风格
    • 目标比例:技术准确性 60% / 个人化 40%

新增

  • references/ 目录:个人风格参考目录
    • personal-style-guide.md:个人风格特征指南
      • 思维过程展示(弹性表达、承认局限、观察性总结)
      • 口语化表达(生活化比喻、对话式句式、直接对话读者)
      • 第一人称与个人观点
      • 句子节奏
      • 自然过渡
      • 问题导向与实用建议
    • expression-transformations.md:表达方式转化对照表
      • 绝对化 → 弹性表达
      • 对比句式 → 并列/递进
      • 程式化连接词 → 自然过渡
      • 生活化比喻库
      • 口语化句式库
    • sentence-rhythm-guide.md:句子节奏指南
      • 长短句搭配原则
      • 短句点睛技巧
      • 自然断句
      • 段落节奏

工作流程更新

原有流程:

  1. 阅读理解
  2. 识别AI化表述
  3. 判断是否修改
  4. 重新表述句子

新增步骤:

  1. 注入个人风格(可选)

持续迭代

  • 个人风格定义会在实际使用中持续优化
  • 根据用户反馈调整 reference 文件
  • 记录有效的风格特征和表达方式

[0.2.0] - 2026-01-24 19:53

重大变更 - 方法论重构

  • 核心方法论更新:从"删除标记词汇"改为"重新表述整个句子"
    • 明确区分"删除式修改"(错误)与"重新表述"(正确)
    • 添加详细的对比示例表,展示两种方法的差异
    • 强调重新表述句子结构,而非简单删除标记词

新增

  • 第14类检测规则:比较性与断定性表述
    • "它更像一种"、"更像一个.*"
    • "它其实是"、"这里其实"、"其实是第二类"
    • "天然会"、"天生就"、"自然而然就"
    • "会更清楚"、"会更.*"(过度使用的"会更"模式)
    • "就.*了"、"就.*能"(过于绝对的断言)

文档完善

  • 修复 markdown 格式问题(表头对齐、列表空行等)
  • 增强方法论部分的可操作性

[0.1.1] - 2026-01-13

变更

  • 技能架构整合:从 wechat-article-write skill 整合AI腔控制功能
    • 新增观察式表达检测规则(第16条检测规则)
    • 增强AI化表述检测能力,统一管理所有AI腔问题
    • 完善改写方向指导,提供更具体的优化建议
    • 升级版本至 v1.1.0

文档完善

  • 完善 frontmatter 元数据,添加版本、作者、分类等信息
  • 增强SKILL.md主文件的结构化程度
  • 补充详细的质量标准和优秀标准

[0.1.0] - 2026-01-13

新增

  • 创建AI化表述检测skill,支持13大类AI化表述的识别
    • 对比句式:不是...而是...、并非...而是...等
    • 口语化词汇:稳、靠谱、飘、搞定等
    • 戏剧化表达:推到底、刺痛感、本质上等
    • AI过渡语:先把...摆出来、不妨、话说对了一半等
    • 自我陈述:我更愿意、我给自己定、我想强调等
    • 程式化连接词:首先、其次、此外、但是、因此等
    • 导语式口癖:表面上看、更关键的是、接下来会等
    • 口号化隐喻:信号、叙事、闭环、生态、搬进等
    • 过度情绪化:扎心、必然、无疑、绝对等
    • 排比句:工整的并列句式
    • 无序列表:检测过度使用,非完全禁止
    • 结尾姿态句:方向已经明确、未来可期等
    • 引号使用:检测过度使用、格式错误

技术优化

  • 设计4步工作流程:阅读理解→识别AI化表述→判断是否修改→修改
  • 强调基于理解而非机械扫描,避免使用固定正则表达式
  • 强调避免固定替换模板,保持语言多样性和个性
  • 删除references目录,保持skill简洁

待办事项

  • 根据实际使用情况优化检测规则
  • 可能增加更多AI化表述模式

Source: SKILL.md on GitHub

1 warning15d4 checks · Risk SAFE
  • Gen Agent Trust Hub15d

    The de-ai-polish skill is a sophisticated NLP toolkit designed to naturalize AI-generated Chinese text. It utilizes a robust framework of internal validation scripts to ensure Markdown structure preservation (images and headings) and stylistic integrity without relying on external dependencies or performing risky network operations. The implementation follows security best practices, including privacy-preserving hashing for logs and defensive coding to prevent data leakage.

  • Socket15d

    No alerts

  • Snyk15d

    Risk: LOW · No issues

  • Runlayer7mo

    6/6 files flagged

Signed by skilld at 6113db6. This ties the file your Agent reads to that commit on GitHub. It does not review the instructions.

Last checked against GitHub yesterday.

Activeupdated 2 months ago
Other metadata
metadata
{
  "author": "杨卫薪律师(微信ywxlaw)",
  "homepage": "https://github.com/cat-xierluo/legal-skills",
  "version": "3.2.6"
}

README badge

README badge for cat-xierluo/legal-skills/de-ai-polish