模型 / 数据集
Nanako0129/sepia avatar
Nanako0129/sepia

sepia:从叙事架构而非措辞入手,把 AI 写作痕迹拆掉

De-AI writing skill for any Agent Skills-compatible agent (77+ via the Skills CLI), with native plugins for Claude Code, Codex, Grok Build, and Antigravity. Narrative-architecture repair for fiction, venue-matched rules for professional prose. Based on StoryScope (arXiv:2604.03136).

2,622 个 Star166 个 ForkPythonMIT
GitHub

秒懂

它是什么?
sepia 是一个面向 Agent Skills 兼容代理的写作技能包,把去 AI 味的工作从表面措辞挪到叙事架构层。它依据 StoryScope 论文的检测数据设计,对小说和专业文体分别给出规则,但它的适用范围和版本状态需要你先看清楚。
适合谁用?
小说作者、技术文档撰写者,以及使用 Claude Code、Codex、Grok Build 或 Antigravity 并希望减少 AI 腔调的工程师,值得尝试 sepia。它的核心主张有论文数据支撑,且明确反对把所有规则堆满,这种克制是多数人文化简工具缺少的。
能商用吗?
可以。MIT 是宽松许可证:你可以使用、修改并销售基于它的软件,只需保留版权和许可证声明。
还在维护吗?
在维护。仓库在最近一天内有新的提交。
用什么语言写的?
主要是 Python(依据 GitHub 的语言统计)。

以上回答依据项目的 GitHub 数据(最近同步于 2026年9月15日)和我们的分析,不构成法律意见。

开源项目深度解析

它解决的问题:AI 的破绽不在用词,而在结构

大多数去 AI 工具只改词和句法,但 sepia 的出发点不同。它引用了 arXiv:2604.03136 的 StoryScope 研究,该研究用 61,608 个故事训练了一个分类器,仅凭叙事结构特征就能以 93.2% 的 macro-F1 识别 AI 小说。更关键的发现是,人类编辑只改写表面风格后,检测率只从 95.5% 降到 93.9%。也就是说,那些真正出卖 AI 的特征是主题被叙述者直接解释、情节单一且因果过于整齐、情绪只表现为身体感觉、缺少真实世界指涉、没有读者意识、线性时间、以及用主角成长和接受来收尾。sepia 把这类被论文验证的缺陷整理成一套三遍修改协议。它服务的对象是两类人:写小说但不想被识别为 AI 的作者,以及写 release notes、PR 回复、事故报告、工单和技术文章的专业人士。后者面对的失败模式不同,比如无信息量的填充词、该下判断时却含糊其辞、聊天机器人残留、以及不符合文体要求的格式。

三层修复机制:从架构到表面,但保留余地

sepia 的修改流程分三遍。第一遍处理叙事架构,针对小说,规则包括停止解释主题、放松因果链、把揭示往后放、混合情绪模式、稀疏人物网络、以及写出真实事物。第二遍是话语流,解决段落与问题的固定序列、中段疲软、节奏和位置的变化不足。第三遍才是经典的表面风格层,处理陈词滥调、句法模板、词汇和语域。这个顺序很关键:它先动结构,最后才碰措辞。但 sepia 没有把每条规则都强制应用。它有一个 30 特征的诊断规则,每次只选择 3 到 5 个动作,并故意留下松弛。原因是人类写作者通常处于中等值,如果一篇故事应用了所有规则,反而会形成新的指纹。这个设计直接回应了它自己的原则:校准到人类分布,而不是反转 AI 分布。对于专业文体,每种文档类型都有一个薄规则文件叠加在共享检查表上。例如,release notes 要求用户影响优先、每个声明附上工件、不做营销夸大;事故报告则要求对人无指责、对机制无情,并包含时间戳、死胡同和明确归属的行动项。

模型指纹与诊断:知道谁写的,才知道怎么改

sepia 的独特之处在于它考虑到了生成模型的差异。它包含两层指纹:一层是 StoryScope 测量的叙事痕迹,覆盖 Claude、GPT、Gemini、DeepSeek 和 Kimi;另一层是句子级痕迹,取自各厂商自己的提示指南,包括 Claude Fable 5.1 和 Mythos 5.1、Opus 5、GPT-5.6、GPT-6 Astra、Gemini 3 系列等。当写作或执行模型已知时,这些指纹会被应用。对于没有发布此类指南的厂商,README 明确说它们被记录为“已咨询”,而不是被猜测。这意味着 sepia 的诊断不是通用的,它依赖用户告诉它当前使用哪个模型。如果你不提供这个信息,指纹匹配就不会生效。这是一个实际的约束,而不是缺陷:不同模型的 AI 味确实不同,用同一套规则去改所有模型的输出,效果会打折。但这也意味着使用 sepia 需要额外的一步操作,而且它不能自动检测模型。

安装与操作:一个 SKILL.md,四条原生插件路径

sepia 是一个 Agent Skill,遵循 agentskills.io 的规范。任何支持该标准的代理都能加载它,而 Skills CLI 支持 77 种以上的代理,可以用一条命令安装。Claude Code、Codex、Grok Build 和 Antigravity 还额外获得原生插件打包。关键设计是只有一个规范的 SKILL.md,没有为每个平台维护分支。安装时需要注意:操作包装器依赖其兄弟规范技能,所以不支持单独安装包装器,必须安装完整插件包。操作分为四个主要入口:write 用于新写,review 只诊断不修改,refactor 做最小就地编辑,recreate 从源事实和意图完整重写。另有 hemingway 入口,它应用内置的海明威风格档案。在 Claude Code 中这些入口以斜杠命令形式存在,例如 /sepia-write,在 Codex 中则是 $sepia-write。README 没有给出具体的安装命令,但提到 Skills CLI 支持一条命令安装,你需要查阅 skills.sh 的文档来获取确切的命令。

可叠加的语音技能:一个实验性接口,不是成熟功能

自 v0.4.0 起,sepia 定义了一个接口,允许在其上叠加语音或风格技能,例如极简主义方法、品牌声音或人物指南。这个功能是选择加入的:你必须告诉 sepia 语音技能在起作用,它才会加载 references/voice-skills.md 文件,否则不会加载任何外部语音。规则是 sepia 的架构决策优先,语音的动作只被选择性地应用,每篇作品 3 到 5 个标志性动作,有时故意打破公式化结尾。审查报告会报告语音的已知成本,而不是修复它们,但一致性发现保持完整强度:语音不能成为节拍器的借口。专业路线上,文体仍然决定语域。直接冲突会回到你这里。README 很诚实:这个接口基于一个针对严格极简主义样本的盲审实验,是一个工作示例,不是测量证据。内置的海明威档案位于 references/voices/ 下,它把每个动作追溯到其来源,例如小说中的冰山省略和 Kansas City Star 规则。但注意,在小说上,审查只在你的文本发现与海明威档案匹配时才报告,它不会主动加载。如果你要求对故事进行强去 AI 处理,那会被视为选择加入,sepia 会告诉你它应用了哪个档案以及如何拒绝。这个设计的代价是它增加了复杂性,而且实验性质意味着你可能需要调试。

中文校准与韵律:尚未完全确认的部分

README 的英文部分在句子节奏和中文校准处被截断,只提到“风格检查会检查句子的分布”,后面就断了。仓库有简体中文和繁体中文的 README 文件,说明项目面向中文用户,但具体的简体中文校准规则是否完整实现,从当前材料中无法确认。release 版本 v0.9.0 发布于 2026 年 9 月 8 日,距离 v0.7.0 只有四天,版本迭代很快,可能包含中文相关更新,但 release notes 的内容没有提供。如果你主要写中文,这是一个必须验证的盲点。项目的三遍修改协议和文档类型规则是基于英文研究的,中文的叙事架构特征是否相同,StoryScope 的研究是否涵盖中文,材料中没有说明。因此,中文用户在使用前应检查 README.zh-CN.md 文件,或查看 release notes 中关于中文韵律校准的说明。

与典型 humanizer 的差异:校准而非反转

常见的去 AI 工具,比如那些改写同义词和句法的服务,本质上是在表面层做文章。sepia 的立场是这些工具没用,因为 StoryScope 的数据表明,即使人类编辑重写了表面风格,检测率也只下降了不到两个百分点。真正的差异在架构层。因此,sepia 的替代品不是另一个写作助手,而是那些不做架构修复的工具。例如,一个普通的“人文化”提示词或插件只会替换词汇和调整句子长度,它不会教你停止解释主题或后移揭示。另一种替代方案是手动应用 StoryScope 论文中的特征,但那需要你自己消化研究。sepia 把研究转化为可执行的规则,这是它的价值。但要注意,这种深度也意味着它不适合快速润色。如果你只想要一个轻量工具来降低 AI 检测分数,sepia 的三遍流程可能过重。它更接近一个写作教练,而不是一个过滤器。

维护成本与许可:MIT 下的快速迭代项目

sepia 使用 MIT 许可,这意味着你可以自由使用、修改和分发,只要保留版权声明。没有 copyleft 义务,适合集成到商业工作流中。但维护成本不低。项目版本迭代很快:v0.7.0 在 9 月 4 日,v0.8.0 在 9 月 5 日,v0.9.0 在 9 月 8 日。这种速度表明项目仍在积极开发中,规则和接口可能频繁变化。README 提到操作包装器依赖兄弟技能,所以升级时必须保持整个包一致,不能只更新一部分。此外,语音技能接口是实验性的,其行为可能在后续版本中改变。如果你依赖 sepia 的特定输出,你需要跟踪每次 release 的变更。仓库有行为评估和版本一致性检查的 CI 工作流,这能降低回归风险,但它不能替代你自己在升级后运行测试。最后,项目没有主页,文档集中在 README 和 research/ 目录,但 research/ 的内容没有被提供,所以评估其深度需要你自己查看。

编辑结论

小说作者、技术文档撰写者,以及使用 Claude Code、Codex、Grok Build 或 Antigravity 并希望减少 AI 腔调的工程师,值得尝试 sepia。它的核心主张有论文数据支撑,且明确反对把所有规则堆满,这种克制是多数人文化简工具缺少的。但不要把它当作一键人文化按钮:它要求你接受一个三遍修改流程,还要在每次运行时告诉它当前使用的模型,否则指纹匹配不会生效。不适合那些只想要快速同义词替换、不愿介入叙事决策的写作者。在采用前,先确认你的代理确实支持 Agent Skills 标准,或能安装完整插件包;单独安装操作包装不被支持。还要检查 v0.9.0 的 release notes,确认中文韵律校准功能是否已包含简体中文的完整规则,因为 README 的英文部分在句子节奏处被截断,简体中文版的支持程度未明确。

官方来源

  1. Issues
  2. License: MIT
  3. Nanako0129/sepia on GitHub
  4. README
  5. Releases
社区笔记

社区笔记