<div align="center">
<img width="120" height="120" alt="1000196472" src="https://github.com/user-attachments/assets/b8501663-7c7e-42cf-a8e7-59019420d779" />

# 中医思维蒸馏器 · TCM-Distiller

**将任意中医师的思维体系蒸馏为可被 AI 调用的技能（Skill）**

[![Version](https://img.shields.io/badge/版本-V4.5-blue)](CHANGELOG.md)
[![License](https://img.shields.io/badge/License-MIT-green.svg)](LICENSE)
[![Platform](https://img.shields.io/badge/Platform-IMA%20Skill-orange)]()
[![Tests](https://img.shields.io/badge/15维度-100%25-success)]()
[![Stars](https://img.shields.io/github/stars/jangviktor-web/tcm-distiller?style=social)]()

> 「授人以鱼，不如授人以渔」——不产出某一个中医师，而是产出**能产出任何中医师**的流水线。

</div>

---

## 📌 这是什么

**中医思维蒸馏器**是一套完整的、经过实战验证的 **AI 技能蒸馏流水线**——输入某位中医师的著作/讲稿/医案（一手素材），输出一个**可被 AI 调用的、忠实还原其思维体系的人物技能**。

与市面上"把资料塞给 AI"的简单做法不同，本蒸馏器基于 **15 个蒸馏维度 + 12 个质量保障模块**，确保产出的技能不只是"资料库"，而是真正"会像该医家一样思考"。

### 已用本流水线蒸馏的人物

| 人物 | 流派 | 成果 |
|---|---|---|
| 胡希恕 | 经方派 | 38 万字讲稿 → 完整技能（首发验证案例） |
| 黄元御 | 气机升降派 | 3.5MB/38,266 行医书十一种 → V3 深度优化 |
| 吴鞠通 | 温病派 | 4 著作 → V3.5 端到端 + 359 医案 + GitHub 发布 |
| 倪海厦 | 经方派 | 258 方剂量全量勘误 + 表达还原度反超旧版 + 达尔文全流程优化（V4.5 七项经验反哺） |

---

## 🚀 快速开始

### 环境要求
- Python 3.8+（索引验证脚本）
- 任意支持技能（Skill）机制的 AI 平台（Claude Code / IMA / OpenClaw 等）

<details>
<summary><b>手动安装</b></summary>

```bash

# 手动
git clone https://github.com/jangviktor-web/tcm-distiller.git
cp -r nihaixia/ ~/.claude/skills/tcm-distiller/
把github“https://github.com/jangviktor-web/tcm-distiller”项目安装到本地skill

```
</details>


<details open>
<summary><b> ClawHub（推荐）已更新至V2.3.0版本可复制下面文字到agent更新</b></summary>

```bash

openclaw skills install @jangviktor-web/tcm-distiller
npx skills add https://clawhub.ai/jangviktor-web/skills/tcm-distiller

```
</details>

<details>
<summary><b>SkillHub（腾讯云）已更新至V2.3.0版本可复制下面文字到agent更新</b></summary>

```bash

请根据 https://skillhub.cn/install/skillhub.md，安装 @user_ff4d9420/tcm-distiller。

```
</details>

---

## ✨ 核心特性

### 🧠 15 维度蒸馏体系
覆盖一个人物思维的全部关键层：**核心心智模型 / 临床决策启发式 / 方证体系 / 表达 DNA / 反模式与诚实边界 / 剂量思维 / 饮食调理 / 条辨框架 / 生平传承 / 方证体系 / 内在张力 / 智识谱系 / FAQ / 临床安全层 / 功法体系（可选）**

### 🛡 12 个质量保障模块（S1-S12）
| 模块 | 功能 |
|---|---|
| S1 | 古今病名映射索引 |
| S2 | 强制原文引用与回答协议（检索线索不进回答） |
| S3 | 热度驱动测试训练法（50 题实测） |
| S4 | 知识网络体检 |
| S5 | 角色扮演 7 段式 |
| S6 | 15 维度覆盖率验证 |
| **S7** | **剂量勘误工作流**（258 方逐方对照源文件） |
| **S8** | **版本差异处理**（讲课版 vs 通行本，防误判） |
| **S9** | **剂量三体系换算**（考古/台湾/临床直换铁律） |
| **S10** | **诚实标注规范**（不编造，缺口显性化 + 来源追问四段式话术） |
| **S11** | **表达还原度验证**（20 题长答盲评，六维差距检查） |
| **S12** | **档案清理与索引健康维护**（删除后索引四步验证） |

### 🔬 实战验证的数据
- **倪海厦 258 方剂量勘误**：合格 233 / 修复 30+ 处 / 复查无回滚
- **表达还原度**：20 题长答盲评从"十题全败"修复至"9 胜 1 平 0 败"（4.65 vs 4.46）
- **达尔文全流程（2026-08-15）**：新旧对比 90.0 vs 67.1 → 11-20 长叙事补测三向盲评 → 7 项经验反哺蒸馏器 V4.5
- **索引健康**：174 条关键词引用 0 失效
- **吴鞠通 100 题热度测试**：平均 7.17/10（优秀级）

---


### 使用（两条流水线）
```
Pipeline A · 新蒸馏（人 → skill）
  Phase 0 入口分流 → Phase 1 十维并行调研 → Phase 2 框架合成 → Phase 3 质量验证 → Phase 4 增量补充 → Phase 5 交付
  → Phase 3 质量验证 → Phase 4 增量补充 → Phase 5 交付

Pipeline B · 增量优化（skill → 更好 skill）
  Phase B0-B5：差距分析 → 定向增强 → 剂量勘误 → 表达还原 → 复测棘轮
```

### 一句话触发
> "蒸馏胡希恕" / "把倪海厦的思维方式做成技能" / "优化吴鞠通 skill"

---

## 📂 目录结构

```
tcm-distiller/
├── SKILL.md                    # 主技能文件（双流水线 + S1-S12 模块 + 15 维度定义）
├── CHANGELOG.md                # 完整版本历史（V1.0 → V4.5）
├── references/
│   ├── 01-15 维度定义          # dimensions.md（15 维深化定义）
│   ├── phase1-agents.md        # 10+2 维子 Agent Prompt 模板
│   ├── phase2-checklist.md     # 框架合成检查清单
│   ├── phase3-quality.md       # 质量验证标准（15 维度覆盖率）
│   ├── 18-error-handling.md    # 系统性错误处理与降级机制
│   ├── 20-original-text-digitalization.md  # 原文数字化方法论
│   ├── 21-acceptance-testing.md # 验收测试（热度实测+负优化审计+盲评法）
│   ├── 25-index-audit.md       # 索引完整性审计
│   ├── 26-dose-audit-workflow.md  # 剂量勘误工作流（S7/S8/S9）
│   ├── 27-honesty-standards.md    # 诚实标注规范（S10）
│   ├── 28-expression-verification.md # 表达还原度验证（S11）
│   ├── 29-archive-maintenance.md   # 档案清理与索引健康（S12）
│   └── 实战案例（huxishu-case / huangyuanyu-v3-case）
└── scripts/
    ├── validate_keyword_refs.py   # 关键词引用验证脚本
    ├── extract_titles.py          # 原文标题提取
    ├── cleanup_headers.py         # OCR 噪音清理
    └── ...（共 9 个工具脚本）
```

---
## 📖 版本历史（更新日志）

### V4.5（2026-08-15）· 达尔文实战七项优化
- **表达池机制**：三件套升级为口头禅池+断言池（各 8-18 短语）+ 会话级去重 + 同义族合并计数 + 池尽复用间隔≥3 轮（倪海厦 10+ 轮长会话零重复实战）
- **输出四查**：三查升级四查，新增"引用数量对账"（正文引用条目数 == 卡片数）
- **原文细节一致性铁律**：炮制字三级判定（炙/生甘草不可互换；主动改需原话 / 转录省略按原文 / 两可按原文）
- **临床替代注记**：人物主动化裁须标注（倪师乌梅代乌头、甜酒酿代白酒实例）
- **来源追问四段式话术**（S10 升级）：用户追问"是本人说的还是你算的"→ 总声明/口述/换算/底线
- **新旧同题盲评法**（Pipeline B5 必做）：三向同题盲评 + judge 六维评分，本次 ≥ 上次才通过
- **注册三步防护**：注册前 zip 备份 → 注册后 grep 验证 → 被覆盖恢复

<details>

<summary><b>点击展开</b></summary>

### V4.4d（2026-08-15）· 档案清理与索引健康维护
- **新增 S12**：权威 vs 档案分级 + 档案体检五步 + 删除后索引健康四步法
- **新增 references/29**：完整方法论（倪海厦 research 目录清理实战：10 文件→删 2 修 1 标 1，删除后 174 引用 0 失效）
- 坑位沉淀："推荐"标注的过时文件最危险 / 同错误多文件并存 / 删除留痕可追溯

### V4.4c（2026-08-15）· 文件名标准化
- 产出 skill 内部文件统一 `NN-english-kebab-name.md` 命名规范（禁中文文件名）

### V4.4b（2026-08-14）· 临床剂量补齐
- Phase 4.2b：临床剂量补齐工作流（S7 下游延伸，源自倪海厦实战）

### V4.4（2026-08-14）· 表达还原度方法论
- 三件套落地法：前置表达速查卡 / 输出形态铁律 / 语气量化指标（双保险）
- "改进后必须实测盲评"铁律（倪海厦 14b 事故教训：规则埋在深处=没有）

### V4.3（2026-08-14）· 表达还原度验证
- **新增 S11**：20 题长答盲评法 + 六维质地差距检查表 + 修复 7 技法
- A/B 双版本盲评法（21 第五节）：双版本准备→3 题库并行→盲评→棘轮决策
- 多文件同知识全量核验教训（酸枣仁汤速查卡残留案例）

### V4.2（2026-08-14）· 全历史会话二轮挖掘
- 平台错误码速查表（411003/411006/200005）+ 平台快照覆盖防护
- 源文件编码统一（GBK→UTF-8 校验）
- GitHub/ClawHub 发布渠道规范
- 四层结构心智模型框架（公理/定理/算法/边界层）

### V4.1（2026-08-14）· 历史会话经验补注
- 安装路径修正（符号链接机制）
- 跨流派对话测试法（吴鞠通 V3.1 实测：倪驱邪 vs 吴存津）
- 语气量化评估法（互动追问/模板/舞台指示计数）
- "不编造 ≠ 不缺失"平衡原则

### V4.0（2026-08-13）· 剂量勘误方法论注入
- **新增 S7 剂量勘误工作流**（五步：清单→提取→二次检测→P0-P3 修复→报告）
- **新增 S8 版本差异处理**（以源文件讲课版为准，防 judge 通行本误判）
- **新增 S9 剂量三体系**（①考古考证 ②台湾临床 ③临床直换铁律：古方一两=临床一钱）
- **新增 S10 诚实标注规范**（五类必标场景 + 子 Agent 复核纪律）

### V3.x（2026-08-09 ~ 08-13）· 端到端与索引体系
- V3.6：索引引用规范化（`文件 搜"关键词"` 格式）+ validate_keyword_refs.py
- V3.5：端到端蒸馏完成（吴鞠通全流程验证）
- V3.1：5 项内化升级（description/安全声明/分域取法/功法维度/用药铁律原文出处）

### V1.0 - V2.x（2026-08-04 ~ 08-09）· 奠基
- 胡希恕 38 万字讲稿首发验证
- 黄元御 3.5MB 医书十一种深度案例
- 9 维评分基线 79.5 → 84.3

> 完整更新日志见 [CHANGELOG.md](CHANGELOG.md)

</details>
---

## 🛠 技术亮点

### 棘轮机制（只进不退）
每个优化都经过：**评分 → 改进 → 实测 → 独立盲评 → 保留或回滚**——只保留被实证的改进，自动回滚退步。

### 独立盲评（不自己改自己评）
评分/judge 全部用独立子 agent，标记 A/B 打乱，只凭质量打分——杜绝"自我感觉良好"。

### 剂量三体系（防误判）
考古换算（1两≈15.6g）仅理解原方规模；临床开方一律"古方一两=临床一钱"直换——解决了 AI 测试中长期存在的 judge 误判问题。

### 表达池与四查（V4.5 新增）
口头禅/断言池化管理 + 会话级去重，10+ 轮长对话不重复；输出四查含引用数量对账，正文提到几个方剂就出几张卡——把"像不像"从玄学变成可检查的清单。

---

## 🤝 贡献

欢迎通过以下方式参与：
- 🐛 报告问题：提交 Issue（附复现步骤）
- 💡 建议新维度/新模块
- 📚 分享你的蒸馏案例（格式参考 references/huxishu-case.md）

---

## ⚠️ 免责声明

- 本项目用于**教育与学术研究**，产出的人物技能仅供学习其思维方法论
- 所有中医相关内容不构成医疗建议，临床用药请咨询执业中医师
- 人物技能的表述基于公开讲义/著作，不代表人物本人观点

---

<div align="center">

**Made with ❤️ for the TCM community**


[![RepoStars](https://repostars.dev/api/embed?repo=jangviktor-web%2Ftcm-distiller&theme=grape)](https://repostars.dev/?repos=jangviktor-web%2Ftcm-distiller&theme=grape)

</div>
