跳转到内容

从零构建 MedAgent Forge

医疗 Agent 旗舰项目

这本书不从框架 API 开始,而是从一个可审核的医疗业务闭环开始:协议解析、患者证据、逐条资格判断、人工复核与完整审计。

24 章,按真实构建顺序展开

从问题边界出发,经过数据、模型、运行时与评测,最后回到可交付的工作台。

  1. 01

    问题、边界与系统设计

    入组审核到底管到哪一步,先把这条线划清楚,需求才能写成能验收的系统合同。

    1. 01问题定义与医疗边界
    2. 02需求工程与验收
    3. 03总体架构
    4. 04公共数据合同
  2. 02

    医疗数据与证据层

    FHIR、DICOM、病理、基因,四类证据格式各不相同,但都要能挂回同一条患者时间线。

    1. 05合成数据工厂
    2. 06FHIR 患者时间线
    3. 07DICOM 与多模态
    4. 08病理、基因与 OMOP
  3. 03

    协议解析、检索与判断

    入排标准是一段段自然语言,得先拆成条件树;判出来的每个结论都要能指回原始证据。

    1. 09协议解析
    2. 10召回与排序
    3. 11逐条资格匹配
    4. 12循证 RAG
  4. 04

    模型适配与后训练

    CPT、SFT、DPO、RLVR 各自治什么病?从一条不训练的基线出发,一个个试过去。

    1. 13医疗模型与 MedGemma
    2. 14CPT 与 DAPT
    3. 15SFT 与 LoRA/QLoRA
    4. 16DPO 偏好优化
    5. 17GRPO 与 RLVR
  5. 05

    Agent Runtime 与企业工作台

    显式状态、工具协议、最小权限、责任边界——长流程能不能撑住,靠的是这几样。

    1. 18Agent Runtime
    2. 19工具协议与 MCP
    3. 20多 Agent 编排
  6. 06

    评测、部署与完整复盘

    评测不看答案对不对,看任务有没有真的做完;红队、部署和最后的复盘也在这一单元。

    1. 21执行型评测
    2. 22安全与治理
    3. 23企业工作台与部署
    4. 24复盘与面试

教程只记录真实实现,不提前虚构结果

Section titled “教程只记录真实实现,不提前虚构结果”

每章对应源码仓库中的一个可运行阶段。实验结论、失败记录和限制会与代码一同更新;尚未通过验证的章节明确标为“编写中”。