项目案例
MedStatForge
一个本地优先的医学统计 Agent + RAG 工作台,将私有研究材料、数据、方法审阅、人工确认与统计交付组织为可追溯的研究流程。
项目简介
MedStatForge 是一个面向医学科研场景的本地部署工作台。它不是只回答问题的聊天界面,而是把项目私有知识库、研究数据、多步 Agent、医学统计分析和结果交付连接为一条可审阅的工程链路。
私有材料与数据 → 证据检索与方案审阅 → 人工确认 → Worker 执行 → 安全结果与制品交付
系统围绕“项目”组织文献、数据集、会话、统计方案、运行记录和制品版本。研究者可以回看检索证据、变量绑定、方案哈希、确认记录和执行结果,而不是只接收一段无法复核的文本结论。
为什么做这个项目
医学研究中的知识检索、数据检查、方法选择、统计执行和结果整理往往散落在文献管理器、聊天工具、统计软件和手工文档之间。把这些步骤简单串联并不可靠:来源、数据边界、变量定义和每一次决策都需要被保留。
MedStatForge 尝试解决的正是这条链路的断点。Agent 负责理解研究问题、组织证据与协助审阅;统计执行则必须绑定已确认的方案哈希,由独立 Worker 调用固定快照的医学统计 Skill。两者的职责被明确分开,避免自然语言对话绕过研究设计与审计边界。
核心能力
- 建立项目私有知识库,支持论文、指南、量表、数据说明和代码等研究材料;检索结果保留文件、页码、章节和分块来源。
- 结合本地
BAAI/bge-m3向量、Milvus BM25、Hybrid Search 与 RRF 融合检索,并展示检索 Trace、证据质量和降级路径。 - 使用 LangGraph 编排会话型研究 Agent,支持工具调用、复杂问题分解、SSE 过程展示与可恢复的人工审阅状态。
- 盘点多种研究数据格式,并在多文件研究中显式声明文件角色、连接键、基数、时间关系和变量概念;网页与模型只接收安全的聚合盘点。
- 从文献中提取可追溯的 MethodProfile,形成方法综合与复现映射,明确哪些变量与参数可复现、哪些仍需确认。
- 将确认后的医学统计任务交由 Redis Worker 执行,输出表格、图形、报告、Artifact Version 与安全 ZIP 制品包。
本地优先与安全边界
项目通过 Docker Compose 组织 Web、API、Worker、RAG、向量检索、Embedding、OCR 和容器化 R 运行时。除 Web 工作台外,其余服务位于 Compose 私有网络;原始资料、规范化数据和中间产物保存在项目私有 Docker volume 中,不直接暴露给 Agent、网页或最终交付包。
系统不会让模型直接读取患者级行数据,也不会让 Agent 绕过确认门执行统计任务。当证据不足、模型未配置或服务不可用时,界面会显示明确的限制或降级状态,而不是伪造结论或结果。
当前重点
MedStatForge 是目前持续投入开发的核心项目。当前版本面向单个研究者的本地部署;多用户认证、云端租户隔离和服务器治理仍不属于现阶段默认承诺。后续开发将继续围绕证据审阅、研究状态管理、统计模块与安全交付能力推进。