Back to projects
Apr 20, 2024
1 min read

中医舌象智能辅助分析与数据治理平台

面向中医舌诊科研与算法研发打造的人机混合标注与数据治理平台。围绕「舌象标注沉淀标准数据集,反哺后续智能识别模型」的核心目标,采用「AI 预识别 + 人工复核」的人机混合标注方式,全面支持舌象原始图批量导入预处理与结构化训练数据批量导出,打通从原始样本采集到高质量数据集交付的全链路闭环。

项目展示

向下滚动 ↓
基于 JWT 与 RevokedToken 黑名单的细粒度权限认证门户
舌象原图批量采集与 OpenCV / Pillow 标准化预处理中台
AI 多模态预分析与 ChromaDB 混合 RAG 辅助标注工作台
面向模型微调的标准化 JSON 训练数据集构建与导出
图像预处理与数据集导出全链路任务可观测中心

核心产品亮点与用户体验设计

在中医舌象智能识别与科研落地中,高质量数据集的匮乏与标注效率低下是制约识别模型迭代的核心瓶颈。本平台以「通过舌象标注持续沉淀高质量数据集,并为后续智能识别提供标准数据底座」为核心设计目标,通过人机混合(Human-in-the-Loop)识别标注模式,将批量导入舌象原始图、人机协同高效打标、批量导出结构化数据打磨为一条高吞吐、低负担的数据治理工作流。

1. 以「沉淀标准识别数据集」为核心的数据治理闭环

  • 从临床样本到识别数据集的持续转化:每一次舌象分析与标注不再是一次性的孤立操作,而是自动沉淀为带标准五维标签(舌色、苔色、苔厚、裂纹、齿痕)与典籍依据的规范样本资产,直接服务于后续舌象识别模型的构建、微调与评测。
  • 极简的作业动线设计:界面围绕数据生产主链路(「主页 · 图片管理 · 数据导出 · 任务中心」)组织,标注人员与管理员各司其职,开箱即用。

2. 「人机混合」识别标注工作台:AI 先行预判 + 人工高效复核

  • AI 预识别大幅降低标注负担:告别传统纯人工从零勾选的枯燥流程。进入标注台后,AI 先行对舌象进行多模态预分析,自动输出五维特征识别结果与置信度(如 淡红舌 90%、白苔 85%),并同步匹配《中医舌诊学》标准与相似案例供参照。
  • 一键采纳与交互校准:标注人员只需在 AI 预识别结果的基础上进行审阅确认,支持「采纳到表单」或「一键采纳并保存」秒级完成单张样本入库;遇到疑难样本还可通过内置对话向 AI 发起追问辅助判读,兼顾标注速度与专家级准确度。

3. 支持「批量导入舌象原始图」与自动化标准化预处理

  • 多源原始图一键批量导入:针对不同采集设备带来的尺寸、旋转方向与光线偏差,支持在「图片管理」中一次性批量拖入舌象原始图,系统自动完成方向矫正、色彩明暗均衡与标准画布生成。
  • 样本状态全链路追踪:列表页集中展示所有批量导入样本的缩略图、尺寸规格与当前处理/标注状态(「待处理」「已标注」),点击即可无缝切入单张样本的人机混合标注台。

4. 支持「批量导出结构化数据」与后台任务透明可视

  • 标准化结构化数据集一键打包:在「数据导出」模块中,支持按批次或条件筛选已沉淀的标注成果,一键批量导出结构化数据(涵盖原图/处理图/缩略图三版本资产、五维结构化 JSON 标签及诊断摘要),无需二次脚本清洗即可直接投入模型训练与识别任务。
  • 批量作业进度实时可观测:针对大批量原始图导入预处理与大规模结构化数据集导出,「任务中心」提供异步任务队列监控,实时呈现每项批处理任务的状态流转、关联样本与耗时明细。