工作原理
从 PDF 到 Excel,3 步完成
上传与导出之间发生了什么,以及每个阶段为什么这样设计。
- 1上传
- 2识别
- 3提取与校验
- 4导出与溯源
- 1
上传
拖入一份或多份 PDF。文件以 TLS 1.3 加密传输,接收时计算 SHA-256 哈希。哈希和时间戳锚定整个审计链。
- 拖拽或批量上传(多文件)
- 云端单文件最大 100 MB,每份 PDF 最多 200 页
- 支持文本型和扫描型 PDF
- 2
识别
ChromaParse 将 PDF 与模板指纹库匹配(Waters Empower、Agilent ChemStation/OpenLab、Thermo Chromeleon、Shimadzu LabSolutions ...),选择对应的解析器。
- 自动识别厂商 + 工作站 + 版本
- 非文本 PDF 回退到 OCR 版面分析
- 选中的模板写入审计日志
- 3
提取与校验
逐字段提取,带置信度评分。数值精度严格无损 —— 不四舍五入,不为科学计数法发愁。
- 保留时间、峰面积、峰高、面积%、峰名
- 系统适用性表格、样品 / 方法头部
- 低置信度字段按严重等级标记给审核员
- 4
导出与溯源
一键 Excel/CSV 导出。每个单元格携带溯源元数据 —— 在 Excel 中点击,ChromaParse 在源 PDF 中高亮对应 bbox。
- Excel / CSV / JSON 导出
- 每个单元格内嵌溯源元数据
- 直接 LIMS 字段映射(配置驱动)