Skip to main content
工作原理

从 PDF 到 Excel,3 步完成

上传与导出之间发生了什么,以及每个阶段为什么这样设计。

  1. 1
    上传
  2. 2
    识别
  3. 3
    提取与校验
  4. 4
    导出与溯源
  1. 1

    上传

    拖入一份或多份 PDF。文件以 TLS 1.3 加密传输,接收时计算 SHA-256 哈希。哈希和时间戳锚定整个审计链。

    • 拖拽或批量上传(多文件)
    • 云端单文件最大 100 MB,每份 PDF 最多 200 页
    • 支持文本型和扫描型 PDF
  2. 2

    识别

    ChromaParse 将 PDF 与模板指纹库匹配(Waters Empower、Agilent ChemStation/OpenLab、Thermo Chromeleon、Shimadzu LabSolutions ...),选择对应的解析器。

    • 自动识别厂商 + 工作站 + 版本
    • 非文本 PDF 回退到 OCR 版面分析
    • 选中的模板写入审计日志
  3. 3

    提取与校验

    逐字段提取,带置信度评分。数值精度严格无损 —— 不四舍五入,不为科学计数法发愁。

    • 保留时间、峰面积、峰高、面积%、峰名
    • 系统适用性表格、样品 / 方法头部
    • 低置信度字段按严重等级标记给审核员
  4. 4

    导出与溯源

    一键 Excel/CSV 导出。每个单元格携带溯源元数据 —— 在 Excel 中点击,ChromaParse 在源 PDF 中高亮对应 bbox。

    • Excel / CSV / JSON 导出
    • 每个单元格内嵌溯源元数据
    • 直接 LIMS 字段映射(配置驱动)

看实际样子?

演示页含真实样本 PDF 与提取后的 Excel 表。