我的 PDF 是扫描件,能处理吗
可以。ChromaParse 有独立的 OCR pipeline:
- 首选路径:文本层提取(数值字段 100% 精确)
- 回退路径:文本层不可用时启动 OCR(数值字段 >99.8%,标记为 OCR 来源)
OCR 路径产出的字段会显式带 precision_class: ocr,审计链路完整保留。如果你的报告全是扫描件,建议升级到企业版以使用专门优化的 OCR 模板组。
多语种 PDF 能处理吗
支持以下语种的报告:
- 英语(主要)
- 中文(简/繁)
- 日语(LabSolutions / Xcalibur 常见)
- 德语(部分 Empower 欧洲版)
- 法语、西语、韩语(已收录但样本较少,Beta)
字段名跨语种自动归一(例如”保留时间”/“Retention Time”/“保持時間”会归一到 retention_time)。
加密 PDF 能处理吗
如果 PDF 是 owner password 加密但允许打印(色谱仪导出最常见情况),可以直接处理。
如果是 user password 加密,需要在上传时输入密码;密码不会被持久化(只在解析时存在内存)。
如果设了 DRM 或仅限阅读权限的特殊保护,我们读不到内容 —— 这是 PDF 标准本身的限制。
自定义模板需要多久适配
公共指纹库的新版式适配周期取决于复杂度:
- 常见变体(列顺序调换、表头改字):1–3 个工作日
- 结构性变化(新报告族、未见过的检测器):1–3 周
- 私有指纹库:在合同 SLA 内交付,通常 5–10 个工作日
给我们提供 3–5 份脱敏样本 是加速适配的关键。
有 API 吗
有。
- SaaS REST API:OAuth 2.0,文档见 API Reference(暂不公开,试用账号注册后开放)
- Local 部署 REST API:同等接口,数据不出客户网
- Webhook:解析完成后回调,常用于 LIMS 异步集成
- 批量 SDK:Python / Node 客户端,适合大规模历史 PDF 迁移
我可以本地部署吗
可以。详见 企业版。
- Local Pro:单服务器部署,适合 1 个 QC 实验室
- Local Enterprise:多节点 + 多厂区,适合大型 CDMO 与跨工厂场景
数据完全在客户网络内,审计日志按 GMP 留存。
数据安全方面有什么承诺
简短版:
- SaaS:加密传输 + 加密存储,可选退出模型训练
- Local:数据不出客户网络,我们看不到任何客户数据
- 私有指纹库:IP 隔离,合同明确