扫描件也能核:OCR 优先 + 低置信降级,拍照即能查
外贸单据常是扫描件或照片。DocuConsist 走 OCR 一等公民路径(hermes-ocr / PaddleOCR),优先识别;低置信字段降级为复核而非断言,绝不据噪声下结论。本文讲清扫描件怎么核、脱敏怎么做。
最后更新:2026-09-02 · 简体中文
外贸单据一半是扫描件或手机拍的照。过去这类单子要么人眼硬看,要么 OCR 结果被直接当真理。我们的做法是:OCR 一等公民路径——优先识别,但识别结果带置信度门控,低置信就降级为复核,绝不据噪声下结论。
一、为什么扫描件难核
扫描件/照片没有可复制的文本层,字段要先"认"出来才能比对。认错一个字(如 0 认成 O、1 认成 l),跨单比对就会误报或漏报。所以"怎么认、认不准怎么办"是核心。
二、OCR 一等公民路径
我们走 hermes-ocr(PaddleOCR) 优先识别:能识别就先识别,把图片/PDF 里的字段读出来,再交给固定规则做跨单比对。OCR 是"认字"的一环,不是"判断"的一环。
三、低置信降级(不靠肉眼也比得了)
每个 OCR 字段带置信度。低置信字段在跨单比对时降级为 review(请人工核对),绝不据 OCR 噪声断言"不一致"(*_LOW_CONFIDENCE)。这样你一眼就能分清:哪些是铁定矛盾,哪些是识别可能不准、需要你确认。
四、脱敏怎么做
默认本机解析;仅当本地解析失败时,才调用云端 OCR 兜底补全文字。云端只用于"认字",不参与任何判断,识别结果标注为草稿需逐条确认,识别密钥不经过浏览器。
五、拍照即查怎么用
把扫描件/照片和 born-digital 的发票/报关单混排上传,工具先抽取(本地优先、云端兜底),再按场景做跨单比对。今天查、明天查,同一份单据结论一致。
一次上传整套互相对见《多证合一核验怎么做》。
诚实边界
我们做"认字 + 规则比对",不声称识别百分之百准确。低置信字段一律交给你确认,最终判断权在你手里。