企业里较磨人的一类工作,是处理非结构化单据——报关单、合同、质检报告、发票,格式五花八门、来源系统不一,却都要被准确抽取、核对、录入。过去这类工作靠人眼+键盘,慢且易错。随着大模型与 OCR、版面分析技术的成熟,"文档智能"成为自动化链路中不可替代的"认知层"。本文从工程视角,讲清楚它怎么落地。
一、非结构化单据为什么难
- 格式不统一:同一类单据在不同系统、不同时段导出的字段位置、排版都可能变化;
- 字段要求高:业务号、编码、数量、日期等关键信息必须准确匹配,错一个字段就可能引发合规风险;
- 量大且时效强:跨境贸易的报关、申报有明确时间窗口,人工超 200 单时耗时易超 3 小时。
单靠"机器人点击"解决不了,必须让机器先"看懂"文档。
二、文档智能的三层技术栈
- 版面分析(Layout):识别文档的区块结构——表头、表格、备注栏、附件,确定字段的物理位置;
- OCR 与识别:把扫描件、图片中的文字转为可结构化文本,处理多语言、多字体、印章干扰;
- 大模型抽取与校验:用大模型理解语义,把"备注栏里的业务号""申报状态"等非固定位置的信息抽取出来,并与业务规则做一致性校验。
三、工程落地五步法
文档智能与执行机器人配合,典型链路是:① 获取(机器人登录系统下载单据)→ ② 解析(文档智能读取并抽取关键字段)→ ③ 匹配(与数据库/申报规则校验)→ ④ 录入/申报(机器人写回目标系统)→ ⑤ 兜底(版式异常、置信度低的转人工复核)。
其中版式兜底机制关键:当遇到训练样本外的新版式,系统能识别异常并交人工,而不是硬抽导致错录。
四、落地数据
某医药国际贸易企业,过去每天登录系统筛选近一个月报关单,逐一解析 Excel 备注栏业务号并匹配数据库,日均耗时超 3 小时且易漏匹配。引入"机器人下载 + 文档智能抽取"后,人工 50 分钟、机器人 5 分钟,效率提升约 90%,每周节省 1 个人力。
某轴承科技企业,进出口材料申报需逐条核对商品编码、数量、申报状态,跨平台复制粘贴易错漏。自动化后人工 180 分钟、机器人 30 分钟,效率提升约 83%,实现 0 错误、100% 合规。
五、工程经验
- 先小样本压测识别率,再决定哪些走自动、哪些走人工;
- 版式变更要可感知,上游改版式时监控模块及时报警;
- 合规优先于效率,进出口场景宁可多一道校验;
- 人机协同是常态:机器做前置工序,人做末道防线。
文档智能让自动化从"会点击"进化到"能理解",是处理非结构化数据较务实的工程路径。
六、工程选型要点
落地文档智能时,建议重点看四点:识别率是否在真实版式上压测达标、是否具备版式兜底而非硬抽、能否与执行机器人无缝衔接、是否支持人工复核闭环。前两点决定准确率,后两点决定能否真正跑进生产流水线。选错任何一项,都会在上线后付出返工代价。从“会点击”到“能理解”,文档智能正是自动化从执行层向认知层跃迁的关键一环,也是处理非结构化数据较务实的路径。