资讯动态

PaddleOCR 营业执照识别:5 分钟跑通,3 条部署路径直接选

发布时间:2026/8/29 11:21:47 来源:尧图企业网站定制
PaddleOCR 营业执照识别5 分钟跑通3 条部署路径直接选【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR某银行网点柜员每天要把两百多张对公客户的营业执照信息敲进系统一家一户录入一天就这么耗完了。PaddleOCR 的营业执照识别把这件事拆成两步先让模型把图里的文字全部找出来再按证照版式把企业名称、统一社会信用代码这些字段摘成 JSON整条链路本地就能跑不用把证照发到外部服务。5 分钟跑通 PaddleOCR 营业执照识别 环境准备只要两条命令一条装推理引擎一条装 OCR 本体国内环境建议加-i https://pypi.org/simple换成你手头的镜像源python -m pip install paddleocr[all]装完用下面这段最小脚本试一张执照照片from paddleocr import PaddleOCR # 引入 OCR 引擎 ocr PaddleOCR() # 初始化自动下载中文模型 res ocr.predict(license.jpg) # 识别营业执照 for line in res[0][rec_texts]: print(line) # 逐行输出识别文本跑通后的效果长这样左图是原始件右边是被框出的文本及其位置它怎么认出执照上的字 说白了就是一条流水线四步走完。预处理先判断页面有没有倒置、拍摄有没有透视变形需要时自动转正避免后面的检测认错方向。文字检测DB 系列检测模型负责把每个文本块的位置框出来印刷体、小字号都能定位到。文字识别识别模型当前主线是 PP-OCRv5/PP-OCRv6把框里的内容转成文字并附带 0 到 1 的置信度。版面结构化用 PP-StructureV3 这类管线再解析表格与字段布局把纳税人名称某某公司还原成字段名 → 值的结构企业证照自动化到这一步才算闭环。下面这张是版面解析的示意每个字段都被单独框出并标了位置三个场景拆开看对公开户输入一张执照照片得到含名称、代码、法人、注册地址的 JSON省掉的是键盘录入和双人复核这两步一张从三分钟压到几秒。征信批量回档输入一整目录的历史扫描件用命令行脚本按文件名循环调用结果批量落库省掉的是外包标注团队跑一批前先抽 20 张看置信度分布心里就有底了。票据混录输入执照、增值税专票混合的一摞图识别管线自动输出带坐标和置信度的文本低分条目打标进人工队列省掉全量人工抽检。专票上的印章、骑缝章也不至于干扰正文提取选型速查Python API、命令行还是 PaddleCloud三条路径各有分工模型配置可以从 PP-OCRv5 中文检测配置 这类文件入手调参。部署路径适合场景接入方式主要成本本地 Python API功能验证、中小批量predict()调一下首次自动下模型命令行批处理整目录回档、离线跑批paddleocr ocr -i 目录写个循环脚本PaddleCloudK8s 编排企业级服务化、多人共用Pipeline 工作流 推理服务组件需要容器平台第三种的架构大致是交互层、飞桨套件层、云组件和 K8s 基础四层容易踩的四个坑1. 扫描件太糊关键字段整个消失。检测阶段会先缩放图像再分割文本块源图模糊时小字号低于检测阈值直接不出框识别自然无从谈起。做法扫描件重扫到 300 DPI 以上初始化时关掉用不上的use_doc_unwarping省下的时间还给检测。2. 置信度卡在 0.7~0.8 的条目不敢信。这个区间往往是印刷重影或印章压字硬用会错全丢又浪费。做法把text_rec_score_thresh调到 0.5低于阈值的字段自动进人工队列只复核有疑点的部分。3. 中英文混排证照里英文总差一口气。Co., Ltd. 常被认出成 Co.,Ltd因为空格与标点边界模型不敏感。做法入库前加一层正则做格式归一化别指望原文一字不差。4. 大图一上内存先爆。检测默认会把长边压到 736 像素处理但原图本身超大的话解码这一步就先占走不少内存。做法喂进去之前先用 PIL 缩到长边 2048 以内批量场景开多进程别指望单线程硬扛。到这里从装环境到出结构字段一条完整链路你已经跑过了。更多参数说明和管线用法可以看仓库内的官方文档 docs/quick_start.md。【免费下载链接】PaddleOCRTurn any PDF or image document into structured data for your AI. A powerful, lightweight OCR toolkit that bridges the gap between images/PDFs and LLMs. Supports 100 languages.项目地址: https://gitcode.com/GitHub_Trending/pa/PaddleOCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价