myocr2-invoice

介绍

发票OCR识别，支持【增值发票、普通发票、机动车发票、铁路发票】，实现方式使用RT-DERTv2目标检测提取关键位置发票信息，PaddleOCR根据提取的位置进行文字识别。支持图片和PDF识别，主要识别了发票标题、发票代码、发票号码、开票日期、购买方名称、购买方识别号、销售方名称、销售方识别号、含税金额、不含税金额、税费等信息。

软件架构

RT-DERTv2+PaddleOCR+Flask+easyofd

关于贡献

欢迎任何人加入对项目增添砖瓦

安装教程

Python3.9环境

安装paddlepaddle 3.0.0版本, 推荐使用GPU, GPU/CPU切换public_info.py字段device的值。根据官网中配置信息下载对应的，https://www.paddlepaddle.org.cn/install/quick?docurl=/documentation/docs/zh/install/pip/windows-pip.html
pip install -r requirements.txt

3. (1)gunicorn -w 4 -b 0.0.0.0:5000 main:app 端口可以自由设置
(2)python main.py
以上都可以启动服务
4. 启动成功发送地址测试(post请求，file参数)http://127.0.0.1:5000/invoice_ocr

发票识别截图

增值发票识别
普通发票识别
机动车发票识别
铁路发票识别

后续

目前训练数据种类比较少，后续逐步完善。

注意注意注意

如需paddlepaddle 3.0.0以下版本请切换到PPOCR-V4分支

Name		Name	Last commit message	Last commit date
Latest commit History 55 Commits
deploy		deploy
easyofd		easyofd
images		images
models		models
tool		tool
.gitignore		.gitignore
2.0.1		2.0.1
Dockerfile		Dockerfile
LICENSE		LICENSE
README.md		README.md
TextOCR.py		TextOCR.py
batch_convert.py		batch_convert.py
entrypoint.sh		entrypoint.sh
main.py		main.py
predict2.py		predict2.py
requirements.txt		requirements.txt

Provide feedback

Saved searches

Use saved searches to filter your results more quickly

Repository files navigation

myocr2-invoice

介绍

软件架构

关于贡献

最新动态

安装教程

发票识别截图

后续

注意注意注意

About

Uh oh!

Releases

Packages

Uh oh!

Contributors

Uh oh!

Languages

Folders and files

Latest commit

History

Repository files navigation

myocr2-invoice

介绍

软件架构

关于贡献

最新动态

安装教程

发票识别截图

后续

注意注意注意

About

Resources

License

Uh oh!

Stars

Watchers

Forks

Releases

Packages 0

Uh oh!

Contributors

Uh oh!

Languages

Packages