一点奇怪的想法——paddleocr识别的应用——ppstructure下的关键信息抽取
·
ppstructure/kie/how_to_do_kie.md · PaddlePaddle/PaddleOCR - Gitee.com 看到与我需求最为相关的功能。
就是将文本中的信息key 与value的对应。。看着不麻烦,实际上掉头发。。
环境配置上还是存在一定的麻烦,不过还好没有大问题
库和模型的下载参考官方文档
doc/doc_ch/kie.md · PaddlePaddle/PaddleOCR - Gitee.com
具体使用到的命令行有:
还有一些别人写了,还是有用的,可以自行解决。
pip install Polygon3 -i https://pypi.tuna.tsinghua.edu.cn/simple
这个是lanms没有安装,有些博主的法子完全是狗屁。反正这个是我今天安上去的命令行,后面会不会成为狗屁就不知道了
pip install lanms-neo
这个是getsize()在pillow10这个库里取消了,有直接改方式没细看。所以就直接安装了9.5
pip install Pillow==9.5 -i https://pypi.tuna.tsinghua.edu.cn/simple
最后就是:
python kie/predict_kie_token_ser.py --kie_algorithm=LayoutXLM --ser_model_dir=../model/ser_vi_layoutxlm_xfund_infer --image_dir=./docs/kie/input/testas004.jpg --ser_dict_path=../train_data/XFUND/class_list_xfun.txt --vis_font_path=../doc/fonts/simfang.ttf --ocr_order_method="tb-yx"

看的结果还能接受,没有去训练自己的模型有一个不错的识别结果能接受。接下就是将这个上面获取的答案填入另一个表上相似的问题上。----第一个没有头绪的地方来了

今天白天先到这,晚上再来。
更多推荐


所有评论(0)