此贴已删除

此贴已删除。。。

免费一键OCR工具不是一大堆吗(不知道有什么你问豆包帮你搜),真的非paddleocr不可的话官网调用免费的:

PaddleOCR - 文档解析与智能文字识别 | 支持API调用与MCP服务 - 飞桨星河社区

你很想和wynick27识别的一模一样的话,直接下载他的开源工具,填入api就行了。

额,他的开源工具链接是哪个

自己动手搜一下呗 :melting_face:,而且他的工具也没有对OCR结果做特定优化,那个是校对工具,你拿官网识别差不多的,只是说心理安慰上是一样的。

我用官网每次最多识别100页

那就用他工具填一下api就行了,不知道在哪获取你百度搜或者问客服。而且是1000页吧?你拿工具拆分下pdf就行了吧。。。

我现在开的坑比较多,忙不过来了,建议楼主申请个key自己试试ocr

我现在也打包了release版本,可以直接下载

在这里登录百度账号就能申请key

免费的key每天可以识别3000页
工具是拆分成单个图片识别的,因为直接多页pdf的话返回的位置不是图片本身的位置,而是在pdf里渲染的位置,还需要额外计算比例。

好的,谢谢你

你的这个工具有使用说明吗,不太会用哎

在百度申请api key后会得到一个网址(这个决定了用什么模型),然后还有一个token,打开工具选settings/manage,在global settings里面填上这两个值

然后建一个工程,pdf就选你的pdf文件位置,ocr json就是你保存结果的位置,开始页码结束页码就是范围,页码偏移就是ocr中第一页的位置,也就是第7页-第1页也就是6.设置好以后在主界面选ocr全部页面,然后就要等很久。

完成以后点导出所有ocr页面文本就会把这个合并成一个文本

不过这个只是合并显示的内容,不会处理图片和表格之类的,我准备以后再加这个功能。

为啥我申请后只有token,没有网址,而且只有1000页

pdf要预先转成图片吗

网址和模型有关,选了模型后就会有网址,就是API_URL那里,我看了下才发现砍了额度,现在只给1000页了。不需要先转图片,程序会自动转,而且还有工具自带提取图片功能。

不是一万了吗

哦,现在不用申请就有1万页了吗,我之前申请过提高额度,不知道现在直接注册是什么情况。

怎么知道工具已经在工作了,以及怎么知道什么时候结束了 :grinning_face:

下方有进度条提示啊

执行到55%不动了,是卡住了吗,能不能退出后重新运行

可以的,已经识别过的不会重复识别。

有些地方识别漏了,能直接修改识别的文本吗,怎么修改