我自研了一款基于AI的OCR图片识别文字工具,免费分享给大家,有办公需求的朋友点击这里直接下载:https://bestllm.bashige.com/download/Bashige-OCR.exe
这是截图

Bashige OCR软件优势特点
- 这是一个单文件绿色软件,下载后直接打开就行,无需安装,环保无污染
- 支持将图片格式或图片格式的PDF文件进行文字识别
- 基于AI视觉识别技术,相比基于传统OCR引擎,识别效果更好
- 支持单个文件或批量多个文件识别处理
- 提示词可根据自己业务微调修改
- 识别文字结果可直接导出为TXT、PDF、MD、JSON、HTML格式文件
- 除了支持调用远程大模型聚合平台中转站的API外,如果您的电脑配置高,能够本地部署大模型的话,也能调用例如Ollama、LM Studio本地API接口
使用方法
首先填入OpenAI兼容的Base URL、API Key、Model ID这三要素,需要从AI大模型聚合中转站获取。API对接方法可参考《AI大模型聚合平台的API Key如何调用?超级简单》。
然后上传需要OCR识别的图片、PDF文件,点击”开始识别“即可。处理过程中有进度条可以看。
选择大模型的注意事项
无论您选择哪家中转站,务必选择支持”视觉Vision“的大模型,不然是识别不了图片的。

使用过程中如遇Bug,请在下方留言反馈,我会及时修复。