ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

批量离线OCR、扫描件转可搜索PDF:免费的Umi-OCR

批量离线OCR、扫描件转可搜索PDF:免费的Umi-OCR 批量离线OCR、扫描件转可搜索PDF免费的Umi-OCR【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR扫描版 PDF 用 CtrlF 搜不到字屏幕上的文字想复制却复制不了Umi-OCR 是一款免费开源的离线 OCR 工具截图、批量图片在本地完成识别扫描版 PDF 也能变成可搜索、可复制的文档。解压即用不联网照样跑。速览表维度内容适用平台Windows 7 x64、Linux x64安装方式解压即用无需安装是否离线是全程不需要网络输入格式图片 jpg/png/webp/bmp/tif文档 pdf/xps/epub/mobi/fb2/cbz结果输出txt、jsonl、md、csv、双层可搜索 PDF授权方式MIT 开源装好就能跑解压后双击启动 下载发布包.7z压缩包或.7z.exe自解压包没装压缩软件也能用后者。解压到任意目录软件全部文件都在该目录内运行。双击Umi-OCR.exe启动主窗口出现Linux 用户运行umi-ocr.sh。首次打开界面语言跟随系统自动切换之后可在「全局设置」→「语言 / 主题」里改语言和深浅色主题。三个核心OCR场景屏幕上的文字想拿走却复制不了场景部分软件和论文阅读器里的文字选不中想引用一段屏幕内容。步骤打开「截图OCR」标签页。按快捷键在屏幕上框选那段文字。在右侧识别记录栏里选中文字支持多选记录一起复制。把结果复制到剪贴板在别处复制的图片也可以粘贴进来识别。结果你拿到的是可编辑的纯文本多栏或代码截图可在设置里切「排版解析方案」整理换行代码选「单栏-保留缩进」行首空格原样保留。兜底如果结果总差几个字先把图片调高对比度或转灰度再识别仍不理想就换内置的另一套 OCR 引擎跑一遍。一文件夹图片不想一张张录入场景几十张发票扫描件堆在文件夹里文字要进表格或归档。步骤打开「批量OCR」页把整个文件夹拖进去。若每张图固定位置有水印进右栏「忽略区域」按住右键画矩形框住。等任务跑完左侧列表能看到每张图的耗时和状态。勾选保存格式txt、jsonl、md、csv可直接进 Excel任选。结果你拿到的是按所选格式批量输出的识别结果忽略区域内的整个文字块被直接跳过不用事后清理。兜底图太多太大跑得慢就拆成几批排队超大长图把「限制图像边长」数值调高比硬扛一张超长图快得多。扫描版PDFCtrlF搜不到东西场景扫描教材、合同本质是一摞图片阅读器里搜索框永远是空的。步骤打开「文档识别」标签页把 PDF 拖入XPS、EPUB、MOBI、FB2、CBZ 也支持。有页眉页脚的话用「忽略区域」把固定位置框掉。等任务完成导出结果。结果你拿到的是一份双层可搜索 PDFCtrlF 能定位术语在第几页文字能整段复制。兜底某个 PDF 报无法处理时把它逐页转成图片走批量 OCR通常能绕过去。它是怎么做到的 双层 PDF 没有重绘你的文档。原始扫描图完整保留为图像层版式、插图、字体原样不动OCR 把每页文字转成一层透明文本叠在图片上。你看到的还是扫描件但搜索索引指向的是那层透明文字所以能搜、能复制。识别本身由内置的离线引擎RapidOCR、PaddleOCR 两套在本地机器上完成图片和文档全程不出网卡断网不影响运行。不开界面用命令行跑OCR命令行入口就是主程序本身可以把整个文件夹识别后写进一个文件umi-ocr --path D:/images --output D:/result.txt需要程序化调用时软件自带本地 HTTP 接口只走本机环回图片和文档识别都能走接口。参数细节见命令行手册和HTTP接口手册。它不擅长什么识别率和输入质量强相关艺术字、潦草手写有上限调参数救不了先做对比度增强等预处理。超大图和长图吃内存4GB 以下内存的机器减少单批数量或调低「限制图像边长」。HTTP 接口不擅长并发脚本里串行调用长时间连续调用偶发连接报错重试即可。目前只支持 Windows 和 Linux x64Mac 用户等兼容计划落地。识别结果建议抽查关键数字和人名后再归档重要材料别只信机器。Umi-OCR 把截图取字、批量图片转文字、扫描件变可搜索 PDF、二维码读写这四件事收进了一个免费离线的小工具里。更多细节看README遇到问题可到项目的 Issue 区反馈入口见 README。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表