ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

免费离线 OCR:Umi-OCR 3 步把扫描 PDF 变成可搜索文档

免费离线 OCR:Umi-OCR 3 步把扫描 PDF 变成可搜索文档 免费离线 OCRUmi-OCR 3 步把扫描 PDF 变成可搜索文档【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCRUmi-OCR 是一款免费、离线运行的开源 OCR 文字识别工具把扫描 PDF 转成双层可搜索 PDF也支持截图取字与批量图片识别。快速判断✅ 免费且开源代码全部开源使用不收费离线运行识别全程无需网络内容不上传无需安装解压 .7z 发行版后直接启动格式支持输入 jpg、png、webp、tif 图片与 pdf 文档输出 txt、jsonl、md、csv 或可搜索 PDF跟一遍完整流程首次使用下载 .7z 发行版解压Windows 双击 Umi-OCR.exe、Linux 用 umi-ocr.sh 启动界面语言按系统自动切换主题与字号在“全局设置”中调整。从屏幕截图取出文字屏幕内容禁止复制时用截图取字代替逐字重录。打开“截图 OCR”标签页按快捷键截屏识别结果默认写入剪贴板左侧预览栏可划选原文右侧识别记录可编辑、多选复制多栏版面文本后处理选“多栏-按自然段换行”代码截图用“单栏-保留缩进”保留行首空格把扫描 PDF 变成能搜索的文档扫描版 PDF 无法搜索或复制文字时用文档识别处理。打开“文档识别”标签页导入 pdf也支持 xps、epub点开始输出双层可搜索 PDF透明文字层叠加在原扫描上可全文检索与复制页眉页脚位置固定时用忽略区域框掉长文档可开启任务完成后自动关机或待机把整文件夹图片批量识别成文本需要把几十、几百张图片逐张转成文字时用批量任务一次完成。打开“批量 OCR”标签页拖入图片支持 jpg、png、webp、tif 等格式排队识别结果保存为 txt、jsonl、md 或 csvExcel带固定水印时右键在忽略区域画矩形框排除超大长图先调高文字识别里的“限制图像边长”读取图片里的二维码图片里的码不便用手机扫描时直接交给软件处理。在“二维码”标签页截图、粘贴或拖入图片自动读取图中的码支持一图多码与 19 种协议输入文本可生成二维码可调纠错等级识别失败时先放大目标区域再试 配置项速查设置项作用建议值或可选值文本后处理整理识别文本的排版与顺序多栏-按自然段换行代码截图用单栏-保留缩进忽略区域排除水印、页眉页脚文字矩形框包住水印全部可能出现位置限制图像边长控制超大长图是否被压缩识别大图前调高数值保存文件类型批量识别的输出格式txt / jsonl / md / csvExcelOCR 引擎选择离线识别引擎RapidOCR 兼容性好PaddleOCR 速度稍快语言/Language切换界面显示语言跟随系统或手动指定渲染器控制界面渲染方式截屏闪烁时切换方案或关闭硬件加速 问题排查现象解法多栏版面识别顺序混乱文本后处理选“多栏”系列预设结果混入水印文字忽略区域编辑器右键画框包住水印超大长图识别不全调高“限制图像边长”数值截图闪烁、界面错位全局设置切换渲染器或关闭硬件加速 延伸与生态命令行手册用命令行把识别挂进脚本与定时任务HTTP 接口手册本地启动 OCR 服务供程序直接调用翻译工具说明参与界面多语言翻译协作Umi-OCR 是解压即用的免费离线 OCR 工具。下载发行版把待处理的扫描件一次识别完。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表