Tesseract OCRv4.0

大小:41.89MB

版本:4.0

语言:简中

更新:2025-11-08

普通下载
360安全卫士下载
资源说明

Tesseract OCR是一款专业的图文识别的工具软件。软件支持中文(简体和繁体)、英语等语言的图文识别并转换为可编辑文本。十分方便快捷,界面简约,布局直观清晰,操作简单,极易上手,是一款不可多得的利器。

软件特色

去持多语言

当前3.02 版本支持包括英文,简体中文,繁体中文,支持Windows,Linux,Mac OSX 多平台。使用中Tesseract 的识别率非常高。

Tesseract安装

这里使用的版本为Tesseract3.02。直接点击上面的链接,下载windows下的安装文件tesseract-ocr-setup-3.02.02.exe。安装tesseract-ocr-setup-3.02.02.exe。安装成功后会在相应磁盘上生成一个Tesseract-OCR目录。如图我是安装到了如下位置安装完成打开命令行,输入tesseract,展现如下图说明已经安装成功。

命令行测试使用

接下来就可以使用tesseract进行图片识别了。准备一副待识别的图像,这里用画图工具随便写了一段字,然后定义成1.jpg,在命令行中定位到图片路径然后输入命令:tesseract 1.jpg result -l eng,其中result表示输出结果文件txt名称,eng表示用以识别的语言文件为英文。会发现图片当前目录下生成了1个result.txt文件里面结果为

增加中文语言库

安装目录下的tessdata目录存放的是语言识别包,如果想增加中文识别功能,可以将中文的语言库放到此目录下,下载后将解压出的chi_sim.traineddata放到此目录下。然后调用的时候指明语言库即可,例如:tesseract xxx.jpg result -l chi_sim照样。

执行后结果

可以看到,识别率并不是十分令人满意。而且这边使用的例子都是十分正规的字体。如果遇到验证码那种不规则的字体,识别率也会大打折扣的,当然可以参考网上的相关资料进行对Tesseract字符识别进行样本训练,通过使用训练后的语言库会提高识别精度。这里就不做演示了。

常见问题

那如何使用java程序调用相应的tesseract进行操作呢?

这里介绍2种方式

一种是使用cmd方式,另外一种就是使用tess4j。tess4j的源码地址 http://sourceforge.jp/projects/sfnet_tess4j/ 中文首页

感兴趣的自己下载查看源代码。

由于范例代码较多就不一一贴出来了,会在文章结尾提供一个下载链接,大概讲下结构,

如上图,tess4j包下是使用tess4j调用tesseract,src下的dll文件是需要使用到的。同时,加载的语言库文件也要放到tessdata目录下。而cmd 包下是使用cmd方式调用的范例,额外需要swingx-1.6.1.jar,调用时直接配置使用的安装的路径,并配置语言库即可。

代码下载地址,由于附带了data文件,jar包等,所以会比较大,接近50M。导入到工程即可。各个包下都有测试的Test类,直接右键就可以运行。前提是对应目录下有相应图片。

在cmd包下ClearImageHelper这个类是对图片进行处理的类,比如灰度转换,二值化,缩放等等,对于复杂图片可以先进行处理,来提高图片识别率。而tess4j下也封装了图片处理的工具类,基本都包含这些功能,例子中也给出了部分样例。

Bty,话说使用原生态识别调用,跟tess4j得到的结果还是有所差别的。

安装步骤

下载安装包并打开

点击自定义选择安装位置安装

安装完成后即可打开使用

软件合集更多

Tesseract OCR版本大全更多

Tesseract OCR可识别图像中的文本,并将其转换为可编辑和可搜索的数据格式。它适用于多种应用场景,包括文档扫描、图像处理、数字存档等。它支持多种语言的文本识别,包括英语、中文、法语、德语、西班牙语等,因此可广泛应用于世界各地。下面就为大家带来Tesseract OCR版本大全。

ocr文字识别软件有哪些更多

ocr软件能够帮助用户们把图片上的文字提取下来进行复制等操作,是十分方便的收集素材的一种方式,同时也能帮助你在各种复杂的水印文件中找到自己所需要的内容,下面就为大家推荐一些好用免费的ocr文字识别软件。

从图片中提取文字的免费软件有哪些更多

从图片中提取文字的的软件在多个场景中有着广泛的应用,可帮助用户快速从图像中提取文本,并进行编辑、复制和共享。在学术研究中,研究人员经常需要从书籍、论文或研究报告中提取关键信息。使用这些软件可以快速识别和提取这些信息,节省大量时间和精力。下面就为大家推荐一些从图片中提取文字的免费软件。

图片识别文字的软件有哪些免费更多

图片识别文字软件在日常生活和工作中有多种用途。可以帮助用户快速从图片中提取文字信息,节省大量时间和人力成本。例如,在旅行中遇到不懂的外语菜单或路标时,使用图片文字识别工具可以立即将其翻译成熟悉的语言,从而轻松翻译各种信息。下面就为大家推荐一些图片识别文字的软件。

相关软件
神奇OCR文字识别软件3.0.0.311

神奇OCR文字识别软件3.0.0.311

下载
神奇OCR文字识别软件是一款非常好用功能强大的文字识别软件,这款软件可以很好的进行文字识别,支持从图片中读取、来自手机图片、来自扫描仪照片、来自摄像头拍照、来自剪贴板图片、来自屏幕截图。有需要的用户快来下载使用吧!
大小:51.14MB 时间:2025-11-18
全方位OCR图片文字识别软件64位v2.3.3

全方位OCR图片文字识别软件64位v2.3.3

下载
全方位OCR图片文字识别软件是一款智能化的图片文字识别软件,软件包括PDF、JPG、PNG等,软件支持对图文中的文字进行识别并提取,同时支持批处理模式,这是一款很不错的软件,我们在日常生活中也能经常使用到,对该软件感兴趣的小伙伴千万别错过,欢迎需要的朋友下载使用。
大小:107.64MB 时间:2025-10-20
闪电OCR图片文字识别2.2.8.0

闪电OCR图片文字识别2.2.8.0

下载
闪电OCR图片文字识别是一款非常优秀的图片文字识别工具,界面简洁大方,功能强劲实用,支持TXT、doc、docx三种格式输出,点击开始识别就可以将文本内容识别出来并且将文字保存到doc文件,这款软件也支持图片识别、支持手写识别、支持票证识别!
大小:51.05MB 时间:2025-10-18
转易侠扫描王OCR文字识别3.6.0.1

转易侠扫描王OCR文字识别3.6.0.1

下载
转易侠扫描王是一款不错的OCR图文识别软件,该软件支持屏幕截图识别,身份证、驾驶证、发票等数十种证件文字提取,可将图片识别成保留图文排版布局的word文档,可提取图片里的表格部分保存成excel文档,支持批量识别处理,大大提高您的办公效率,需要的朋友快来下载吧!
大小:3.96MB 时间:2025-08-09
最新软件
超级变速器2.1.3.4

超级变速器2.1.3.4

下载
超级变速器是一款非常实用的游戏时间加速工具,软件非常适合单机游戏用,可以提供一倍、二倍、五倍、十倍等不同的加速功能,可以快速跳过这些繁琐的动画内容,让玩家们轻松畅玩,仅限于单机游戏的使用,在网络游戏中使用该软件将违反账号协议,具有封号风险,请大家酌情使用这款加速神器哦!
大小:30.76MB 时间:2025-12-19
图片工厂电脑版

图片工厂电脑版

下载
图片工厂是一款功能强大的图像处理工具,图片工厂集图片浏览、编辑、排版、相框、美颜特效等功能于一体,方便用户快速浏览美化图片,软件内置了丰富的图片组合样式,用户可以制作精美的图片集并进行播放,运行稳定,处理图片速度快,对该软件电脑版有需求的用户千万不要错过,快来下载使用吧!
大小:77.07MB 时间:2025-12-19
EditPlusv6.1.780

EditPlusv6.1.780

下载
EditPlus是一款功能强大,可取代记事本的文字编辑器,具有无限撤销和重做、英文拼写检查、自动换行、列号标记、搜索和替换、同时编辑多个文件、全屏浏览等功能,同时它具有监视剪贴板的功能,可以与剪贴板同步自动将文本粘贴到EditPlus的编辑窗口中,这样就可以省去粘贴步骤,并且提供了多工作窗口,可以在工作区打开多个文档而不用切换到桌面,喜欢该软件的快来下载试试吧!
大小:2.78MB 时间:2025-12-19
AnyDeskv9.6.6

AnyDeskv9.6.6

下载
AnyDesk是一款堪称速度最快的免费远程连接桌面控制软件,采用先进的视频压缩技术deskPT,轻松实现防火墙路由器穿透,AnyDesk运行稳定、反应流畅迅速,而且软件体积小巧,使用时内存占用低,重点还支持与远程电脑同步剪贴板,整体速度较为流畅,是一款很不错的软件,对该软件最新版感兴趣的快来下载吧!
大小:7.59MB 时间:2025-12-19

玩家点评 0人参与,0条评论)

收藏
违法和不良信息举报
分享:

热门评论

全部评论