着急求助!有这种软件么?

来源:百度知道 编辑:UC知道 时间:2024/06/07 16:29:47
我是把一本书,扫描到电脑里,然后用软件辨别,生成文本文件。

但是其中有一些相近的字错误。比如自己(ji)会变成自已(yi)。

有什么软件可以把中文词语当中的错别字搜出来的么?

请高人帮忙。

(表说还没编写出来)
407631 - 经理 四级 汉化不能用哦
补充:我的是已经把图像辨别为文本txt,现在要找txt当中的别字。
不是要把扫描的图片里的字辨别出来。

用OCR软件就可以搞定
如果 公式 字母 中文 混排
任何软件都识别不全的!
用OCR就可以了.
比如Office 2003中也提供了文字识别服务,结合那个Image writer可以很方便将PDF转成WORD。
第一种方法:用SnagIt工具进行文字提取。

首先使用SnagIt的文字捕捉功能将文字提取出来。SnagIt当前版本为7.02,大小为8903KB,下载地址可以在http://www.skycn.com/soft/2290.html 找到,汉化补丁可以在http://www.skycn.com/soft/2291.html 找到。启动SnagIt,选择菜单“输入/区域”,选择菜单“工具/文字捕获”,然后我们打开要捕捉的文件窗口,按下捕捉快捷键,选定捕捉区域即可捕捉到文字。

接着用相应工具重排文字。此时我们发现提取的文字可能会有很多空格或段落错乱等现象,而且字号、字体等不合自己的心意。这时我们可以用熟悉的WPS或Word软件进行重新编排。我们以WPSOffice2003为例看看如何对付提取后文章的编排。

用WPSOffice2003打开提取文章;然后选择“工具”菜单下的“文字”/“段落重排”,这时你会看到提取文章重新进行排版;接下来选择“工具”菜单下的“文字”/“删除段首空格”命令,使得文章的每段参差不齐的行首空格被删除;再选择“工具”菜单下的“文字”/“增加段首空格”,文章变为正常的书写格式;提取文章一般都留有空段,为删除这些空段,继续选择“工具”菜单下的“文字”/“删除空段”命令,这时文章完全变为我们所要的形式;用你熟悉的界面任意编辑文章吧。

第二种方法:用屏幕截图然后让OCR软件识别。

打开带有文字的图片或电子书籍,