请问如何从扫描的图片上截取文字进行编辑?谢谢!
发布网友
发布时间:2022-04-23 00:51
我来回答
共5个回答
热心网友
时间:2023-07-14 23:14
从图片上截取文字进行编辑可以通过【风云OCR文字识别】完成。在网页上搜索下载软件。
安装好软件后,双击打开软件。选择左下方的截图识别。
在截图识别功能界面中间有一个点击截图,可以通过这个按钮进行截图识别文字。不过小编更喜欢用快捷键(ALT+F)
打开你想要截图识别的网页,小编这里随意打开一个网页界面作为示例了。将网页截图后,软件会显示为第二张图的样子。
选择输出格式。在将截图识别为文字后,可以保存为Word文档的形式也可以保存为TXT文本的格式。
设置转换模式。可以选择是优先编辑还是保持原排版。
设置输出路径。在此可以选自定义输出还是原目录输出。在确定完这些选项后,点击开始识别。
当截图识别文字完成后,会弹出一个弹出框,点击中间的打开文件,进行对识别出来的文字的查看。
截图识别的结果如下。
热心网友
时间:2023-07-14 23:15
一\ word就可以 用OCR识别功能
首先将扫描仪安装好,接下来启动“Microsoft Office/ Microsoft Office 工具/Microsoft Office Document Scanning”即可开始扫描
示:Office 2003默认安装中并没有这个组件,如果你第一次使用这个功能可能会要求你插入Office2003的光盘进行安装。
由于是文字扫描通常我们选择“黑白模式”,点击扫描,开始调用扫描仪自带的驱动进行扫描。这里也要设置为“黑白模式”,建议分辨率为300dpi。扫描完毕后回将图片自动调入Office 2003种另外一个组件“Microsoft Office Document Imaging”中
点击工具栏中的“使用OCR识别文字”按键,就开始对刚才扫描的文件进行识别了。按下“将文本发送到Word”按键即可将识别出来的文字转换到Word中去了。如果你要获取部分文字,只需要用鼠标框选所需文字,然后点击鼠标右键选择“将文本发送到Word”就将选中区域的文字发送到Word中了
二\尚书7号OCR文字识别系统 Shocr7.0 (扫描文字识别系统)绿色完全版
下载地址:http://www.cm520.net/Software/Catalog50/4205.html
三\先课文成PDF,然后在OFFICE 2007中转换成word文档 。最后保存
四先把文件转成PDF格式,然后,用Adobe Acrobat 7.0 Professional打开。就可以转成文字了。
回答者:yalal - 经理 四级 9-5 10:55
修改答复: yalal,您要修改的答复如下: 积分规则 关闭
一\ word就可以 用OCR识别功能
首先将扫描仪安装好,接下来启动“Microsoft Office/ Microsoft Office 工具/Microsoft Office Document Scanning”即可开始扫描
示:Office 2003默认安装中并没有这个组件,如果你第一次使用这个功能可能会要求你插入Office2003的光盘进行安装。
由于是文字扫描通常我们选择“黑白模式”,点击扫描,开始调用扫描仪自带的驱动进行扫描。这里也要设置为“黑白模式”,建议分辨率为300dpi。扫描完毕后回将图片自动调入Office 2003种另外一个组件“Microsoft Office Document Imaging”中
点击工具栏中的“使用OCR识别文字”按键,就开始对刚才扫描的文件进行识别了。按下“将文本发送到Word”按键即可将识别出来的文字转换到Word中去了。如果你要获取部分文字,只需要用鼠标框选所需文字,然后点击鼠标右键选择“将文本发送到Word”就将选中区域的文字发送到Word中了
二\尚书7号OCR文字识别系统 Shocr7.0 (扫描文字识别系统)绿色完全版
下载地址:http://www.cm520.net/Software/Catalog50/4205.html
三\先课文成PDF,然后在OFFICE 2007中转换成word文档 。最后保存
四先把文件转成PDF格式,然后,用Adobe Acrobat 7.0 Professional打开。就可以转成文字了。
热心网友
时间:2023-07-14 23:15
OCR技术是光学字符识别的缩写(Optical Character Recognition),是通过扫描等光学输入方式将各种票据、报刊、书籍、文稿及其它印刷品的文字转化为图像信息,再利用文字识别技术将图像信息转化为可以使用的计算机输入技术。可应用于银行票据、大量文字资料、档案卷宗、文案的录入和处理领域。适合于银行、税务等行业大量票据表格的自动扫描识别及长期存储。相对一般文本,通常以最终识别率、识别速度、版面理解正确率及版面还原满意度4个方面作为OCR技术的评测依据;而相对于表格及票据, 通常以识别率或整张通过率及识别速度为测定OCR技术的实用标准。
OCR识别技术不仅具有可以自动判断、拆分、 识别和还原各种通用型印刷体表格,在表格理解上做出了令人满意的实用结果,能够自动分析文稿的版面布局,自动分栏、并判断出标题、横栏、图像、表格等相应属性,并判定识别顺序,能将识别结果还原成与扫描文稿的版面布局一致的新文本。表格自动录入技术,可自动识别特定表格的印刷或打印汉字、字母、数字,可识别手写体汉字、手写体字母、数字及多种手写符号,并按表格格式输出。提高了表格录入效率,可节省大量人力。同时支持将表格识别直接还原成PTF、PDF、HTML等格式文档;并可以对图像嵌入横排文本和竖排文本、表格文本进行自动排版面分析。
采用OCR识别技术,可以将其应用于银行票据光盘缩微系统,可以自动提取票据要素,可减轻操作员的工作量,减少重复劳动,尤其是在与银行事后且监督系统相结合后,可以替代原先的操作人员完成事后监督工作。由计算机自动识别票据上的日期、帐号、金额等要素,通过银行事后监督系统与业务系统中的数据进行比较,完成传统的事后监督操作;配有印章验证系统后,自动将凭证图像中的印章与系统中预留的印鉴进行比较,完成印章的真伪识别。
利用目前的高新技术-OCR,直接从凭证影像中提取金额、帐号等重要数据,代替人的手工录入,与条码识别/流水识别紧密结合,实现建立事后副本帐、完成事后监督的工作。OCR处理一般使用性能较好的PC机,OCR处理程序一经启动会自动扫描数据库中的凭证影像,发现有需OCR处理而未处理的,提取到本地进行处理。
OCR手写体、印刷体识别技术,能识别不同人写的千差万别的手写体汉字和数字,应用于本系统,识别凭证影像中储户填写的信息,如大写金额、小写金额、帐号、存期、日期、证件号等,可以代替手工录入。同时被识别得出的金额还要与流水识别所得的金额进行核对,核对成功,则OCR识别成功。这样处理是为了避免误判。
经过对银行产生的实际凭证进行的大量测试,在实际开发过程中,根据银行的实际需求,OCR技术在票据和表格识别能力和手写体自动识别能力上不断提升,目前处理速度可达到每分钟60~80张票据,存折识别率已经达到了85%以上,存单、凭条识别率达到90%以上,而85%以上的识别率就能减少80%以上的数据录入员。
参考资料:http://zhidao.baidu.com/question/23978139.html?si=3
热心网友
时间:2023-07-14 23:16
“可以把扫描上的文字直接用于编辑”与扫描仪无关,什么扫描仪都可以。能“直接用于编辑”属于汉字识别,是靠OCR(光学字符识别)软件实现的。
购买扫描仪时,商家都会附送OCR软件。
国内最好的两家:清华TH-OCR、汉王OCR。
他们的OCR软件都有批量识别的功能。
热心网友
时间:2023-07-14 23:16
用OCR文字识别软件吧
比如尚书七号
操作是注意调好相应参数