问答文章1 问答文章501 问答文章1001 问答文章1501 问答文章2001 问答文章2501 问答文章3001 问答文章3501 问答文章4001 问答文章4501 问答文章5001 问答文章5501 问答文章6001 问答文章6501 问答文章7001 问答文章7501 问答文章8001 问答文章8501 问答文章9001 问答文章9501

用matlab对图片进行字符识别,只要能识别字母就行…十万火急!!请各位大侠们多多帮忙…

发布网友 发布时间:2022-04-23 15:39

我来回答

3个回答

热心网友 时间:2023-10-08 18:31

OCR的处理流程如下:

首先将标的物的影像输人,然后经过影像前处理、文字特征抽取、比对识别等过程,最后经人工校正将认错的文字更正,将结果输出。详细如下:

影像输入

要想进行OCR处理,必须先通过光学仪器,如影像扫描仪、传真机或任何摄影器械,将影像转人计算机。随着科技的进步,扫描仪等输人装置已制作得愈来愈精致,轻薄短小,品质也高,对OCR有相当大的帮助。扫描仪分辨率的提高使影像更清晰,扫描速度的加快提高了OCR处理的效率

影像前处理

影像前处理是OCR系统中需解决问题最多的一个模块。从得到一个不是黑就是白的二值化影像或灰阶、彩色的影像,到分离出一个个的文字影像的过程,都属于影像前处理。它包含了影像正规化、去除噪声、影像矫正等的影像处理,以及图文分析、文字行与字分离的文件前处理。影像处理的原理及技术都已成熟,在网站上有不少可用的链接库;在文件前处理方面,则凭各家本领了;影像需先将图片、表格及文字区域分离出来,甚至可将文章的编排方向、文章的提纲及内容主体区分开,而文字的大小及文字的字体也可如原始文件一样地判断出来。值得一提的是如何将独立文字从文字行抽取出来。中文字特别的地方在于它有部首的观念。因此,不只是上下的合成,左右合成的字也特别多,且有可能是两部分(如“利”、“明”等),也有三部分的(如“捌”、“晰”等)合成。当这些字与英文或数字同时存在且紧靠在一起时,判断如何连接或切出,是相当困难的。对排版整齐的印刷文件都无法百分之百解决,更何况是每个人写字习性都不同的手写文件。也因此,手写的OCR产品走向是特殊且有*的。

文字特征抽取

单以识别率而言,特征抽取可说是OCR的核心,用什么特征,怎么抽取,直接影响识别的好坏,所以在OCR研究初期,特征抽取的研究报告特别多。而“特征”可说是识别的筹码,可简易的区分两类。一类为统计的特征。例如文字区域内的黑/白点数比,当文字区分成好几个区域时,这一个个区域黑/白点数比之联合,就成了空间的一个数值向量。在对比时,基本的数学理论就足以应付了。而另一类特征为结构的特征。例如文字影像细线化后,取得字的笔画端点、交叉点之数量及位置,或以笔划段为特征,配合特殊的比对方法进行比对,市面上的线上手写输人软件的识别方法多以此种结构的方法为主。

比对数据库

当输人文字算完特征后,不管是用统计或结构的特征,都需有一比对数据库或特征数据库来进行比对,数据库的内容应包含所有欲识别的字集文字以及根据与输人文字一样的特征抽取方法所得的特征群组。

比对识别

比对识别是指根据不同的特征特性,选用不同的数学距离函数进行比对.较有名的比对方法有欧式空间的比对方法、松弛比对法(Relaxation)、动态程序比对法(Dynamic Programming, DP)以及类神经网络的数据库建立及比对、HMM(Hidden Markov Model)等著名的方法。为了使识别的结果更稳定,提出了专家系统(Experts System),利用各种转征比对方袂的相异互补性,使识别结果的可靠性提高。

字词后处理

由于OCR的识别率并无法达到百分之百,为了加强比对的正确性及信心值,一些除错或甚至帮忙更正的功能,便成为OCR系统中必要的一个模块。字词后处理就是一例。它在比对后的识别文字与其可能的相似候选字群中,根据前后的识别文字找出最合乎“词”的词,作为更正的功能。例如识别出“找门”,在词库中找不到这个词,而“我”是“找”的相似候选字,因此很自然地将“我”取代“找”,而成“我们”。

字词数据库

它是为字词后处理所建立的词库。

人工校正

这是OCR最后的关卡。在此之前,使用者可能只是拿个鼠标,跟着软件设计的节奏操作或仅是观看,而在此则需要使用者去更正甚至找寻可能是OCR出错的地方。一个好的OCR软件,除了有一个稳定的影像处理及识别核心以降低错误率外,人工校正的操作流程及其功能也影响OCR的处理效率。因此,文字影像与识别文字的对照及其屏幕信息摆放的位置,还有每一识别文字的候选字功能、拒认字的功能及继字词后处理而特意标示出可能有问题的字词,都是为了让使用者尽量少地使用键盘。当然,不是说系统没显示出的文字就一定正确,可根据具体要求决定是否重新校正一次。

结果输出

其实输出是件简单的事,但需看使用者用OCR到底为了什么。有人只要求文本文件用于部分文字的再使用,所以只要一般的文字文件,有人要求输人文件的原文原封不动地重现出来;有人注重表格内的文字,要求跟Excel等软件结合。无论怎么变化,都只是输出档案格式的变化而已。

热心网友 时间:2023-10-08 18:32

http://www.cnki.com.cn/Article/CJFDTOTAL-YYGX200906016.htm

http://www.cnki.com.cn/Article/CJFDTOTAL-YJSK200602009.htm

自己下来看吧,GOOD LUCK

热心网友 时间:2023-10-08 18:32

看来你也是高手哦 我来学学的
声明声明:本网页内容为用户发布,旨在传播知识,不代表本网认同其观点,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。E-MAIL:11247931@qq.com
华为平板变电脑无法适配怎么办华为平板电脑无法连接电脑 华为平板电脑有线网络设置在哪平板电脑要连接有线网络怎么设置_百度... diskgenius怎么恢复格式化文件 电脑内文件丢失了怎么恢复电脑文件夹丢失的文件怎么恢复 格式化数据恢复,4个方法,恢复文件好帮手 闲鱼上卖假货订单被投诉商家害不害怕-闲鱼举报假货但是商家下架了怎么... Mysql安装注意事项、安装失败的五个原因分析 ...安装 mysql 的时候提示"系统管理员设置了系统策略禁止进行此安装"有... 如何辨别烟好坏 换流站典型施工工艺标准化手册:土建篇图书目录 用MATLAB做文字识别仿真 matlab实现ART1汉字分类,训练,识别代码 如何用MATLAB仿真印刷体汉字识别系统 matlab 文字检测 MATLAB平台下的汉字识别 生姜粉能放进卤汤中吗? 一个抖音号不同时间观看同一视频算多少浏览量? 抖音流量收益怎么计算? 姜放进沙子要不要浇水 生姜怎样放才好呢? 抖音转发的播放量算谁的 中视频抖音有播放西瓜没有怎么算 抖音如何计算一次完整的播放次数? 如何把微信好友全部转移到另一个上,不要一个个添加了,求大神详解, 微信好友怎么全部发信息 阿拉斯加蟹有哪些做法 学烹饪怎样88? ASMR美女独享印度洋帝王蟹,鲜美的蟹腿蘸着辣酱,真好吃! 为什么帝王蟹价格那么昂贵,我们就只吃帝王蟹的蟹腿? 吃蟹阿姨吃玉米和帝王蟹,蘸上秘制辣油,味道别提多棒了 怎么用程序(MATLAB和C语言都可以)识别图片文字(如下图)?,不一定要识别到100%,识别到一半以上就OK。 MATLAB图片中数字和文字的提取 matlab字符识别神经网络怎么训练 基于深度学习的自然场景文字识别的代码怎么写,用matlab仿真 求MATLAB程序:利用前向传播神经网络进行字符识别的程序。设神经网络为具有一个隐含层的BP网络 matlab怎么读取文本文件中的数据? 毕业设计 手写汉字识别系统 最好是用MATLAB 求指导 matlab读取txt中的文字,并转化怎么弄? MATLAB依次读取文本文件中的全部内容 自然场景文字识别的代码怎么写,用matlab仿真 matlab怎么读取txt文件中带有汉字的数据 如何测试编写的matlab模式识别分类器的各个程序? 如果EXCEL里既有字母,汉字又有数据,在MATLAB中该如何读取? 我在厦门,在哪个机构申请CE认证 厦门ce认证一般多少钱 欧盟认可的国际权威机构SGS颁发的CE认证证书是什么? 听说厦门石材公司做石材CE认证有补贴,这是真的吗?具体怎么申请有人知道吗? 急!谢谢! 厦门CE认证 福建哪里申请CE认证 请问人造石出口欧洲,客户要求有CE认证,哪里可以做?费用多少?要多久?