如图:
[attachment=29990]
Mini Ocr进行汉字识别的策略:
1、采用复合特征的分类方法。
2、字符集选择3755个一级汉字。
3、字体选择最常用的宋体。
4、字号选择从小五号到一号汉字,主要针对20个点之内的小字体。
5、英汉混排时,汉语优先。
6、汉字粘连时,进行动态优化切分。
展望与下一步的开发计划:
1、重新优化英文识别的算法;
2、对英文粘连的切分算法进行调整;
3、移植进入Linux;
如果您选择Ocr软件,目的是用来识别扫描仪出来打印字体,推荐还是选用知名的商业Ocr。如果您要识别屏幕上显示的汉字,Mini Ocr是一个比较不错的选择。真诚地希望您在使用中,能喜欢上它!
本部分内容设定了隐藏,需要回复后才能看到