Python数据可视化：SVM算法实现光学字符识别（实战篇—3）

不脱发的程序猿

已于 2023-02-28 22:47:56 修改

阅读量2.4w

点赞数 8

分类专栏：人工智能 Python数据分析与可视化文章标签： SVM算法光学字符识别 Python 神经网络

于 2021-04-05 22:48:56 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/m0_38106923/article/details/115449342

版权

Python数据分析与可视化同时被 2 个专栏收录

15 篇文章 ¥49.90 ¥99.00

订阅专栏

14 篇文章

订阅专栏

本文通过Python使用SVM算法在UCI的Letter Recognition数据集上进行光学字符识别（OCR）实战，探讨了核函数选择、惩罚参数C的影响，最终模型在测试集上的正确率达到了97.63%。

摘要生成于 C知道，由 DeepSeek-R1 满血版支持，前往体验 >

目录

1、数据来源

2、数据预处理

3、模型训练

4、模型性能评估

5、模型性能提升

5.1、核函数的选取

5.2、惩罚参数C的选取

OCR （Optical Character Recognition，光学字符识别）是指电子设备（例如扫描仪或数码相机）检查纸上打印的字符，通过检测暗、亮的模式确定其形状，然后用字符识别方法将形状翻译成计算机字符的过程；即，针对印刷体字符，采用光学的方式将纸质文档中的文字转换成为黑白点阵的图像文件，并通过字符识别模型将图像中的文字处理成文本格式。

光学字符识别是OCR的核心，然而对于许多类型的机器学习算法来说，这种图像处理都是一项艰巨的任务。将像素模式连接到更高概念的关系是极其复杂的，而且很难定义。例如，让一个人识别一张面孔、一只猫或字母A是容易的，但用严格的规则来定义这些模式是很困难的。此外，图像数据往往是噪声数据，对于光学字符图像，灯光、定位和对象的位置都能影响最终的图像数据。

支持向量机非常适合处理图像数据，它能够学习复杂的图案而不需要对噪声数据过度敏感，能够以较高的准确度识别光学图案。

1、数据来源

本博文中，将使用UCI公开的光学字符识别数据集（

了解本专栏

评论 5

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

不脱发的程序猿 亲，赏包辣条吧~

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。