我们一块来学SVM支持向量机

Escape the bug

已于 2022-03-08 10:42:22 修改

阅读量552

点赞数 1

分类专栏：神经网络文章标签： matlab 深度学习开发语言

于 2022-03-08 10:41:16 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.youkuaiyun.com/jnbfknasf113/article/details/109842415

版权

神经网络专栏收录该内容

5 篇文章

订阅专栏

SVM支持向量机

支持向量
参考文章

支持向量机（support vector machines，SVM）是一种二分类模型，它将实例的特征向量映射为空间中的一些点，SVM 的目的就是想要画出一条线，以 “最好地” 区分这两类点，以至如果以后有了新的点，这条线也能做出很好的分类。SVM 适合中小型数据样本、非线性、高维的分类问题。

支持向量

1.线性可分

在分类问题中，最简单的分类就是二分类问题，而且这个二分类问题是一个线性可分问题。
在一维空间，也就是一个坐标轴上面，要分开两个可以分开的点集合，我们只需要找到一个点，如图1：
在这里插入图片描述图1 一维线性可分示意图

在二维空间中，要分开两个线性可分的点集合，我们需要找到一条分类直线即可，如图2：
在这里插入图片描述
图2 二维线性可分示意图

在三维空间中，要分开两个线性可分的点集合，我们需要找到一个分类面:如图3：
在这里插入图片描述
图3 三维线性可分示意图

数学定义：
$D_0$ 和 $D_1$ 是 n 维欧氏空间中的两个点集。如果存在 n 维向量 w 和实数 b，使得所有属于 $D_0$ 的点 $x_i$ 都有 $wx_i+b>0$ ，而对于所有属于 $D_1$ 的点 $x_j$ 则有 $wx_j+b<0$ ，则我们称 $D_0$ 和 $D_1$ 线性可分。

2.最大间隔超平面

从二维扩展到多维空间中时，将 $D_0$ 和 $D_1$ 完全正确地划分开的 $wx_i+b=0$ 就成了一个超平面。

为了使这个超平面更具鲁棒性，我们会去找最佳超平面，以最大间隔把两类样本分开的超平面，也称之为最大间隔超平面。

两类样本分别分割在该超平面的两侧；
两侧距离超平面最近的样本点到超平面的距离被最大化了。

3.最优化问题

在这里插入图片描述

样本中距离超平面最近的一些点，这些点叫做支持向量。

SVM 想要的就是找到各类样本点到超平面的距离最远，也就是找到最大间隔超平面。任意超平面可以用下面这个线性方程来描述：

$W^Tx+b=0$

二维空间点 $(x, y)$ 到直线 $A x + B y + C = 0$ 的距离公式是：

$\cfrac{|Ax+By+C|}{\sqrt{A^2+B^2}}$

扩展到 n 维空间后，点 $x=(x_1,x_2...x_n)$ 到直线 $w^Tx+b=0$ 的距离为：

$\cfrac{|w^Tx+b|}{||w||}$

其中 $||w||=\sqrt{w_1^2+...w_n^2}$ 。

如图所示，根据支持向量的定义我们知道，支持向量到超平面的距离为 d，其他点到超平面的距离大于 d。
在这里插入图片描述
于是可以导出这个公式

$\begin{cases}\cfrac{|w^Tx+b|}{||w||}\ge d,y=+1\\\cfrac{|w^Tx+b|}{||w||}\leq d,y=-1\end{cases}$

y代表最大间隔超平面分割的两个类。

稍作转化可以得到：

$\begin{cases}\cfrac{|w^Tx+b|}{||w||d}\ge1,y=+1\\\cfrac{|w^Tx+b|}{||w||d}\leq -1,y=-1\end{cases}$

$∣ ∣ w ∣ ∣ d$ 是正数，我们暂且令它为 1（之所以令它等于 1，是为了方便推导和优化，且这样做对目标函数的优化没有影响），故：

$\begin{cases}w^Tx+b\ge1,y=+1\\w^Tx+b\leq-1,y=-1\end{cases}$

将两个方程合并，我们可以简写为：

$y(w^Tx+b)\ge1$

至此我们就可以得到最大间隔超平面的上下两个超平面：
在这里插入图片描述
每个支持向量到超平面的距离可以写为：

$d=\cfrac{|w^Tx+b|}{||w||}$

由上述 $y(w^Tx+b)>1>0$ 可以得到 $y(w^Tx+b)=|w^Tx+b|$ ，所以我们得到：

$d=\cfrac{y(w^Tx+b)}{||w||}$

最大化这个距离：

$max2*\cfrac{y(w^Tx+b)}{||w||}$

这里乘上 2 倍其实就是margin,方便后续计算。刚刚我们得到支持向量 [公式] ，所以我们得到：

$max\cfrac{2}{||w||}$

再做一个转换：

$min\cfrac{||w||}{2}$

为了方便计算（去除 $∣ ∣ w ∣ ∣$ 的根号），我们有：

$min\cfrac{||w||^2}{2}$

所以得到的最优化问题是：

$min\cfrac{||w||^2}{2} s.t.\quad y_i(w^Tx_i+b)\ge1$

未完待续--------------------

参考文章

SVM清晰讲解——线性可分问题

【机器学习】支持向量机 SVM（非常详细）

机器学习算法（一）SVM

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

Escape the bug 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。