用人话讲明白支持向量机SVM(下)

本文为博客 VIP 文章,开通 VIP 后可阅读全文

开通 VIP



4.求解超平面

上篇仅介绍了SVM的基本概念,本篇着重讲解SVM中的最佳线性分类器(最大边界超平面)是如何求得的。

4.1几何间隔

上一小节给出二维问题下最佳线性分割的标准就是分割线到两类边界点的距离最“宽”,那么这个“宽度”怎么量化和求解呢?

我们知道,点 ( x 0 , y 0 ) (x_{0} ,y_{0}) (x0,y0)到直线 A x + B y + c = 0 Ax+By+c=0 Ax+By+c=0的距离(中学的知识点),可以表示为:
D = ∣ A x 0 + B y 0 + c ∣ A 2 + B 2 D=\frac{|Ax_{0}+By_{0}+c|} {\sqrt{A^{2}+B^{2}}} D=A2+B2 Ax0+By0+c

在我们的二维问题中,第i个点的坐标为 X i = ( x i 1 , x i 2 ) T X_{i}=(x_{i1},x_{i2})^{T} Xi=(xi1,xi2)T,直线为 w 1 x 1 + w 2 x 2 + b = W T X + b = 0 w_{1}x_{1}+w_{2}x_{2}+b=W^{T}X+b=0 w1x1+w2x2+b=WTX+b=0(为了打公式方便,后面我们不区分向量和其转置,省略T标志,统一写成 W X + b = 0 WX+b=0 WX+b=0),将上式替换, X i X_{i} Xi到分割直线的距离为:
D = ∣ W X i + b ∣ w 1 2 + w 2 2 = ∣ W X i + b ∣ ∣ ∣ W ∣ ∣ D=\frac{|WX_{i}+b|} {\sqrt{w_{1}^{2}+w_{2}^{2}}}=\frac{|WX_{i}+b|} {||W||} D=w12+w22 WXi+b=WWXi+b

有的人也许对分母||W||感到陌生,这里多做点解释。

||W||是向量W的2-范数( L 2 L_{2} L2范数),一般我们说向量长度指的是向量的2-范数。例如这里的 W = ( w 1 , w 2 ) W=(w_{1},w_{2}) W=(w1,w2),它的2-范数就是 ∣ ∣ W ∣ ∣ 2 = w 1 2 + w 2 2 ||W||_{2}=\sqrt{w_{1}^{2}+w_{2}^{2}} W2=w12+w22 (通常会省略下标2,一般说||W||就是指 ∣ ∣ W ∣ ∣ 2 ||W||_{2} W2),而它的p-范数( L p L_{p} Lp范数)就是 ∣ ∣ W ∣ ∣ p = w 1 p + w 2 p p ||W||_{p}=\sqrt[p]{w_{1}^{p}+w_{2}^{p}} Wp=pw1p+w2p

这里给出向量范数的一般形式:对于n维向量 W = ( w 1 , w 2 , . . . , w n ) W=(w_{1},w_{2},...,w_{n})

用人明白机器学习MachineLearning 目录 1.什么是机器学习 2.机器学习的种类 3.相关名词释义 1. 什么是机器学习 人的一生在不断学习,广义的学习包含观察世界、认识世界、形成世界观、改造世界的过程。我们通过眼睛观察生活,通过大脑思考其中的联系和规律,从而规划自己的人生路径,这是人的学习。我们总结自己和前人的经验,未来生活中遇到类似的事情,能够找到应对之法,这也是人的学习。 机器学习与人的学习一样,只不过学习主体从人变成了计算... 阅读详情

相关推荐

历经一个月,终于搞定了SVM(支持向量机)-附源代码解析

其实整体算下来,断断续续的也得有快两个月了(原谅博主比较笨)。中间也有好几次放弃,不想写这篇总结了,但是之前立下的誓言,要将学习到的每一个机器学习算法写成博客总结,一方面呢,检验自己是否真的明白了,另一方面,也希望自己的理解能够帮助到一些人。

梁先森的博客 3万+

机器学习算法理论+实战之支持向量机SVM

1. 写在前面 如果想从事数据挖掘和数据分析的工作,掌握常用的机器学习算法是非常有必要的,比如我之前写过的一篇十大机器学习算法的小总结,在这简单的先捋一捋, 常见的机器学习算法: 监督学习算法:逻辑回归,线性回归,决策树,朴素贝叶斯,K近邻,支持向量机,集成算法Adaboost等 无监督算法:聚类,降维,关联规则, PageRank等 为了详细的理解这些,曾经看过西瓜书,统计学习方法,机器学习...

Miracle8070 5913

支持向量机SVM①——Sklearn核函数参数介绍(线性&高斯&多项式&sigmond)

本来想先写一篇支持向量机的原理篇,结果在白天钻研,晚上做梦都在思考的2周后,还是没有搞太明白,实在是见识到了人类智慧的博大精深和自我的渺小。因此我还是先从应用下手,先用到慢慢体会好了。本篇主要介绍sklearn库的svm的分类和回归参数,其中重点介绍四大核函数的参数。 之前在未调参的情况下将svm和决策树、贝叶斯进行了分类对比,发现训练器分数巨低,且训练过程时间是真的长,长到怀疑人生。所以想要SV...

cindy407的博客 2万+

机器学习故事汇-搞定支持向量机SVM

一听到支持向量机这个名字,给大家的感觉应该是这个样子滴,感觉好像很高端一个事情,但是又不知道它到底在什么。咱们今天的目标就是用最通俗的语言搞定它! 首先我们来看一下咱们的支持向量机是要打算干一个什么大事情!其实我第一次听到这个名字的时候最想搞清楚的就是它为啥起了个这么个怪名字(看完你就懂啦)!对于一个分类任务而言,最主要的目标就是能分得开,但是对于上图当中的两类数据点来说,我可以找到

mmp591的博客 364

svm分类器_用人明白支持向量机SVM(上)

特别说明:文中含有大量公式,只能转化为图片后才能正常显示,造成阅读不畅请谅解。文章目录·1.什么是SVM·2.线性分类器的含义3.怎么找线性分类器1.什么是SVMSVM支持向量机,号称机器学习的拦路虎。江湖传言,遇到了他,机器学习就会从入门到放弃。另一方面也就是说,只要搞定了SVM,后面的算法模型学起来都是小意思。那我们就先打虎,再盘后面的小猫咪。由于SVM较复杂,我分两篇来进行阐述,本篇仅介绍S...

weixin_39990029的博客 250

支持向量机通俗导论(理解SVM的三层境界)

支持向量机通俗导论(理解SVM的三层境界) 作者:July、pluskid ;致谢:白石、JerryLead 出处:结构之法算法之道blog。 前言     动笔写这个支持向量机(support vector machine)是费了不少劲和困难的,原因很简单,一者这个东西本身就并不好懂,要深入学习和研究下去需花费不少时间和精力,二者这个东西也不好

Mac Track 33万+

SVM支持向量机)详解

SVM 1、支持向量机发展历史 1963年,Vapnik在解决模式识别问题时提出了支持向量方法。起决定性作用的样本为支持向量 1971年,Kimeldorf构造基于支持向量构建核空间的方法 1995年,Vapnik等人正式提出统计学习理论。 通俗来SVM是一种二类分类模型,其基本模型定义为特征空间上的间隔最大的线性分类器,即支持向量机的学习策略便是间隔最大化,

wqthaha的专栏 3万+

支持向量机松弛变量的理解

首先要清楚: 1,线性可分,即能找到超平面,对于硬间隔支持向量机 2,部分点不可分,总体近似可分,近似线性可分,对应软间隔支持向量机 3,线性不可分,需要用到核函数 软间隔支持向量机要加个松弛变量ξ。 我们都知道,硬间隔满足,yi * ( wi * x + b )≥1,这是函数间隔,是几何间隔的||w|| 倍。 由于一些点出现在两条线的间隔内部,函数间隔的约束条...

ustbbsy的博客 2万+

【数模百科】支持向量机SVM如何处理非线性数据——非线性SVM(python代码实现)

非线性支持向量机,是从原始的线性支持向量机演化而来的,与线性支持向量机的主要区别在于它可以处理非线性可分的数据集。这是通过使用一种所谓的“核技巧(Kernel trick)”来实现的。原始的线性支持向量机试图在样本的特征空间中寻找一个线性超平面,可以最大化地分隔两个类别的样本。然而,在实际情况中,我们经常会遇到一些问题,其中两个类别的样本无法通过一个线性超平面来完全分隔。

weixin_62457573的博客 2017

用人明白线性回归LinearRegression

目录 什么是回归 一元线性回归 损失函数 最小二乘估计 小结 1. 什么是回归 当我们学习一门新课程、接触一个新专业时,总会对该领域的专有名词感到困惑,甚至看完解释仍难以理解其含义。在我们一起学习machine learning的过程中,我会尽量对相关名词用“人”做一遍解释,以减少学习的“痛苦感”。 譬如今天要学的线性“回归”,这个回归(regression)和我们平时说的“回归祖国”的回...

化简可得 1万+

用人明白聚类算法kmeans

文章目录1.什么是聚类2.K-Means步骤3.K-Means的数学描述4.初始中心点怎么确定5.K值怎么确定6.小结 1.什么是聚类 先来回顾一下开篇就到的机器学习的种类。 监督式学习:训练集有明确答案,监督学习就是寻找问题(又称输入、特征、自变量)与答案(又称输出、目标、因变量)之间关系的学习方式。监督学习模型有两类,分类和回归。 • 分类模型:目标变量是离散的分类型变量; • 回归模型:...

化简可得 2856

用人明白逻辑回归Logistic regression

文章目录1.从线性回归说起2.sigmond函数3.推广至多元场景4.似然函数5.最大似然估计6.损失函数7.梯度下降 今天梳理一下逻辑回归,这里的“逻辑”是音译“逻辑斯蒂”的缩写,并不是说这个算法具有怎样的逻辑性。该算法由于简单、实用、高效,在业界应用十分广泛。 前面说过,机器学习算法中的监督式学习可以分为2大类: 分类模型:目标变量是分类变量(离散值); 回归模型:目标变量是连续性数值变量...

化简可得 1314

用人明白梯度下降Gradient Descent(以求解多元线性回归参数为例)

文章目录1.梯度2.梯度下降 梯度下降算法在机器学习中出现频率特别高,是非常常用的优化算法。 本文借多元线性回归,用人解释清楚梯度下降的原理和步骤。 1.梯度 梯度是什么呢? 我们还是从最简单的情况说起,对于一元函数来,梯度就是函数的导数。 而对于多元函数而言,梯度是一个向量,也就是说,把求得的各个偏导数以向量的形式写出来,就是梯度。 例如,我们在用人明白线性回归LinearRegre...

化简可得 1183

用人明白近邻算法KNN

文章目录1.什么是聚类2.K-Means步骤6.小结 1.什么是聚类 先来回顾一下开篇就到的机器学习的种类。 监督式学习:训练集有明确答案,监督学习就是寻找问题(又称输入、特征、自变量)与答案(又称输出、目标、因变量)之间关系的学习方式。监督学习模型有两类,分类和回归。 • 分类模型:目标变量是离散的分类型变量; • 回归模型:目标变量是连续性数值型变量。 无监督学习:只有数据,无明确答案,即...

化简可得 669

机器学习复习Day4——神经网络,多分类softmax

**关键实现(今天最容易搞混的一点):** 输出层 `activation="linear"`,配 `SparseCategoricalCrossentropy(from_logits=True)`——不是直接把 softmax 当激活,而是**让损失函数在内部自动算 softmax**(`from_logits=True` 就是"我传的是没归一化的原始分数 logits,你帮我加 softmax 再算交叉熵")。- **多分类 = 从"是/不是"升级到"是哪个"。

2503_94114317的博客 425

隐私与机器学习:什么才是真正的隐私?

差分隐私使你参与数据分析的个人风险≈不参与的风险。如果你不参与研究:你的隐私风险 = 从群体结论中推断出的信息如果你参与研究(在 DP 保护下):你的隐私风险 ≈ 不参与时的风险差分隐私保证你不会因参与而变得比不参与时更容易受伤害。

ChesterXue的博客 351

生成对抗网络的变体版本

StyleGAN(及其升级版StyleGAN2、StyleGAN2-ADA)是目前最主流的选择,它本身是一个高质量的人脸生成器,但研究者们发现可以通过操控其内部的“潜在空间”(Latent Space)来精确控制生成人脸的各种属性。:一个框架,包含一组转换函数,用于在预训练好的GAN(如StyleGAN)的潜在空间中进行属性编辑,支持包括年龄和性别在内的多种属性。:一个较新的框架,结合了潜在扩散模型,能进行包括年龄、性别、表情在内的多属性、高分辨率的人脸编辑。

有的话没说出来之前,你是他的主人,一旦说出来你就成了他的奴隶||想要干好事,别太把自己当人,别把别人太不当人||认识这个人就是开了一扇窗户,就能看到不一样的东西,听到不一样的声音,能让你思考、觉悟,这已经够了 195
上一篇: 用人话讲明白支持向量机SVM(上)
下一篇: 用人话讲明白聚类算法kmeans
化简可得
博客等级 码龄7年 104粉丝 14原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值