Python----Kernel SVM

什么是kernel

Kernel的其实就是将向量feature转换与点积运算合并后的运算，如下，

概念上很简单，但是并不是所有的feature转换函数都有kernel的特性。

常见kernel

常见kernel有多项式，高斯和线性，各有利弊。

kernel SVM

在非线性的SVM算法中，如何将一组线性不可分的数据，利用从低维到高维的投射，使它变成在高维空间中线性可分的数据。将已经分割好的数据，投射回到原先的空间，及低维空间。

（1）一维空间

一维空间中的线性分类，找是否从在一个点，使一边都是红，一边都是绿，显然这样的线性分类器是不存在的。所以将数据投射到二维的空间里，例如：

（2）二维

投射，保持X1轴和X2轴不变，增加第三个轴，将X1，X2两个点投射到一个三维空间里，前两个维度不变，第三个z与X1，X2有关系；在新的三维空间里，绿色和红色就变成了线性可分。线性可分在不是二维的空间中，有一个超平面，将两组数据分开。

（3）反向投射

三维空间中找到的分割的平面，与数据本身结构，根据这两个信息，找出在原来数据空间二维空间中的分类界线。

核技巧在非线性SVM的应用

（1）非线性SVM最常用的核方程：

假设只有一个自变量X，而l已定，看成一个关于X的函数，此时的函数在空间中的形态

l点就是（0,0）这个点

利用高斯核函数算出分类函数：

绿点所对应的高斯核函数的值，坐落在白色圈的里面（小山上）；红点所对应的高斯核函数的值，坐落在周围深蓝色图像上。做出的投影图。

σ：控制圈的半径（大小）

（2）较复杂的二维

此时的核函数

实例

数据集

# Importing the libraries

import numpy as np

import matplotlib.pyplot as plt

import pandas as pd

# Importing the dataset

dataset = pd.read_csv('Social_Network_Ads.csv')

X = dataset.iloc[:, [2,3]].values

y = dataset.iloc[:, 4].values

# Splitting the dataset into the Training set and Test set

from sklearn.model_selection import train_test_split

X_train, X_test, y_train, y_test = train_test_split(X, y, test_size = 0.25, random_state = 0)

# Feature Scaling

from sklearn.preprocessing import StandardScaler

sc_X = StandardScaler()

X_train = sc_X.fit_transform(X_train)

X_test = sc_X.transform(X_test)

# Fitting Logistic Regression to the Training set

#训练集拟合SVM的分类器

#从模型的标准库中导入需要的类

from sklearn.svm import SVC

#创建分类器

classifier = SVC(kernel = 'rbf', random_state = 0)#rbf运用了高斯核

#运用训练集拟合分类器

classifier.fit(X_train, y_train)

# Predicting the Test set results

#运用拟合好的分类器预测测试集的结果情况

#创建变量（包含预测出的结果）

y_pred = classifier.predict(X_test)

# Making the Confusion Matrix

#通过测试的结果评估分类器的性能

#用混淆矩阵，评估性能

#65,24对应着正确的预测个数；8,3对应错误预测个数；拟合好的分类器正确率：（65+24）/100

from sklearn.metrics import confusion_matrix

cm = confusion_matrix(y_test, y_pred)

# Visualising the Training set results

#在图像看分类结果

from matplotlib.colors import ListedColormap

#创建变量

X_set, y_set = X_train, y_train

#x1,x2对应图中的像素；最小值-1，最大值+1，-1和+1是为了让图的边缘留白，像素之间的距离0.01；第一行年龄，第二行年收入

X1, X2 = np.meshgrid(np.arange(start = X_set[:, 0].min() - 1, stop = X_set[:, 0].max() + 1, step = 0.01),

                     np.arange(start = X_set[:, 1].min() - 1, stop = X_set[:, 1].max() + 1, step = 0.01))

#将不同像素点涂色，用拟合好的分类器预测每个点所属的分类并且根据分类值涂色

plt.contourf(X1, X2, classifier.predict(np.array([X1.ravel(), X2.ravel()]).T).reshape(X1.shape),

             alpha = 0.75, cmap = ListedColormap(('red', 'green')))

#标注最大值及最小值

plt.xlim(X1.min(), X1.max())

plt.ylim(X2.min(), X2.max())

#为了滑出实际观测的点（黄、蓝）

for i, j in enumerate(np.unique(y_set)):

    plt.scatter(X_set[y_set == j, 0], X_set[y_set == j, 1],

                c = ListedColormap(('orange', 'blue'))(i), label = j)

plt.title('Classifier (Training set)')

plt.xlabel('Age')

plt.ylabel('Estimated Salary')

#显示不同的点对应的值

plt.legend()

#生成图像

plt.show()

# Visualising the Test set results

from matplotlib.colors import ListedColormap

X_set, y_set = X_test, y_test

X1, X2 = np.meshgrid(np.arange(start = X_set[:, 0].min() - 1, stop = X_set[:, 0].max() + 1, step = 0.01),

                     np.arange(start = X_set[:, 1].min() - 1, stop = X_set[:, 1].max() + 1, step = 0.01))

plt.contourf(X1, X2, classifier.predict(np.array([X1.ravel(), X2.ravel()]).T).reshape(X1.shape),

             alpha = 0.75, cmap = ListedColormap(('red', 'green')))

plt.xlim(X1.min(), X1.max())

plt.ylim(X2.min(), X2.max())

for i, j in enumerate(np.unique(y_set)):

    plt.scatter(X_set[y_set == j, 0], X_set[y_set == j, 1],

                c = ListedColormap(('orange', 'blue'))(i), label = j)

plt.title('Classifier (Test set)')

plt.xlabel('Age')

plt.ylabel('Estimated Salary')

plt.legend()

plt.show()

训练集图像显示结果：

测试集图像显示结果：

Python----Kernel SVM的更多相关文章

Kernel Methods (4) Kernel SVM
(本文假设你已经知道了hard margin SVM的基本知识.) 如果要为Kernel methods找一个最好搭档, 那肯定是SVM. SVM从90年代开始流行, 直至2012年被deep lea ...
Python实现SVM(支持向量机)
Python实现SVM(支持向量机) 运行环境 Pyhton3 numpy(科学计算包) matplotlib(画图所需,不画图可不必) 计算过程 st=>start: 开始 e=>end ...
基于Python使用SVM识别简单的字符验证码的完整代码开源分享
关键字:Python,SVM,字符验证码,机器学习,验证码识别 1 概述基于Python使用SVM识别简单的验证字符串的完整代码开源分享. 因为目前有了更厉害的新技术来解决这类问题了,但是本文作 ...
（转载）python应用svm算法过程
除了在Matlab中使用PRTools工具箱中的svm算法,Python中一样可以使用支持向量机做分类.因为Python中的sklearn库也集成了SVM算法,本文的运行环境是Pycharm. 一.导 ...
jupyter notebook添加Anaconda虚拟环境的python kernel
之前在自己博客上写了一个如何通过自建配置文件,让jupyter notebook可以调用conda虚拟环境的python解释器. 今天介绍一种更加简单的方式,无需手动配置文件,利用ipykernel可 ...
基于jupyter lab搭建网页编程环境并添加自定义python kernel和matlab kernel以及plotly的使用
内容转载自我的博客目录说明 1. 创建虚拟环境jupyter 2. 安装nodejs(用于jupyterlab安装扩展) 3. 安装pip包 4. 使用jupyterlab 5. 配置jupyte ...
【367】通过 python 实现 SVM 硬边界算法
参考: 支持向量机整理 SVM 硬边界的结果如下: $$min \quad \frac{1}{2} \sum_{i=1}^m\sum_{j=1}^m \alpha_i\alpha_jy_iy_j \v ...
机器学习经典算法详解及Python实现--基于SMO的SVM分类器
原文:http://blog.csdn.net/suipingsp/article/details/41645779 支持向量机基本上是最好的有监督学习算法,因其英文名为support vector ...
机器学习——SVM详解（标准形式，对偶形式，Kernel及Soft Margin）
(写在前面:机器学习入行快2年了,多多少少用过一些算法,但由于敲公式太过浪费时间,所以一直搁置了开一个机器学习系列的博客.但是现在毕竟是电子化的时代,也不可能每时每刻都带着自己的记事本.如果可以掏出手 ...
SVM之Python实现
SVM Python实现 Python实现SVM的理论知识 SVM原始最优化问题: \[ min_{w,b,\xi}{1\over{2}}{||w||}^2 + C\sum_{i=1}^m\xi^{( ...

随机推荐

生产环境中学习Redis
摘要看到这篇文章,很有借鉴意义,因此写个读书笔记,不算是翻译.想要深入了解,请看原文http://tech.trivago.com/2017/01/25/learn-redis-the-hard-w ...
[intellij IDEA]导入eclipse项目
1.因为最近eclipse在更新代码时经常卡死,就想将eclipse的项目迁移到idea.特意写下自己的经验,给迁移时遇到困难的朋友一些帮助 File -> new ->project f ...
Java中食之无味弃之可惜的数组
在Java的泛型出现之前,只有数组可以用来存储指定类型的对象:在自动装箱机制出现之前,只有数组可以用来存储基本数据类型:也就是说,在泛型和自动装箱机制出现之前,数组在Java当中的分量举足轻重. 况且 ...
.net core自定义高性能的Web API服务网关
网关对于服务起到一个统一控制处理的作用,也便于客户端更好的调用:通过网关可以灵活地控制服务应用接口负载,故障迁移,安全控制,监控跟踪和日志处理等.由于网关在性能和可靠性上都要求非常严格,所以针对业务需 ...
Gulp(自动化构建工具 )
前言 Gulp,简而言之,就是前端自动化开发工具,利用它,我们可以提高开发效率. 比如: 1. 压缩js 2. 压缩css 3. 压缩less 4. 压缩图片等等… 我们完全可以利用Gulp ...
Asp.Net Core 轻松学-在.Net Core 使用缓存和配置依赖策略
前言几乎在所有的应用程序中,缓存都是一个永恒的话题,恰当的使用缓存可以有效提高应用程序的性能:在某些业务场景下,使用缓存依赖会有很好的体验:在 Asp.Net Core 中,支持了多种缓存组 ...
（四）surging 微服务框架使用系列之网关
一.什么是API网关 API网关是一个服务器,是系统对外的唯一入口.API网关封装了系统内部架构,为每个客户端提供一个定制的API.API网关方式的核心要点是,所有的客户端和消费端都通过统一的网关接入 ...
点击菜单选项，右侧主体区新增子界面（Tab）的实现
今天是2019年小年后一天,还有三天回家过年. 今天记录一下一种前端页面的效果的实现,这种效果很常见,一般用于网站后台系统的前端页面.一般后台系统会分为顶部导航栏,左边的菜单栏和右边的主体区.有一种效 ...
前端入门24-响应式布局（BootStrap）
声明本篇内容摘抄自以下两个来源: BootStrap中文网感谢大佬们的分享. 正文-响应式布局(BootStrap) 这次想来讲讲一个前端开发框架:BootStrap BootStrap 目前已经 ...
noi.ac#309 Mas的童年(子集乱搞)
题意题目链接 Sol 记$s_i$表示前$i$个数的前缀异或和,我们每次相当于要找一个$j$满足$0 < j < i$且\((s_i \oplus s_j) + s_j\ ...

Python----Kernel SVM

Python----Kernel SVM的更多相关文章

随机推荐

热门专题