热门标签 | HotTags
当前位置:  开发笔记 > 人工智能 > 正文

【统计学习方法】感知机

感知机(perceptron)是二分类的线性分类模型,其输入为实例的特征向量,输出为实例的类别,取+1和-1二值。感知机对应于输入空间(特征空间)中将实例划分为正负两类的分离超平面

感知机(perceptron)是二分类的线性分类模型,其输入为实例的特征向量,输出为实例的类别,取+1和-1二值。感知机对应于输入空间(特征空间)中将实例划分为正负两类的分离超平面,属于判别模型。感知机学习旨在求出将训练数据进行线性划分的分离超平面,为此,导入基于误分类的损失函数,利用梯度下降法对损失函数进行极小化,求得感知机模型。


感知机模型

假设输入空间(特征空间)X = R^n,输出空间Y = {-1,+1}。输入x∈X表示实例的特征向量,对应于输入空间(特征空间)的点;y∈Y表示实例的类别。

则输入空间到输出空间的如下函数:

                                                                             

 

 称为感知机。 其中,w,b为感知机模型参数,w属于R^n叫权值(weight)或权值向量(weight vector),b∈R称为偏置(bias)。

sign是符号函数:

                                                                              

 

 感知机的假设空间是定义在特征空间的所有线性分类模型:

                                                                              

 


 


感知机学习策略

 给定一个线性可分数据集:

                                             

 

 损失函数设为误分类点个数:

                                                                              

 

 则损失函数不可导,不方便优化,故更改为:

                                                                               

其中,误分类点的集合M:

                                                                             

 

 


感知机学习算法

感知机学习算法等价于求以下损失函数极小化问题的解:                                          

                                                                             

 

采用随机梯度下降(stochastic gradient descent): 任取一个超平面w0, b0, 然后利用随机梯度下降不断的极小化损失函数——一次随机选取一个误分类点使其梯度下降。

损失函数梯度:

                                                                            

 

 随机选取误分类点,对w,b进行更新:

 

                                                                       

 

 式中表示步长,又称学习率(learning rate)

 

 

 算法1(原始形式):

 输入:训练数据集,其中  学习率

 

 输出:w,b: 感知机模型

 (1)选取初值w0, b0;

 (2)在训练集选取数据

 

 (3)如果,

 

                                                                           

 (4)转至(2),直到训练集中没有误分类点

 

算法2(对偶形式):

 输入:训练数据集,其中  学习率

 输出:a,b: 感知机模型

 

 (1)

 (2)训练集中选取数据

 (3)如果

 

                                                                        

 

 (4)转至(2)直至没有误分数据

对偶形式中训练实例仅以内积形式出现, 为方便,可以预先将训练集中实例间的内积计算出来并以矩阵形式储存——Gram矩阵:

                                                                          

 

 

可以证明,感知机学习算法收敛。

 



推荐阅读
  • 深入理解OAuth认证机制
    本文介绍了OAuth认证协议的核心概念及其工作原理。OAuth是一种开放标准,旨在为第三方应用提供安全的用户资源访问授权,同时确保用户的账户信息(如用户名和密码)不会暴露给第三方。 ... [详细]
  • 本文详细探讨了KMP算法中next数组的构建及其应用,重点分析了未改良和改良后的next数组在字符串匹配中的作用。通过具体实例和代码实现,帮助读者更好地理解KMP算法的核心原理。 ... [详细]
  • 1:有如下一段程序:packagea.b.c;publicclassTest{privatestaticinti0;publicintgetNext(){return ... [详细]
  • C++实现经典排序算法
    本文详细介绍了七种经典的排序算法及其性能分析。每种算法的平均、最坏和最好情况的时间复杂度、辅助空间需求以及稳定性都被列出,帮助读者全面了解这些排序方法的特点。 ... [详细]
  • 本文介绍如何利用动态规划算法解决经典的0-1背包问题。通过具体实例和代码实现,详细解释了在给定容量的背包中选择若干物品以最大化总价值的过程。 ... [详细]
  • 本文详细探讨了Java中的24种设计模式及其应用,并介绍了七大面向对象设计原则。通过创建型、结构型和行为型模式的分类,帮助开发者更好地理解和应用这些模式,提升代码质量和可维护性。 ... [详细]
  • 本文介绍了Java并发库中的阻塞队列(BlockingQueue)及其典型应用场景。通过具体实例,展示了如何利用LinkedBlockingQueue实现线程间高效、安全的数据传递,并结合线程池和原子类优化性能。 ... [详细]
  • 题目描述:给定n个半开区间[a, b),要求使用两个互不重叠的记录器,求最多可以记录多少个区间。解决方案采用贪心算法,通过排序和遍历实现最优解。 ... [详细]
  • 深入理解C++中的KMP算法:高效字符串匹配的利器
    本文详细介绍C++中实现KMP算法的方法,探讨其在字符串匹配问题上的优势。通过对比暴力匹配(BF)算法,展示KMP算法如何利用前缀表优化匹配过程,显著提升效率。 ... [详细]
  • 探讨一个显示数字的故障计算器,它支持两种操作:将当前数字乘以2或减去1。本文将详细介绍如何用最少的操作次数将初始值X转换为目标值Y。 ... [详细]
  • 本文详细介绍了Java编程语言中的核心概念和常见面试问题,包括集合类、数据结构、线程处理、Java虚拟机(JVM)、HTTP协议以及Git操作等方面的内容。通过深入分析每个主题,帮助读者更好地理解Java的关键特性和最佳实践。 ... [详细]
  • 本文探讨如何设计一个安全的加密和验证算法,确保生成的密码具有高随机性和低重复率,并提供相应的验证机制。 ... [详细]
  • 深入解析:手把手教你构建决策树算法
    本文详细介绍了机器学习中广泛应用的决策树算法,通过天气数据集的实例演示了ID3和CART算法的手动推导过程。文章长度约2000字,建议阅读时间5分钟。 ... [详细]
  • 在金融和会计领域,准确无误地填写票据和结算凭证至关重要。这些文件不仅是支付结算和现金收付的重要依据,还直接关系到交易的安全性和准确性。本文介绍了一种使用C语言实现小写金额转换为大写金额的方法,确保数据的标准化和规范化。 ... [详细]
  • 在给定的数组中,除了一个数字外,其他所有数字都是相同的。任务是找到这个唯一的不同数字。例如,findUniq([1, 1, 1, 2, 1, 1]) 返回 2,findUniq([0, 0, 0.55, 0, 0]) 返回 0.55。 ... [详细]
author-avatar
phpxiaoxuesheng
这个家伙很懒,什么也没留下!
PHP1.CN | 中国最专业的PHP中文社区 | DevBox开发工具箱 | json解析格式化 |PHP资讯 | PHP教程 | 数据库技术 | 服务器技术 | 前端开发技术 | PHP框架 | 开发工具 | 在线工具
Copyright © 1998 - 2020 PHP1.CN. All Rights Reserved | 京公网安备 11010802041100号 | 京ICP备19059560号-4 | PHP1.CN 第一PHP社区 版权所有