有监督学习:对具有概念标记(分类)的训练样本进行学习,以尽可能对训练样本集外的数据进行标记(分类)预测。这里,所有的标记(分类)是已知的。因此,训练样本的岐义性低。
无监督学习:对没有概念标记(分类)的训练样本进行学习,以发现训练样本集中的结构性知识。这里,所有的标记(分类)是未知的。因此,训练样本的岐义性高。聚类就是典型的无监督学习
机器学习中的方法或范式(paradigm)有很多种分类体系,例如从学习的方式分,有例子中学习、类比学习、分析学习等,但一般来说,现在研究得最多、被认为最有用的是从例子中学习。对从例子中学习,又有很多分类方法,例如从学习的主动性方面,可以分为主动学习和被动学习;从训练过程启动的早晚,可以分为迫切学习和惰性学习等等。最常见的对“从例子中学习”的方法的分类是监督学习、非监督学习和强化学习,这是从训练样本的歧义性(ambiguity)来进行分类的。对监督学习来说,它通过对具有概念标记(concept label)的训练例进行学习,以尽可能正确地对训练集之外的示例的概念标记进行预测。这里所有训练例的概念标记都是已知的,因此训练样本的歧义性最低。
对非监督学习来说,它通过对没有概念标记的训练例进行学习,以发现训练例中隐藏的结构性知识。这里的训练例的概念标记是不知道的,因此训练样本的歧义性最高。对强化学习来说,它通过对没有概念标记、但与一个延迟奖赏或效用(可视为延迟的概念标记)
相关联的训练例进行学习,以获得某种从状态到行动的映射。这里本来没有概念标记的概念,但延迟奖赏可被视为一种延迟概念标记,因此其训练样本的歧义性介于监督学习和非监督学习之间。
需要注意的是,监督学习和非监督学习从一开始就是相对的,而强化学习在提出时并没有从训练样本歧义性的角度考虑其与监督学习和非监督学习的区别,因此,一些早期的研究中把强化学习视为一种特殊的非监督学习。事实上,对强化学习的定位到目前仍然是有争议的,有的学者甚至认为它是与“从例子中学习”同一级别的概念。
从训练样本歧义性角度进行的分类体系,在近几年可望有一些扩展,例如多示例学习(multi-instance learning)等从训练样本歧义性方面来看很特殊的新的学习框架有可能会进入该体系。但到目前为止,没有任何新的框架得到了公认的地位。另外,半监督学习(semi-supervised learning)也有一定希望,它的障碍是半监督学习中的歧义性并不是与生俱来的,而是人为的,即用户期望用未标记的样本来辅助对已标记样本的学习。这与监督学习、非监督学习、强化学习等天生的歧义性完全不同。半监督学习中人为的歧义性在解决工程问题上是需要的、有用的(对大量样本进行标记的代价可能是极为昂贵的),但可能不太会导致方法学或对学习问题视点的大的改变。
不同的分类体系是相交的,例如,监督学习方法既可能是迫切的(例如大多数神经网络、决策树等),也可能是惰性的(例如k近邻等)。另外,分类体系也不是绝对的,例如前面提到的强化学习的情况。
相关推荐
机器学习两种方法——监督学习和无监督学习(通俗理解).pdf机器学习两种方法——监督学习和无监督学习(通俗理解).pdf机器学习两种方法——监督学习和无监督学习(通俗理解).pdf机器学习两种方法——监督学习和无监督...
深度学习 监督学习 人工神经网络 模式识别
支持向量机,监督学习与无监督学习的描述。
机器学习入门的可以看一看,作者呕心沥血整理的资源,学习的可以看一看,里面包括机器学习历年来的发展,机器学习的分支,传统机器学习算法和无监督学习,监督学习和强化学习相关定义等等
无监督学习是机器学习的一个重要分支,其在机器学习、数据挖掘、生物医学大数据分析、数据科学等领域有着重要地位。本书阐述作者近年在无监督学习领域所取得的主要研究成果,包括次胜者受罚竞争学习算法、K-means...
监督学习、无监督学习与强化学习
有监督学习和无监督学习的比较,主要是用于金融方面的预测
有关机器 学习的基本介绍,比如机器学习是分为监督学习和无监督学习的,以及监督学习中的一些算法,有分类算法和数值型预测算法,分类算法中几种比较经典的算法
半监督学习图书半监督学习图书半监督学习图书半监督学习图书半监督学习图书
高级人工智能PPT,章节无监督学习,共100多页,需要的自取
深度学习无监督学习算法研究.pdf
机器学习——无监督学习与预处理.
自监督学习作为一种新的学习方法,近几年在表征学习方面取得了骄人的成绩,其利用输入数据本身作为监督,并使得几乎所有类型的下游任务都受益。
深度学习中的无监督学习方法综述.pdf
半监督学习和主动学习相结合的浅层语义分析.pdf半监督学习和主动学习相结合的浅层语义分析.pdf
机器学习,监督学习,无监督学习,推荐系统,深度学习,python,代码实战,数据挖掘,sklearn库,
【毕业设计】基于半监督学习和集成学习的情感分析研究源码【毕业设计】基于半监督学习和集成学习的情感分析研究源码【毕业设计】基于半监督学习和集成学习的情感分析研究源码【毕业设计】基于半监督学习和集成学习的...
神经网络有监督学习 异或函数 反向传播的工作原理 RecognizeIt——鼠标手势的识别 一些有用的技术和技巧 监督学习的应用
半监督学习方法.pdf