Python知识分享网 - 专业的Python学习网站 学Python,上Python222
机器学习配套笔记 PDF 下载
匿名网友发布于:2025-05-25 10:33:51
(侵权举报)
(假如点击没反应,多刷新两次就OK!)

机器学习配套笔记 PDF 下载 图1

 

 

资料内容:

 

1.3 监督学习

在这段视频中,我要定义可能是最常见一种机器学习问题:那就是监督学习。我将在后
面正式定义监督学习。
我们用一个例子介绍什么是监督学习把正式的定义放在后面介绍。假如说你想预测房价。
前阵子,一个学生从波特兰俄勒冈州的研究所收集了一些房价的数据。你把这些数据画
出来,看起来是这个样子:横轴表示房子的面积,单位是平方英尺,纵轴表示房价,单位是
千美元。那基于这组数据,假如你有一个朋友,他有一套 750 平方英尺房子,现在他希望把
房子卖掉,他想知道这房子能卖多少钱。
那么关于这个问题,机器学习算法将会怎么帮助你呢?
我们应用学习算法,可以在这组数据中画一条直线,或者换句话说,拟合一条直线,根
据这条线我们可以推测出,这套房子可能卖$150,000,当然这不是唯一的算法。可能还有更
好的,比如我们不用直线拟合这些数据,用二次方程去拟合可能效果会更好。根据二次方程
的曲线,我们可以从这个点推测出,这套房子能卖接近$200,000。稍后我们将讨论如何选择
学习算法,如何决定用直线还是二次方程来拟合。两个方案中有一个能让你朋友的房子出售
得更合理。这些都是学习算法里面很好的例子。以上就是监督学习的例子。
可以看出,监督学习指的就是我们给学习算法一个数据集。这个数据集由正确答案
成。在房价的例子中,我们给了一系列房子的数据,我们给定数据集中每个样本的正确价格,
即它们实际的售价然后运用学习算法,算出更多的正确答案。比如你朋友那个新房子的价格。
用术语来讲,这叫做回归问题。我们试着推测出一个连续值的结果,即房子的价格。
一般房子的价格会记到美分,所以房价实际上是一系列离散的值,但是我们通常又把房
价看成实数,看成是标量,所以又把它看成一个连续的数值。
回归这个词的意思是,我们在试着推测出这一系列连续值属性。
我再举另外一个监督学习的例子。我和一些朋友之前研究过这个。假设说你想通过查看
病历来推测乳腺癌良性与否,假如有人检测出乳腺肿瘤,恶性肿瘤有害并且十分危险,而良
性的肿瘤危害就没那么大,所以人们显然会很在意这个问题。