【Datawhale X 李宏毅苹果书 AI夏令营】《深度学习详解》Task2 打卡

最新推荐文章于 2024-09-30 13:49:56 发布

mc_dl

最新推荐文章于 2024-09-30 13:49:56 发布

阅读量1k

点赞数 14

分类专栏：比赛文章标签：人工智能深度学习 Datawhale AI夏令营 Datawhale

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/mc_dl/article/details/141654577

版权

比赛专栏收录该内容

8 篇文章 0 订阅

订阅专栏

文章目录

前言
学习目标
一、线性模型
二、分段线性曲线
总结

前言

本文是【Datawhale X 李宏毅苹果书 AI夏令营】的Task2学习笔记打卡。

学习目标

李宏毅老师对应视频课程：https://www.bilibili.com/video/BV1JA411c7VT?p=3
《深度学习详解》第一章主要介绍了深度学习中的基础数学知识。

一、线性模型

经过了前面的梯度下降优化过程以后，我们得到了通过训练数据估计出来的一个数学模型，其中y（预测某天的视频观看次数）和 $x_1$ （前一天的观看次数有关）。

屏幕截图 2024-08-26 164153.png
但是视频观看次数有个周期性的规律，即一周有七天，在周末的时候，人们会去休息放松，所以学习视频的观看次数就会下降（暂时不考虑法定节假日和调休）。

屏幕截图 2024-08-29 050214.png
这些模型都是把输入的特征 x 乘上一个权重，再加上一个偏置就得到预测的结果，这样的模型称为线性模型（linear model）。接下来会看如何把线性模型做得更好。

二、分段线性曲线

对于分段线性曲线，线性模型有很大的限制，这一种来自于模型的限制称为模型的偏差，无法模拟真实的情况。

屏幕截图 2024-08-29 050642.png

分段曲线可以逼近任何连续曲线

屏幕截图 2024-08-29 134723.png
直接写 HardSigmoid 不是很容易，但是可以用一条曲线来理解它，用 Sigmoid 函数来逼近 Hard Sigmoid，如图 1.10 所示。Sigmoid 函数的表达式为
$c\frac{1}{1+e^{− (b+wx_1)}}$
屏幕截图 2024-08-29 135053.png
调整参数，可以绘制出不同的 Sigmoid 函数

屏幕截图 2024-08-29 181504.png

在机器学习里面，Sigmoid 或 ReLU 称为激活函数（activation function）。

Q: 优化是找一个可以让损失最小的参数，是否可以穷举所有可能的未知参数的值？

A：只有 w 跟 b 两个参数的前提之下，可以穷举所有可能的 w 跟 b
的值，所以在参数很少的情况下。甚至可能不用梯度下降，不需要优化的技巧。但是参数非常多的时候，就不能使用穷举的方法，需要梯度下降来找出可以让损失最低的参数。

屏幕截图 2024-08-29 181801.png

经过上面的多个sigmoid函数的计算，可以得到比较有灵活性的损失函数。

在这里插入图片描述

如下图所示，未知参数可以组合成一个向量。

在这里插入图片描述
在训练数据和测试数据上的结果是不一致的，这种情况称为过拟合（overfitting）。

总结

屏幕截图 2024-08-29 185134.png

每一排称为一层，称为隐藏层（hiddenlayer），很多的隐藏层就“深”，这套技术称为深度学习。

关注

14
点赞
踩
12

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。