Machine Learning - Day3 -Gradient Descent

Edible Instruction

More Mathematics knowledges, pls refer to https://blog.csdn.net/landian0531/article/details/118145417

  1. Too many formulations and equations, so screen shots of PPT is necessary.
  2. My mathematics sucks, so you 'll see many mathematical knowledge interspersed in my all ML learning session.
  3. Don’t be afraid of any mathematical symbol, just BAIDU the definition.

1. Review

Based on previous Intro, in step 3, we have to solve the following optimization problem

the formula in the picture should be argmin

arg: argument
argmin means: the value of variable when the latter formula reaches the minimum
argminL( θ \theta θ) means: the minimum value of formula of L( θ \theta θ)
在这里插入图片描述

Suppose the variables
在这里插入图片描述

Partial differential equation(偏微分方程)
derivative (导数)
Learning rate η \eta η
Gradient ∇ \nabla

在这里插入图片描述

在这里插入图片描述

2. Gradient Descent Tips

Tips1: Tuning your learning rate

Set the learning rate η \eta η carefully

在这里插入图片描述

The graph is more efficient when you

在这里插入图片描述

Adaptive Learning Rates

在这里插入图片描述

Adagrad

Reference SGD Adagrad Adam
Good at concept explanation https://zhuanlan.zhihu.com/p/61955391
Good at Visalized https://zhuanlan.zhihu.com/p/32626442

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
Contradiction? (矛盾吗?)
在这里插入图片描述
Intuitive Reason(直观解释)
在这里插入图片描述
在这里插入图片描述

Tips2: Stochastic Gradient Descent

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

Tips3: Feature Scaling(特征缩放)

在这里插入图片描述
在这里插入图片描述
How to Scaling: Normalization
Easier edition: Z-Score https://zhuanlan.zhihu.com/p/364338617
More details edition: https://zhuanlan.zhihu.com/p/265411459

在这里插入图片描述
在这里插入图片描述

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值