吴恩达机器学习课程作业(一)基于python实现 详细解析(下篇)

@正规方程


前言

斯坦福大学吴恩达老师的机器学习课程几乎是每位热爱人工智能领域同学的必修课。网上虽然有许多基于python实现的代码,但大多使用python交互模式解释器ipython实例讲解。本人基于自己的理解采用pycharm提供源代码及个人理解,部分代码可能参考他人代码部分,如有侵权请私信我

一、问题探讨

参考视频4-6 ,到目前为止,我们都在使用梯度下降算法寻找局部最优解。但是对于某些线性回归问题,正规方程方法是更好的解决方案:它相较梯度下降算法而言,可以一次计算得出theta且代码简易方便。且不需要我们人为定义学习率a

而正规方程是通过求解下面的方程来找出使得代价函数最小的参数的在这里插入图片描
假设我们的训练集特征矩阵为 X,并且我们的训练集结果为向量 y,则利用正规方程解出向量在这里插入图片描述
注:可以看到由于向量theta需要我们求出逆矩阵在这里插入图片描述
所以对于那些不可逆矩阵(通常是因为矩阵之间不独立,如包含英尺为单位的尺寸和米为单位的尺寸两个特征,也有可能是特征数量大于训练集的数量),正规方程方法是不可用的

二、代码解析

1.引入库

代码如下(示例):

def normalEqn(X, y):
    theta = np.linalg.inv(X.T@X)@X.T@y#X.T@X等价于X.T.dot(X)
    return theta
final_theta2=normalEqn(x2, y2)
print(final_theta2)

注:使用了原数据x2,y2

C:\Users\33696\AppData\Local\Programs\Python\Python39\python.exe D:/pythonProject/Include/机器学习.py
0.4893617021276595
[[-1.10845139e-16  8.84042349e-01 -5.24551809e-02]](梯度下降算法结果)
0.130686706060959
[[-1.11022302e-16]
 [ 8.84765988e-01]
 [-5.31788197e-02]](正规方程算法结果)

pycharm计算结果如上图所示,可以看到两个计算方法得到的结果相差不大,因而对于读者而言,根据具体的问题,以及特征变量的数量,这两种算法都是值得学习的

总结

在这里插入图片描述
总结一下,只要特征变量的数目并不大,标准方程是一个很好的计算参数𝜃的替代方法。
具体地说,只要特征变量数量小于一万,我通常使用标准方程法,而不使用梯度下降法。(吴恩达老师课程讲义)

  • 5
    点赞
  • 4
    收藏
    觉得还不错? 一键收藏
  • 2
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值