<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[丁磊_ml的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/MosBest</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; MosBest]]></copyright><item><title><![CDATA[java设计模式---]]></title><link>https://blog.csdn.net/MosBest/article/details/111874703</link><guid>https://blog.csdn.net/MosBest/article/details/111874703</guid><author>MosBest</author><pubDate>Tue, 29 Dec 2020 12:07:09 +0800</pubDate><description><![CDATA[文章目录设计模式在软件中哪里？设计模式的七大原则单一职责原则接口隔离原则（Interface Segregation Principle）
设计模式在软件中哪里？
面向对象 ==&gt; 功能模块[设计模式+算法（数据结构）] ==&gt; 框架[使用到多种设计模式] =&gt; 架构[服务器集群]
设计模式的七大原则
编写软件过程中，程序员面临着来自耦合性，内聚性以及可维护性，可扩展性，重用性，灵活性等多方面的挑战，设计模式是为了让程序（软件），具有更好的
1）代码重用性（即：相同功能的代码，不用多次编写]]></description><category></category></item><item><title><![CDATA[linux使用札记]]></title><link>https://blog.csdn.net/MosBest/article/details/110920316</link><guid>https://blog.csdn.net/MosBest/article/details/110920316</guid><author>MosBest</author><pubDate>Wed, 09 Dec 2020 15:41:25 +0800</pubDate><description><![CDATA[文章目录1. 磁盘挂载2. ubuntu 局域网服务器上网-----代理设置2.1 主机A安装 CCProxy2.1 局域网服务器 pip  代理设置2.2 局域网服务器 apt-get install 代理设置其他思路2.3 网速慢的问题3. vi使用
1. 磁盘挂载
~$ df -h
Filesystem      Size  Used Avail Use% Mounted on
udev             16G     0   16G   0% /dev
tmpfs           3.2]]></description><category></category></item><item><title><![CDATA[命名实体识别 NER]]></title><link>https://blog.csdn.net/MosBest/article/details/107712316</link><guid>https://blog.csdn.net/MosBest/article/details/107712316</guid><author>MosBest</author><pubDate>Fri, 31 Jul 2020 16:02:58 +0800</pubDate><description><![CDATA[文章目录搭建NER分类器评估NER分类器NER方法基于规则的方法(Rule-based Approach)投票模型(Majority Voting)基于分类模型-----非时序模型：逻辑回归，SVM ...特征工程Feature Encoding
搭建NER分类器

定义实体种类
准备训练数据
训练NER

评估NER分类器
精确率/召回率
F1-score
NER方法

基于规则（比如正则）
投票模型（Majority Voting）
利用分类模型

非时序模型：逻辑回归，SVM …
时序模型：HMM，C]]></description><category></category></item><item><title><![CDATA[解一个难题的思路]]></title><link>https://blog.csdn.net/MosBest/article/details/107643229</link><guid>https://blog.csdn.net/MosBest/article/details/107643229</guid><author>MosBest</author><pubDate>Tue, 28 Jul 2020 19:20:49 +0800</pubDate><description><![CDATA[]]></description><category></category></item><item><title><![CDATA[自然语言处理：专家系统简介]]></title><link>https://blog.csdn.net/MosBest/article/details/107642387</link><guid>https://blog.csdn.net/MosBest/article/details/107642387</guid><author>MosBest</author><pubDate>Tue, 28 Jul 2020 19:11:00 +0800</pubDate><description><![CDATA[专家系统的工作流程


推理引擎
推理引擎可以扩展 知识库中的知识。
解决规则冲突
选择最小规则子集

]]></description><category></category></item><item><title><![CDATA[自然语言处理-----语言模型 Language Model]]></title><link>https://blog.csdn.net/MosBest/article/details/107630100</link><guid>https://blog.csdn.net/MosBest/article/details/107630100</guid><author>MosBest</author><pubDate>Tue, 28 Jul 2020 18:04:47 +0800</pubDate><description><![CDATA[文章目录Language Model(LM) 简介Chain Rulesparsity 稀疏性问题马尔可夫假设Language Model: Unigram, Bigram, N-gram举例：Unigram, Bigram 模型的训练过程和使用UnigramBigram语言模型的评估-----Perplexity平滑函数Add-one  Smoothing (也就是 拉普拉斯平滑)Add-K SmoothingInterpolationGood-Turning Smoothing语言模型的应用：生成句子
]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--总结]]></title><link>https://blog.csdn.net/MosBest/article/details/107049380</link><guid>https://blog.csdn.net/MosBest/article/details/107049380</guid><author>MosBest</author><pubDate>Tue, 30 Jun 2020 19:58:15 +0800</pubDate><description><![CDATA[文章目录2020-06学习报告线性回归LASSO 回归Ridge 岭回归感知机算法PLApocket算法线性判别分析逻辑回归高斯判别分析PCAhard-margin SVMsoft-margin SVM
2020-06学习报告
本月学习机器学习常见算法，并做相应的数学推导。
具体的数学推导见文件夹中的pdf文件。本word是对上面的算法进行简单的总结。
机器学习模型 主要包括以下流程：

首先根据实际问题(比如 一些 先验信息的假设)，思考自己的解决方案 (算法思路)
将这个解决方案 用 数学的公式 表达出]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--指数族分布]]></title><link>https://blog.csdn.net/MosBest/article/details/107021747</link><guid>https://blog.csdn.net/MosBest/article/details/107021747</guid><author>MosBest</author><pubDate>Mon, 29 Jun 2020 19:47:58 +0800</pubDate><description><![CDATA[文章目录指数族分布公式指数族分布三大特性与三个模型充分统计量共轭最大熵模型将高斯分布写成指数族分布形式对数配分函数 A(η)A(\eta )A(η) 与充分统计量之间的关系极大似然估计求参数  与 充分统计量 之间的关系
事实上，我们之前学的很多种概率分布都是指数族分布。

指数族分布公式


指数族分布三大特性与三个模型

充分统计量

共轭

最大熵

模型

将高斯分布写成指数族分布形式

对数配分函数 A(η)A(\eta )A(η) 与充分统计量之间的关系

将这个定理带入到 高斯分布（一种指数族]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--SVM之核函数]]></title><link>https://blog.csdn.net/MosBest/article/details/107019506</link><guid>https://blog.csdn.net/MosBest/article/details/107019506</guid><author>MosBest</author><pubDate>Mon, 29 Jun 2020 14:57:00 +0800</pubDate><description><![CDATA[文章目录核函数正定核
核函数
在有的数据样本中，样本本就不是线性可分的。
所以，我们就希望 找到一个非线性函数，将样本数据由低维映射到高维，从而使得样本在高维空间下，是可以线性可分的。
cover theonemy: 高维比低维更容易线性可分。
即通过非线性带来高维的转换
假设这个非线性的映射函数为z=ϕ(x)z = \phi(x)z=ϕ(x)
则，映射之后，样本的特征由x变为z


但是
有的时候ϕ(x)\phi(x)ϕ(x)维度非常高，甚至为无限维。导致ϕ(xi)T∗ϕ(xj)\phi(x_i)^T*\]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--soft-margin SVM]]></title><link>https://blog.csdn.net/MosBest/article/details/107010243</link><guid>https://blog.csdn.net/MosBest/article/details/107010243</guid><author>MosBest</author><pubDate>Sun, 28 Jun 2020 23:38:28 +0800</pubDate><description><![CDATA[文章目录

所以soft-margin SVM的中心实现：
在原hard-margin SVM模型的基础上，允许样本操作一定的误差。


]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--线性回归]]></title><link>https://blog.csdn.net/MosBest/article/details/107009386</link><guid>https://blog.csdn.net/MosBest/article/details/107009386</guid><author>MosBest</author><pubDate>Sun, 28 Jun 2020 22:31:45 +0800</pubDate><description><![CDATA[文章目录线性回归的地位线性回归--最小二乘法估计与极大似然法则线性回归模型最小二乘估计，极大似然 ，及二者的关系（用频率派的角度理解最小二乘）最小二乘估计极大似然最小二乘估计 与 极大似然 的关系线性回归--正则化岭回归 l2 正则化 （频率派角度）从贝叶斯派的角度 理解 L2正则化正则化中 频率派和贝叶斯派 是一样的。综上所述
线性回归的地位

线性回归–最小二乘法估计与极大似然法则
线性回归模型

当前目标 是 找到 模型f(w)=wTxf(w)=w^Txf(w)=wTx，也就是求出参数 w。
下面介绍]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--线性分类]]></title><link>https://blog.csdn.net/MosBest/article/details/107009349</link><guid>https://blog.csdn.net/MosBest/article/details/107009349</guid><author>MosBest</author><pubDate>Sun, 28 Jun 2020 22:29:40 +0800</pubDate><description><![CDATA[文章目录线性分类的背景感知机线性判别分析逻辑回归高斯判别分析
线性分类的背景

感知机

https://blog.csdn.net/MosBest/article/details/52029217 这篇文章讲了 感知机算法和pocket算法
线性判别分析
线性判别分析 其实是一种降维的思想。假设样本是p维，二线性判别分析就是将所有p维的样本投影到 一维上（一条线上）。然后在这条线上进行 分类。







逻辑回归

高斯判别分析




...]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--SVM]]></title><link>https://blog.csdn.net/MosBest/article/details/106983532</link><guid>https://blog.csdn.net/MosBest/article/details/106983532</guid><author>MosBest</author><pubDate>Sun, 28 Jun 2020 22:12:52 +0800</pubDate><description><![CDATA[文章目录SVM思想及其数学模型SVM的中心思想：用数学模型来表示SVM的中心思想

建立思想
将思想转化为数学表达式（数学模型）
这个数学模型就是一个优化问题，求解这个优化问题即可。（梯度下降，EM算法，等等其他）

SVM思想及其数学模型
SVM有三宝：间隔，对偶，核技巧
SVM分三类:

hard-margin SVM
soft-margin SVM
kernel  SVM

SVM的中心思想：

用数学模型来表示SVM的中心思想

下一步，就是要用数学公式表示出 margin(w, b)
具体思路可见]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--降维PCA(主成分分析)]]></title><link>https://blog.csdn.net/MosBest/article/details/106928476</link><guid>https://blog.csdn.net/MosBest/article/details/106928476</guid><author>MosBest</author><pubDate>Tue, 23 Jun 2020 19:24:03 +0800</pubDate><description><![CDATA[文章目录维度灾难过拟合的三种解决方案：PCA(主成分分析)数学 预备知识PCA(主成分分析)的核心思想PCA的目标：最大投影方差最小重构距离PCA(主成分分析)------最大投影方差角度PCA(主成分分析)------ 最小重构距离角度PCA(主成分分析)------SVD角度PCA(主成分分析)------概率角度
维度灾难


从数据的角度上来看
当你的模型增加一个特征(属性)后，你所需要的数据是以指数幂的形式增加


从几何的角度上来看
模型维度的增加，会导致数据的稀疏性



过拟合的三种解决方案]]></description><category></category></item><item><title><![CDATA[机器学习---背后数学原理--开篇：频率派 VS 贝叶斯派]]></title><link>https://blog.csdn.net/MosBest/article/details/106252211</link><guid>https://blog.csdn.net/MosBest/article/details/106252211</guid><author>MosBest</author><pubDate>Thu, 21 May 2020 18:07:28 +0800</pubDate><description><![CDATA[文章目录
机器学习方法最终引入 概率 是一个必然趋势，于是 最终 演化成 两大流派：

频率派
贝叶斯派

本片blog就是来讲解这两大流派的异同。
前提假设：
样本 xi=(xi1,xi2,...,xip)x_i = (x_{i1}, x_{i2}, ... , x_{ip})xi​=(xi1​,xi2​,...,xip​): 第i个样本，且每个样本为p维向量
样本集  X:  共有N个样本，则XN∗P=(xij)X_{N*P}=(x_{ij})XN∗P​=(xij​)
参数θ\thetaθ: param]]></description><category></category></item><item><title><![CDATA[设计原则]]></title><link>https://blog.csdn.net/MosBest/article/details/105974936</link><guid>https://blog.csdn.net/MosBest/article/details/105974936</guid><author>MosBest</author><pubDate>Thu, 07 May 2020 16:11:30 +0800</pubDate><description><![CDATA[注意：本笔记整理于 极客时间 设计模式之美
文章目录SOLID原则单一职责原则（SRP）开闭原则里式替换原则接口隔离原则依赖反转原则KISS原则YAGNI原则DRY原则LOD迪米特法则
SOLID原则
SOLID原则：由5个设计原则组成的，它们分别是：
O：开闭原则
L：里式替换原则
I：接口隔离原则
D：依赖反转原则
单一职责原则（SRP）
单一职责原则(Single Responsibilit...]]></description><category></category></item><item><title><![CDATA[面向对象思想]]></title><link>https://blog.csdn.net/MosBest/article/details/105947721</link><guid>https://blog.csdn.net/MosBest/article/details/105947721</guid><author>MosBest</author><pubDate>Wed, 06 May 2020 11:49:48 +0800</pubDate><description><![CDATA[注意：本笔记整理于 极客时间 设计模式之美
文章目录面向对象编程思想面向对象、设计原则、设计模式、编程规范、重构，这五者有何关系？面向对象编程封装（Encapsulation）抽象（Abstraction）继承（Inheritance）多态（Polymorphism）面向对象与面向过程 二者的区别抽象类和接口基于接口而非实现编程多用组合少用继承
面向对象编程思想
现在，主流的编程范式或者是编程风格...]]></description><category></category></item><item><title><![CDATA[mysql索引篇]]></title><link>https://blog.csdn.net/MosBest/article/details/105752059</link><guid>https://blog.csdn.net/MosBest/article/details/105752059</guid><author>MosBest</author><pubDate>Sat, 25 Apr 2020 16:54:06 +0800</pubDate><description><![CDATA[文章目录查询结构的进化史何为索引索引模型哈希索引有序数组实现索引树形索引InnoDB中的索引模型sql语句创建索引InnoDB中表的存储方式索引分类主键索引和非主键索引聚集索引 和 非聚集索引索引创建方法创建表时，自增主键 与 把业务逻辑字段作为主键自增主键业务逻辑的字段做主键最左前缀原则 与 模糊匹配索引优化，在建立联合索引的时候，如何安排索引内的字段顺序索引优化，如何避免回表过程何为回表索引优...]]></description><category></category></item><item><title><![CDATA[mysql基础结构]]></title><link>https://blog.csdn.net/MosBest/article/details/105751860</link><guid>https://blog.csdn.net/MosBest/article/details/105751860</guid><author>MosBest</author><pubDate>Sat, 25 Apr 2020 16:53:43 +0800</pubDate><description><![CDATA[注意：本笔记整理于 极客时间 mysql实战45讲
文章目录mysql 基础架构Server层长连接 与 短连接，--- 尽量使用长连接大多数情况下建议不要使用查询缓存存储引擎层redo log（重做日志）和binlog（归档日志）redo log 与 binlog 的不同？为什么会有这两份日志？mysql如何解决 更新数据 与 写入磁盘 两个操作之间的效率冲突 ----- WAL技术  redo...]]></description><category></category></item><item><title><![CDATA[python常见知识点]]></title><link>https://blog.csdn.net/MosBest/article/details/105706801</link><guid>https://blog.csdn.net/MosBest/article/details/105706801</guid><author>MosBest</author><pubDate>Thu, 23 Apr 2020 14:20:53 +0800</pubDate><description><![CDATA[注意以下内容，大部分为 极客时间 Python核心技术与实战 整理得到
文章目录装饰器与闭包GIL何为GILGIL如何工作CPython引入GIL概念原因+=导致的线程不安全问题（有了GIL，线程也不一定安全）容器，可迭代对象，迭代器容器迭代器可迭代对象生成器多进程编程，多线程编程IO多路复用（select, poll, epoll）select协程并发编程之Futures并发编程之Asyncio...]]></description><category></category></item></channel></rss>