<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[ZD_012的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/ZD_012</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; ZD_012]]></copyright><item><title><![CDATA[【机器学习】机器学习基础]]></title><link>https://blog.csdn.net/ZD_012/article/details/110873998</link><guid>https://blog.csdn.net/ZD_012/article/details/110873998</guid><author>ZD_012</author><pubDate>Tue, 08 Dec 2020 15:56:46 +0800</pubDate><description><![CDATA[一、机器学习概述
1、机器学习算法的判别依据 —— 数据类型

离散型数据：由记录不同类别个体的数目所得到的数据，又称计数数据，所有这些数据全部都是整数，而且不能再细分，也不能进一步提高它们的精确度。
连续型数据：变量可以在某个范围内任取一数，即变量的取值可以是连续的，如长度、时间、质量值等，这类整数通常是非整数，含有小数部分。

注：离散型是区间内不可分，连续型是区间内可分。
数据的类型将是机器学习模型不同问题不同处理的依据。
机器学习算法的分类
1、监督学习（预测）：可以由输入数据中学到或建立一个模型，]]></description><category></category></item><item><title><![CDATA[【机器学习】特征工程——数据降维]]></title><link>https://blog.csdn.net/ZD_012/article/details/110135061</link><guid>https://blog.csdn.net/ZD_012/article/details/110135061</guid><author>ZD_012</author><pubDate>Wed, 25 Nov 2020 17:00:37 +0800</pubDate><description><![CDATA[特征工程
定义：将原始数据转换为更好地代表预测模型的潜在问题的特征的过程，从而提高了对未知数据的预测准确性。
内容：主要有三部分：
　　1、特征抽取
　　2、特征预处理
　　3、数据的降维
数据降维
机器学习领域中所谓的降维就是指采用某种映射方法，将原高维空间中的数据点映射到低维度的空间中。降维的本质是学习一个映射函数 f : x-&gt;y，其中x是原始数据点的表达，目前最多使用向量表达形式。 y是数据点映射后的低维向量表达，通常y的维度小于x的维度（当然提高维度也是可以的）。f可能是显式的或隐式的、线性]]></description><category></category></item><item><title><![CDATA[【机器学习】特征工程—— 特征预处理]]></title><link>https://blog.csdn.net/ZD_012/article/details/110083954</link><guid>https://blog.csdn.net/ZD_012/article/details/110083954</guid><author>ZD_012</author><pubDate>Wed, 25 Nov 2020 16:33:39 +0800</pubDate><description><![CDATA[特征工程
定义：将原始数据转换为更好地代表预测模型的潜在问题的特征的过程，从而提高了对未知数据的预测准确性。
内容：主要有三部分：
　　1、特征抽取
　　2、特征预处理
　　3、数据的降维
特征预处理
特征预处理：通过特定的统计方法（数学方法）将数据转换成算法要求的数据。
1、包含内容

数值型数据：标准缩放，包括归一化、标准化、缺失值
类别型数据：one—hot编码
时间类型：时间的切分

2、sklearn特征处理API：

sklearn.preprocessing

一、归一化
1、特点
通过对原始]]></description><category></category></item><item><title><![CDATA[JetBrain注册学生免费帐号方法]]></title><link>https://blog.csdn.net/ZD_012/article/details/109815610</link><guid>https://blog.csdn.net/ZD_012/article/details/109815610</guid><author>ZD_012</author><pubDate>Thu, 19 Nov 2020 16:40:31 +0800</pubDate><description><![CDATA[首先，进入学生免费注册的官方网站。
网站地址：https://www.jetbrains.com/student/

点击Apply now出现下图。我们选择UNIVERSITY EMAIL ADDRESS进行注册，填写个人信息然后确认。

确认后，跳转到Thank you页面，上面说已经给注册邮箱发送了邮件。稍等片刻即可去查看邮件。

在到这一步时，我遇到点小问题，一直没有收到官方发来的邮件。后来才发现邮件是被邮件网关拦截了没有发送到我的邮箱里面。要解决也比较简单，在邮箱中更改一下设置即可。具体步骤就是在]]></description><category></category></item><item><title><![CDATA[【机器学习】特征工程 —— 特征抽取]]></title><link>https://blog.csdn.net/ZD_012/article/details/109742681</link><guid>https://blog.csdn.net/ZD_012/article/details/109742681</guid><author>ZD_012</author><pubDate>Tue, 17 Nov 2020 15:34:03 +0800</pubDate><description><![CDATA[特征工程
定义：将原始数据转换为更好地代表预测模型的潜在问题的特征的过程，从而提高了对未知数据的预测准确性。
内容：主要有三部分：
　　1、特征抽取
　　2、特征预处理
　　3、数据的降维
数据集
数据集，又称为资料集、数据集合或资料集合，是一种由数据所组成的集合。
Data set（或dataset）是一个数据的集合，通常以表格形式出现。每一列代表一个特定变量。每一行都对应于某一成员的数据集的问题。它列出的价值观为每一个变量，如身高和体重的一个物体或价值的随机数。每个数值被称为数据资料。对应于行数，该数据]]></description><category></category></item><item><title><![CDATA[【Python】正则表达式]]></title><link>https://blog.csdn.net/ZD_012/article/details/109449290</link><guid>https://blog.csdn.net/ZD_012/article/details/109449290</guid><author>ZD_012</author><pubDate>Tue, 03 Nov 2020 16:28:45 +0800</pubDate><description><![CDATA[正则表达式：用于描述一种字符串匹配的模式。它可用于检查一个字符串是否含有某个子串，也可用于从字符串中提取匹配的子串，或者对字符串中匹配的子串执行替换操作。
Python正则表达式支持
在Python的交互解释器中先导入re模块，然后输入re.__all__命令，即可看到该模块所包含的全部属性和函数。
import re
print(re.__all__)


[‘match’, ‘fullmatch’, ‘search’, ‘sub’, ‘subn’, ‘split’, ‘findall’, ‘findit]]></description><category></category></item><item><title><![CDATA[【Python】matplotlib.pyplot绘图不显示中文解决方案]]></title><link>https://blog.csdn.net/ZD_012/article/details/109215782</link><guid>https://blog.csdn.net/ZD_012/article/details/109215782</guid><author>ZD_012</author><pubDate>Thu, 22 Oct 2020 10:05:43 +0800</pubDate><description><![CDATA[今天使用matplotlib.pyplot绘制折线图时，出现图表中文字不显示的问题。

同时会报错：RuntimeWarning: Glyph 20540 missing from current font.
font.set_text(s, 0.0, flags=flags)
解决方案
需添加一行显示中文标签的代码：
plt.rcParams['font.sans-serif'] = ['SimHei']


字体选择：




字体
对应名称




黑体
SimHei


微软雅黑
Microsoft]]></description><category></category></item><item><title><![CDATA[【Python】图形界面编程 —— 布局管理器]]></title><link>https://blog.csdn.net/ZD_012/article/details/109059780</link><guid>https://blog.csdn.net/ZD_012/article/details/109059780</guid><author>ZD_012</author><pubDate>Tue, 13 Oct 2020 20:22:37 +0800</pubDate><description><![CDATA[Grid布局
Grid把组件空间分解成一个网格进行维护，即按照行、列的方式排列组件，组件位置由其所在的行号和列号决定： 行号相同而列号不同的几个组件会被依次上下排列，列号相同而行号不同的几个组件会被依次左右排列。
使用Grid布局的过程就是为各个组件指定行号和列号的过程，不需要为每个网格都指定大小，Grid布局会自动为它们设置合适的大小。
程序调用组件的grid()方法就进行Grid布局，在调用grid()方法时可传入多个选项，该方法支持的选项有：


ipadx：指定组件在x方向（水平）上的内部留白
ip]]></description><category></category></item><item><title><![CDATA[pip安装包出现Retrying (Retry(total=4, connect=None, read=None, redirect=None, status=None))]]></title><link>https://blog.csdn.net/ZD_012/article/details/109050692</link><guid>https://blog.csdn.net/ZD_012/article/details/109050692</guid><author>ZD_012</author><pubDate>Tue, 13 Oct 2020 14:45:58 +0800</pubDate><description><![CDATA[今天安装pygame时出现了一点小问题，在cmd中输入pip install pygame时出现了如下问题：

经过百度，发现是数据源有问题，要更换python的pip源。
国内几个pip源如下：
阿里云 http://mirrors.aliyun.com/pypi/simple/
中国科技大学 https://pypi.mirrors.ustc.edu.cn/simple/
豆瓣(douban) http://pypi.douban.com/simple/
清华大学 https://pypi.tuna.t]]></description><category></category></item><item><title><![CDATA[【Python爬虫】国家药品监督管理总局中基于中华人民共和国化妆品生产许可证相关数据爬取]]></title><link>https://blog.csdn.net/ZD_012/article/details/109046688</link><guid>https://blog.csdn.net/ZD_012/article/details/109046688</guid><author>ZD_012</author><pubDate>Tue, 13 Oct 2020 10:51:11 +0800</pubDate><description><![CDATA[需求
爬取国家药品监督管理总局中基于中华人民共和国化妆品生产许可证相关数据。
代码
import requests
import json
if __name__ == '__main__':
    # 批量获取不同企业的id值
    url = 'http://scxk.nmpa.gov.cn:81/xk/itownet/portalAction.do?method=getXkzsList'
    headers = {'User-Agent': 'Mozilla/5.0 (Windows NT 1]]></description><category></category></item><item><title><![CDATA[【Python爬虫】豆瓣电影]]></title><link>https://blog.csdn.net/ZD_012/article/details/109044711</link><guid>https://blog.csdn.net/ZD_012/article/details/109044711</guid><author>ZD_012</author><pubDate>Tue, 13 Oct 2020 09:51:02 +0800</pubDate><description><![CDATA[需求
爬取豆瓣电影分类排行榜中的电影详情数据。
分析
进入豆瓣电影分类排行榜 - 喜剧片页面，可以发现该页面向下滚动刷新，是进行局部刷新的，可以通过ajax实现。打开开发者工具，找到url、User-Agent，数据包的请求方式以及数据包响应数据的类型。

可以看到请求方式是get，响应数据类型是json，所以使用requests.get()方式发起请求，使用json()方法获取相应对象。
因为页面是可以刷新获取更多电影信息的，我们需要进行动态参数处理。在数据包的Headers框中的最下方有五个参数，它们就]]></description><category></category></item><item><title><![CDATA[【Python爬虫】破解百度翻译]]></title><link>https://blog.csdn.net/ZD_012/article/details/109036911</link><guid>https://blog.csdn.net/ZD_012/article/details/109036911</guid><author>ZD_012</author><pubDate>Tue, 13 Oct 2020 09:30:38 +0800</pubDate><description><![CDATA[需求
破解百度翻译
分析

指定url
进入百度翻译页面，打开开发者工具，在页面上随便翻译一个单词，我们可以看到页面是进行局部刷新的，可以通过ajax实现。点击开发者工具中的Netowrk，我们可以看见出现了一堆的包
发起请求 我们可以通过开发者工具看到请求方式为GET，所以我们使用requests.get()方法。
获取响应数据 从下图可知，内容的类型为text/html，所以我们使用 .text，返回字符串形式的响应数据。
持久化存储

代码
import requests
import json

i]]></description><category></category></item><item><title><![CDATA[【Python爬虫】简易网页采集器]]></title><link>https://blog.csdn.net/ZD_012/article/details/109036562</link><guid>https://blog.csdn.net/ZD_012/article/details/109036562</guid><author>ZD_012</author><pubDate>Mon, 12 Oct 2020 21:00:32 +0800</pubDate><description><![CDATA[需求
爬取搜狗指定词条对应的搜索结果页面。
分析
我搜索的词条为“哈利波特”，其url为 “https://www.sogou.com/web?query=哈利波特”（这是简洁处理过的，实际后面的一些参数省略了，不影响）。但为了能实现搜索不同的词条，我设置了动态参数kw，将其分装到字典中。当我们使用get方法发出请求时，请求所对应的url的参数就可以用params赋值。
代码
import requests

if __name__ == "__main__":
    # UA伪装：将对应的User-Ag]]></description><category></category></item><item><title><![CDATA[【Python爬虫】爬取搜狗首页的页面数据]]></title><link>https://blog.csdn.net/ZD_012/article/details/109023692</link><guid>https://blog.csdn.net/ZD_012/article/details/109023692</guid><author>ZD_012</author><pubDate>Mon, 12 Oct 2020 20:45:47 +0800</pubDate><description><![CDATA[分析
1、指定url
首先进入搜狗搜索页面，指定url，并进行UA伪装。
UA就是User-Agent，UA伪装就是让爬虫对应的请求载体身份标识伪装成某一款浏览器。因为门户网站的服务器会检测对应请求的载体身份标识，如果检测到请求的载体身份标识为某一款浏览器，就说明该请求是一个正常的请求。但是，如果检测到请求的载体身份标识不是基于某一款浏览器的，则表示该请求为不正常的请求（爬虫），服务器就很有可能会拒绝该次请求。
我们进入到搜狗搜索页面，打开开发者工具（鼠标右击，点击“检查”即可），点击Network，刷新页]]></description><category></category></item><item><title><![CDATA[【LeetCode】两数之和]]></title><link>https://blog.csdn.net/ZD_012/article/details/108769257</link><guid>https://blog.csdn.net/ZD_012/article/details/108769257</guid><author>ZD_012</author><pubDate>Thu, 24 Sep 2020 14:46:47 +0800</pubDate><description><![CDATA[题目描述
给定一个整数数组 nums 和一个目标值 target，请你在该数组中找出和为目标值的那 两个 整数，并返回他们的数组下标。
你可以假设每种输入只会对应一个答案。但是，数组中同一个元素不能使用两遍。
示例：

给定 nums = [2, 7, 11, 15], target = 9
因为 nums[0] + nums[1] = 2 + 7 = 9
所以返回 [0, 1]

代码
方法一：
直接使用双重for循环，遍历每一个元素，找出能与该元素相加得到目标值target的值。
class Solut]]></description><category></category></item><item><title><![CDATA[【Java】计算一个字符串中每个字符出现次数]]></title><link>https://blog.csdn.net/ZD_012/article/details/108759698</link><guid>https://blog.csdn.net/ZD_012/article/details/108759698</guid><author>ZD_012</author><pubDate>Wed, 23 Sep 2020 19:28:12 +0800</pubDate><description><![CDATA[思路分析

使用Scanner获取用户输入的字符串
创建Map集合，key是字符串中的字符，value是字符的个数
遍历字符串，获取每一个字符
使用获取到的字符，在Map集合中判断key是否存在
遍历Map集合，输出结果

代码
import java.util.HashMap;
import java.util.Scanner;

public class Test {

	public static void main(String[] args) {
		Scanner sc = new Scanne]]></description><category></category></item><item><title><![CDATA[【LeetCode】盛最多水的容器]]></title><link>https://blog.csdn.net/ZD_012/article/details/108716589</link><guid>https://blog.csdn.net/ZD_012/article/details/108716589</guid><author>ZD_012</author><pubDate>Tue, 22 Sep 2020 09:00:09 +0800</pubDate><description><![CDATA[题目描述
给你 n 个非负整数 a1，a2，…，an，每个数代表坐标中的一个点 (i, ai) 。在坐标内画 n 条垂直线，垂直线 i 的两个端点分别为 (i, ai) 和 (i, 0)。找出其中的两条线，使得它们与 x 轴共同构成的容器可以容纳最多的水。
说明：你不能倾斜容器，且 n 的值至少为 2。

示例：

输入：[1,8,6,2,5,4,8,3,7]
输出：49

代码
class Solution {
public:
    int maxArea(vector&lt;int&gt;&amp; ]]></description><category></category></item><item><title><![CDATA[【Java】斗地主案例]]></title><link>https://blog.csdn.net/ZD_012/article/details/108672939</link><guid>https://blog.csdn.net/ZD_012/article/details/108672939</guid><author>ZD_012</author><pubDate>Sun, 20 Sep 2020 17:21:21 +0800</pubDate><description><![CDATA[题目描述
按照斗地主的规则，完成洗牌发牌的动作。
具体规则：
使用54张牌打乱顺序，三个玩家参与游戏，三人交替摸牌，每人17张牌，最后三张留作底牌。
案例分析


准备牌
牌可以设计为一个ArrayList&lt;String&gt;，每个字符串为一张牌


发牌


看牌



...]]></description><category></category></item><item><title><![CDATA[【Java】接口多态的综合案例 —— 笔记本电脑]]></title><link>https://blog.csdn.net/ZD_012/article/details/108672253</link><guid>https://blog.csdn.net/ZD_012/article/details/108672253</guid><author>ZD_012</author><pubDate>Fri, 18 Sep 2020 20:46:24 +0800</pubDate><description><![CDATA[题目描述
进行描述笔记本类，实现笔记本使用USB鼠标、USB键盘

USB接口，包含打开设备功能，关闭设备功能
笔记本类，包含开机功能、关机功能、使用USB设备功能
鼠标类，要实现USB接口，并具备点击的方法
键盘类，要实现USB接口，具备敲击的方法

注：该案例只是为了便于理解接口和多态，所以案例里面的功能不会具体实现。
代码
//USB接口
public interface USB {
	public abstract void open();	//打开设备
	public abstract void ]]></description><category></category></item><item><title><![CDATA[【Java】群主发普通红包]]></title><link>https://blog.csdn.net/ZD_012/article/details/108653278</link><guid>https://blog.csdn.net/ZD_012/article/details/108653278</guid><author>ZD_012</author><pubDate>Fri, 18 Sep 2020 09:45:25 +0800</pubDate><description><![CDATA[思路解析
发红包的逻辑：
三要素：
返回值类型：ArrayList&lt;Integer&gt;
方法名称：send
参数列表：1、总共发多少红包  int totalMoney      2、分成多少份   int count
public ArrayList&lt;Integer&gt; send(int totalMoney, int count) {
	//...
}

发红包的逻辑：
三要素：
返回值类型：void
方法名称：receive
参数列表：ArrayList&lt;Integer&gt]]></description><category></category></item></channel></rss>