<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[zlb872551601的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/zlb872551601</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; zlb872551601]]></copyright><item><title><![CDATA[git比较项目两个分支的指定文件的差异]]></title><link>https://blog.csdn.net/zlb872551601/article/details/119189299</link><guid>https://blog.csdn.net/zlb872551601/article/details/119189299</guid><author>zlb872551601</author><pubDate>Wed, 28 Jul 2021 20:31:26 +0800</pubDate><description><![CDATA[git比较项目两个分支的指定文件的差异
Git diff branch1 branch2 --stat   //显示出所有有差异的文件列表
Git diff branch1 branch2 文件名(带路径)   //显示指定文件的详细差异
Git diff branch1 branch2                   //显示出所有有差异的文件的详细差异
上面命令中，Git diff branch1 branch2其实就可以看两个分支的指定文件的差异，
但是Git diff branch1 branc]]></description><category></category></item><item><title><![CDATA[Git恢复之前版本的两种方法reset、revert（图文详解）]]></title><link>https://blog.csdn.net/zlb872551601/article/details/119186408</link><guid>https://blog.csdn.net/zlb872551601/article/details/119186408</guid><author>zlb872551601</author><pubDate>Wed, 28 Jul 2021 18:24:48 +0800</pubDate><description><![CDATA[此文章为转载，感谢原博主，
原文链接：https://blog.csdn.net/yxlshk/article/details/79944535
一、问题描述
在利用github实现多人合作程序开发的过程中，我们有时会出现错误提交的情况，此时我们希望能撤销提交操作，让程序回到提交前的样子，本文总结了两种解决方法：回退（reset）、反做（revert）。
二、背景知识
git的版本管理，及HEAD的理解
使用git的每次提交，Git都会自动把它们串成一条时间线，这条时间线就是一个分支。如果没有新建分支，那么]]></description><category></category></item><item><title><![CDATA[make_parse_example_spec的作用只是返回一个字段作为tf.parse_example需要的入参]]></title><link>https://blog.csdn.net/zlb872551601/article/details/118417670</link><guid>https://blog.csdn.net/zlb872551601/article/details/118417670</guid><author>zlb872551601</author><pubDate>Fri, 02 Jul 2021 16:00:51 +0800</pubDate><description><![CDATA[pred_features = tf.parse_example(example_batch,feature_column_lib.make_parse_example_spec(self.pred_column))



]]></description><category></category></item><item><title><![CDATA[修改网络中的参数取值代码]]></title><link>https://blog.csdn.net/zlb872551601/article/details/115603827</link><guid>https://blog.csdn.net/zlb872551601/article/details/115603827</guid><author>zlb872551601</author><pubDate>Sun, 11 Apr 2021 18:46:50 +0800</pubDate><description><![CDATA[代码可以参考：使用tensorflow的模型文件，修改参数名称和数值，合并两个模型等

https://blog.csdn.net/chanbo8205/article/details/88172592

我们的写法也是类似这个博客的写法。




	def main():
	
	
	if not os.path.exists(args.new_checkpoint_path):
	
	
	os.makedirs(args.new_checkpoint_path)
	
	
	with tf.Session.]]></description><category></category></item><item><title><![CDATA[正则中需要转义的特殊字符小结]]></title><link>https://blog.csdn.net/zlb872551601/article/details/114498732</link><guid>https://blog.csdn.net/zlb872551601/article/details/114498732</guid><author>zlb872551601</author><pubDate>Sun, 07 Mar 2021 21:18:54 +0800</pubDate><description><![CDATA[https://www.jb51.net/article/31478.htm
正则中需要转义的特殊字符小结
更新时间：2012年10月07日 04:15:34   作者：
正则表达式中的特殊字符，就是一些有特殊含义的字符，如“.txt”中的，简单的说就是表示任何字符串的意思
如果要查找文件名中有＊的文件，则需要对＊进行转义，即在其前加一个\。ls *.txt。正则表达式有以下特殊字符。需要转义
特别字符
说明
$
匹配输入字符串的结尾位置。如果设置了 RegExp 对象的 Multiline 属性，则 $ ]]></description><category></category></item><item><title><![CDATA[mac os maverics里commend+tab切换程序不能打开被最小化的程序解决办法]]></title><link>https://blog.csdn.net/zlb872551601/article/details/113960026</link><guid>https://blog.csdn.net/zlb872551601/article/details/113960026</guid><author>zlb872551601</author><pubDate>Mon, 22 Feb 2021 22:35:50 +0800</pubDate><description><![CDATA[command+tab选中后 -&gt; 松开tab -&gt; 按下option -&gt; 松开command -&gt; 松开option

]]></description><category></category></item><item><title><![CDATA[hive之regexp_replace函数、split函数的正则]]></title><link>https://blog.csdn.net/zlb872551601/article/details/113562027</link><guid>https://blog.csdn.net/zlb872551601/article/details/113562027</guid><author>zlb872551601</author><pubDate>Tue, 02 Feb 2021 15:59:14 +0800</pubDate><description><![CDATA[转载

https://blog.csdn.net/yuxeaotao/article/details/89645781

hive之regexp_replace函数、split函数的正则

Hive中，regexp_replace函数的第2个参数是正则表达式，第3个参数是字符串






	select split(regexp_replace(data,'\\},\\{','}||{'),'\\|\\|')[0]as test 
	
	
	from 
	
	
	(select '[{"source".]]></description><category></category></item><item><title><![CDATA[深度推荐模型中组件拆解(非完整)]]></title><link>https://blog.csdn.net/zlb872551601/article/details/105460751</link><guid>https://blog.csdn.net/zlb872551601/article/details/105460751</guid><author>zlb872551601</author><pubDate>Sat, 11 Apr 2020 22:18:08 +0800</pubDate><description><![CDATA[深度推荐模型中组件拆解(非完整)
近年来，深度学习兴起，制霸了很多算法领域，在推荐系统中，在数据量足够的情况下，深度学习模型的效果也优于传统模型，在各大会议中，我们看到相关内容的模型层出不穷，wide&amp;deep，deepfm，pnn等。细究这些模型，网络结果可以拆分为各个组件，不同的模型可以看成是组件的排列组合，下面从组件粒度，来分析一下深度推荐模型。
embedding
embeddin...]]></description><category></category></item><item><title><![CDATA[推荐系统中的召回算法大致梳理（非完整）]]></title><link>https://blog.csdn.net/zlb872551601/article/details/105459334</link><guid>https://blog.csdn.net/zlb872551601/article/details/105459334</guid><author>zlb872551601</author><pubDate>Sat, 11 Apr 2020 21:58:12 +0800</pubDate><description><![CDATA[推荐系统中的召回算法大致梳理（非完整）
定义
推荐策略中的两个关键问题分别是“召回”和“排序”。
“召回match”是指从全量信息中触发尽可能多的正确结果，并将正确结果返回给“排序”
来源
全量商品与用户进行匹配排序，计算力无法支持，需要召回获得较小的商品候选集，在进行复杂模型的排序。
指标
召回率（recall）、准确率（precision）
召回类型
1.基于内容匹配的召回（content-b...]]></description><category></category></item><item><title><![CDATA[deepctr源码学习一]]></title><link>https://blog.csdn.net/zlb872551601/article/details/105420745</link><guid>https://blog.csdn.net/zlb872551601/article/details/105420745</guid><author>zlb872551601</author><pubDate>Thu, 09 Apr 2020 21:39:59 +0800</pubDate><description><![CDATA[deepctr源码学习一
按源码里examples文件夹下的run_classification_criteo.py文件，画了deepfm的网络图和源码相应行数的对应关系，为了方便展示结构图，只取了前两个分类特征和前两个数值特征.


...]]></description><category></category></item><item><title><![CDATA[VScode如何Debug(调试)进入标准库文件/第三方包源码]]></title><link>https://blog.csdn.net/zlb872551601/article/details/105354738</link><guid>https://blog.csdn.net/zlb872551601/article/details/105354738</guid><author>zlb872551601</author><pubDate>Mon, 06 Apr 2020 23:56:22 +0800</pubDate><description><![CDATA[今天在用vscode 调试python代码，进deepctr的源码里，打了断点竟然一直没有进入，
也是奇了怪了，虽然很长时间没有打断点，调代码了，但以前pychram 打断点一直没毛病啊，
搞了好久才发现，vscode的调试配置里有个重要的选项没配置，就是"justMyCode": false。这个选项默认是true，是进不了第三方包源码的，所以要改成false。
最后还是要吐槽一下vscode,...]]></description><category></category></item><item><title><![CDATA[推荐中AB实验最大的问题——流量偏置及解决方案：重叠实验架构]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103757907</link><guid>https://blog.csdn.net/zlb872551601/article/details/103757907</guid><author>zlb872551601</author><pubDate>Thu, 16 Jan 2020 10:38:09 +0800</pubDate><description><![CDATA[推荐中AB实验最大的问题——流量偏置及解决方案：重叠实验架构

]]></description><category></category></item><item><title><![CDATA[推荐系统中用户画像]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103751354</link><guid>https://blog.csdn.net/zlb872551601/article/details/103751354</guid><author>zlb872551601</author><pubDate>Sun, 29 Dec 2019 10:37:42 +0800</pubDate><description><![CDATA[推荐系统中用户画像
用户画像的构建方法

1.第一类——基础信息，就是直接使用用户在注册时的原始数据，如人口统计学信息或者一些一旦发生就不再改变的行为信息，如第一次注册时间，第一次查看内容等，这部分内容也被称为静态信息（Static）。这个基础信息类似于查户口，其实没有什么技术含量，但是对于用户冷启动场景非常有用；
2.第二类——行为信息，这里就是不断的堆积用户的历史行为数据，做统计，也是最常见的...]]></description><category></category></item><item><title><![CDATA[头条1-无重复字符的最长子串]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103744276</link><guid>https://blog.csdn.net/zlb872551601/article/details/103744276</guid><author>zlb872551601</author><pubDate>Sat, 28 Dec 2019 14:26:31 +0800</pubDate><description><![CDATA[头条1-无重复字符的最长子串

]]></description><category></category></item><item><title><![CDATA[L1正则化与稀疏性]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103743374</link><guid>https://blog.csdn.net/zlb872551601/article/details/103743374</guid><author>zlb872551601</author><pubDate>Sat, 28 Dec 2019 13:29:29 +0800</pubDate><description><![CDATA[L1正则化与稀疏性
L1正则化使得模型参数具有稀疏性的原理是什么？
机器学习经典之作《pattern recognition and machine learning》中的第三章作出的一个解释无疑是权威且直观的，我们也经常都是从这个角度出发，来解释L1正则化使得模型参数具有稀疏性的原理。再回顾一下，以二维为例，红色和黄色的部分是L1、L2正则项约束后的解空间，蓝色的等高线是凸优化问题中的目标函数（...]]></description><category></category></item><item><title><![CDATA[lightgbm和xgb如何处理不平衡数据的]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103738746</link><guid>https://blog.csdn.net/zlb872551601/article/details/103738746</guid><author>zlb872551601</author><pubDate>Fri, 27 Dec 2019 21:55:44 +0800</pubDate><description><![CDATA[lightgbm和xgb如何处理不平衡数据的
ctr,cvr这类2分类问题的样本不平衡性行可想而知的。
而lightgbm和xgb这些分类大杀器在ctr,cvr这类2分类问题中也是常用的，那问题就是这lightgbm和xgb是如何越过样本不平衡问题的？
答案，lightgbm和xgb模型都有is_unbalance=True/False 、scale_pos_weight这两个参数，这两个参数二选...]]></description><category></category></item><item><title><![CDATA[faiss入门+使用的索引原理]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103704874</link><guid>https://blog.csdn.net/zlb872551601/article/details/103704874</guid><author>zlb872551601</author><pubDate>Wed, 25 Dec 2019 20:00:50 +0800</pubDate><description><![CDATA[faiss入门+使用的索引原理

]]></description><category></category></item><item><title><![CDATA[从EM算法的典型应用GMM说起，需要知悉的几个点]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103672045</link><guid>https://blog.csdn.net/zlb872551601/article/details/103672045</guid><author>zlb872551601</author><pubDate>Mon, 23 Dec 2019 19:38:25 +0800</pubDate><description><![CDATA[从EM算法的典型应用GMM说起，需要知悉的几个点

]]></description><category></category></item><item><title><![CDATA[循环神经网络复习2-seq2seq,attention,self-attention(transform)]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103659388</link><guid>https://blog.csdn.net/zlb872551601/article/details/103659388</guid><author>zlb872551601</author><pubDate>Mon, 23 Dec 2019 01:19:15 +0800</pubDate><description><![CDATA[循环神经网络复习2-seq2seq,attention,self-attention

]]></description><category></category></item><item><title><![CDATA[循环神经网络复习1-RNN,LSTM,GRU(为什么讲gru，因为阿里的推荐DIEN的论文中self-attention中大量是基于GRU的）]]></title><link>https://blog.csdn.net/zlb872551601/article/details/103658808</link><guid>https://blog.csdn.net/zlb872551601/article/details/103658808</guid><author>zlb872551601</author><pubDate>Mon, 23 Dec 2019 00:01:22 +0800</pubDate><description><![CDATA[循环神经网络复习1-RNN,LSTM,GRU(为什么将gru)因为阿里的推荐DIEN的论文中self-attention中大量是基于GRU的

]]></description><category></category></item></channel></rss>