<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[SeizeeveryDay的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/SeizeeveryDay</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; SeizeeveryDay]]></copyright><item><title><![CDATA[数据分析编程：SQL,Python or SPL?]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/143728926</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/143728926</guid><author>SeizeeveryDay</author><pubDate>Tue, 12 Nov 2024 08:01:13 +0800</pubDate><description><![CDATA[01计算用户会话次数SQL, Python or SPL用户行为数据表useridaction_typeaction_timeU1059login2023-12-01 18:00:10U1092login2023-12-01 18:00:17U1069login2023-12-01 18:00:22………10分钟没有任何动作或退出后5分钟没有登录则认为会话结束，计算各用户的会话次数。复制代码：...]]></description><category></category></item><item><title><![CDATA[这套卖了 20w 册的数据分析系列书，又出新书了]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/143460695</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/143460695</guid><author>SeizeeveryDay</author><pubDate>Thu, 31 Oct 2024 22:07:10 +0800</pubDate><description><![CDATA[大家好，我是阿粥今天给大家推荐好友俊红的新作品~数据分析圈的同学应该对《对比Excel》学数据分析这一系列图书都有一定的了解。这一系列书截止目前累计销量已经超 20w 册了。时隔两年后，该系列的又一本新书发布，就是下面这本《对比Excel，轻松学习Python数据可视化》。这本书是对比Excel系列的第五本新书。截止目前，对比Excel红橙黄绿青蓝紫七种颜色中已经凑齐五种。下面是关于这本书的主要介...]]></description><category></category></item><item><title><![CDATA[《数据分析实践：专业知识和职场技巧》终于来了！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/140861932</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/140861932</guid><author>SeizeeveryDay</author><pubDate>Thu, 01 Aug 2024 22:03:31 +0800</pubDate><description><![CDATA[大家好，我是阿粥～今天，给大家推荐好友小火龙的最新力作：《数据分析实践：专业知识和职场技巧》。小火龙具有10年+的数据分析经验，也是前阿里、腾讯的数据科学家，有丰富的数据分析经验。以下为作者自述部分～前排提示：文末有购书和送书福利官宣了！这本历时两年半，独自撰写的新书《数据分析实践：专业知识和职场技巧》出版了！1、本书撰写目的近些年认识了很多同学，发现大家共同的困惑主要有以下几点。困惑1：想从事数...]]></description><category></category></item><item><title><![CDATA[2024年，全球大学计算机专业排名！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/140090630</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/140090630</guid><author>SeizeeveryDay</author><pubDate>Sun, 30 Jun 2024 22:03:30 +0800</pubDate><description><![CDATA[来源：菜鸟教程大家好，我是阿粥今天分享一篇关于全球大学计算机排名的内容，同时前排提示，文末会送两本好书~根据 QS 世界大学学科排名，在计算机科学专业排名中，麻省理工大学、卡内基梅隆大学和斯坦福大学位列前三席。中国排名最高的是清华大学位列第 11 位，其次是北京大学位列第 15 位。复旦大学在 2024 年的 QS 排名中计算机学科也取得了好成绩，进入了全球前 50 强。21 到 40 排名中中国...]]></description><category></category></item><item><title><![CDATA[再版到第14版，连续25年美国统计类教材首选，这本统计学神书中文版来啦！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/139640769</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/139640769</guid><author>SeizeeveryDay</author><pubDate>Wed, 12 Jun 2024 22:03:38 +0800</pubDate><description><![CDATA[大家好，我是阿粥今天给大家分享一本很经典的统计学教材，文末还送两本～下面是这本书的介绍：本书连续25年在美国统计类教材排名第一，已被翻译成多国文字，堪称国际版统计教材！这本神书就是《基础统计学（第14版）（双色）》！对每一位学习统计学的小伙伴来说，它就是案头宝典级的存在！为什么学习统计学统计学是我们认识外部世界的基本工具，无论是自然科学还是社会科学，都离不开统计学。统计学与我们的日常生活息息相关，...]]></description><category></category></item><item><title><![CDATA[87页资料下载 | 四大行业12家BI数字化转型案例！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/139309496</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/139309496</guid><author>SeizeeveryDay</author><pubDate>Wed, 29 May 2024 22:03:48 +0800</pubDate><description><![CDATA[随着全球经济走向新的宏观周期，企业面临的挑战也随之发生了变化。在这个快速变化的环境中，“不确定性”已经取代了“稳定性”成为了企业的首要关注点。为了帮助企业更好地应对这一挑战，《2024企业敏捷经营实践合集》可以提供有价值的参考实践。该合集汇集了来自金融、零售消费、互联网及高端制造四大行业、12家先进企业的BI数字化实践，包括数禾科技、某券商、舍得酒业、维他奶、张亮集团、水滴公司、上汽飞凡、零跑汽车...]]></description><category></category></item><item><title><![CDATA[PowerBI里的可视化神器！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/139187249</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/139187249</guid><author>SeizeeveryDay</author><pubDate>Fri, 24 May 2024 22:03:47 +0800</pubDate><description><![CDATA[大家好，我是阿粥今天给大家分享一本不错的新书，是关于POWERBI可视化的，顺便前排提示，文末送一本~Power BI中的Charticulator插件为用户提供了生成视觉和图形的强大功能。对初学者来说，在Charticulator插件中有无数的设置和选项可以组合在一起，它被称为图表世界的DAX。如果你也想学习这个图表世界的DAX，可以看看《Power BI数据可视化指南：让数据鲜活与可定制的视觉...]]></description><category></category></item><item><title><![CDATA[所谓的RFM模型，你真的用对了吗？]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/139051927</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/139051927</guid><author>SeizeeveryDay</author><pubDate>Sun, 19 May 2024 22:03:54 +0800</pubDate><description><![CDATA[大家好，我是阿粥。在上一篇文章中，说句心里话，别轻易把RFM模型写进简历！和大家聊了聊实际使用RFM会遇到的问题：也收到了一些同学的反馈（不少私聊我想知道这些问题的答案）今天，咱们再聊的深入点。一、聚焦一个问题RFM相关的项目，除了上面三个，还有很多深入的问题一问便知真实水平。这些问题的答案，往往都藏在模型与业务思考中，本质是相似的。这次，我主要讲清楚其中一个典型的问题：RFM模型，用平均金额还是...]]></description><category></category></item><item><title><![CDATA[说句心里话，别轻易把RFM模型写进简历！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/138641774</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/138641774</guid><author>SeizeeveryDay</author><pubDate>Thu, 09 May 2024 22:03:52 +0800</pubDate><description><![CDATA[大家好，我是阿粥我看过很多分析师的简历。这么多年过去了，简历项目经历里，仍然有不少提到用SQL或者Python进行RFM建模。项目细节描述各有千秋，但核心逻辑大体绕不开“基于Python对用户数据进行RFM建模，分成x类人群以支撑精细化运营，最终提升xx指标xx%”。一、有什么问题？模型本身没任何问题，有问题的是人。如果没有深刻理解RFM模型从哪里来，到哪里去，只是生硬的套个分析模版。那不是建立模...]]></description><category></category></item><item><title><![CDATA[用户分层还是分群？可别再乱用了！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/138643085</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/138643085</guid><author>SeizeeveryDay</author><pubDate>Tue, 07 May 2024 22:03:58 +0800</pubDate><description><![CDATA[大家好，我是阿粥“用户分层”和“用户分群”，是出现在分析师简历中的高频词汇。很遗憾，有不少同学虽然把相关项目写进简历，但对于“分群”与“分层”的概念还是不甚清楚，面试的时候一问漏洞百出。今天，我们来聊聊分层和分群有何异同。一、关于用户分层1.1 什么是用户分层用户分层，直白的理解，是把用户按照一定的规则划分成不同的层级：概念就是这么简单，再用我之前写过的例子帮助大家理解：想玩游戏了，打开王者荣耀，...]]></description><category></category></item><item><title><![CDATA[太全了！14 种数据异常检测方法总结！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/138203878</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/138203878</guid><author>SeizeeveryDay</author><pubDate>Thu, 25 Apr 2024 22:03:22 +0800</pubDate><description><![CDATA[作者丨Ai，来源丨宅码编辑丨极市平台本文收集整理了公开网络上一些常见的异常检测方法（附资料来源和代码）。不足之处，还望批评指正。前排提示，文末送两本有趣的好书。一、基于分布的方法1. 3sigma基于正态分布，3sigma准则认为超过3sigma的数据为异常点。图1: 3sigmadefthree_sigma(s):
mu,std=np.mean(s),np.std(s)
...]]></description><category></category></item><item><title><![CDATA[Pandas表格样式设置技巧，漂亮！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/136925675</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/136925675</guid><author>SeizeeveryDay</author><pubDate>Thu, 21 Mar 2024 22:03:39 +0800</pubDate><description><![CDATA[大家好，我是阿粥今天给大家分享如何给Pandas DataFrame添加颜色和样式。前排提示，文末送两本商业分析的好书~通过这一方法，增强数据的呈现，使信息的探索和理解不仅内容丰富，而且具有视觉吸引力。Pandas Styler是Pandas库中的一个模块，它提供了创建DataFrame的HTML样式表示的方法。此功能允许在可视化期间自定义DataFrame的视觉外观。Pandas Styler的...]]></description><category></category></item><item><title><![CDATA[Polars ，最强Pandas平替？]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/136494792</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/136494792</guid><author>SeizeeveryDay</author><pubDate>Tue, 05 Mar 2024 22:03:52 +0800</pubDate><description><![CDATA[转自：数据studio大家好，我是阿粥～今天给大家分享关于Polars库的内容，前排提示，文末送两本好书～Polars是一个用于操作结构化数据的高性能DataFrame库，可以说是平替pandas最有潜质的包。Polars其核心部分是用Rust编写的，但该库也提供了Python接口。它的主要特点包括：快速: Polars是从零开始编写的，紧密与机器结合，没有外部依赖。I/O: 对所有常见数据存储层...]]></description><category></category></item><item><title><![CDATA[5个强大的EDA探索性数据分析神器！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/136385722</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/136385722</guid><author>SeizeeveryDay</author><pubDate>Thu, 29 Feb 2024 22:03:42 +0800</pubDate><description><![CDATA[来源：Deephub Imba作者:Sharod Dey大家好，我是阿粥EDA或探索性数据分析是一项耗时的工作，但是由于EDA是不可避免的，所以Python出现了很多自动化库来减少执行分析所需的时间，今天就跟大家聊聊几个好用的库。前排提示：文末送两本好书EDA的主要目标不是制作花哨的图形或创建彩色的图形，而是获得对数据集的理解，并获得对变量之间的分布和相关性的初步见解。我们在以前也介绍过EDA自动...]]></description><category></category></item><item><title><![CDATA[Linear Regression 读书笔记]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/136385291</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/136385291</guid><author>SeizeeveryDay</author><pubDate>Thu, 29 Feb 2024 22:03:42 +0800</pubDate><description><![CDATA[1. 原文内容概要1）首先阐释了线性回归模型（linear regression）的核心概念，包括线性关系的假设（assumption）、参数估计（coefficient estimate）以及最小二乘法（least squares）的应用，并详细讨论了如何评估系数和模型的有效性和精度；2）然后，作者还深入探讨了线性回归在实际问题中的应用，并介绍了如何处理复杂的数据问题，如分类变量（Qualit...]]></description><category></category></item><item><title><![CDATA[Sora模型解密，AI如何让视频制作翻天覆地？！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/136181272</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/136181272</guid><author>SeizeeveryDay</author><pubDate>Mon, 19 Feb 2024 22:03:48 +0800</pubDate><description><![CDATA[新智元报道编辑：编辑部OpenAI首个AI视频模型Sora横空出世，再次创造历史。这个堪称「世界模型」的技术报告也在今天发布了，不过依然没有公开具体训练细节。最近，「现实不存在了」开始全网刷屏。「我们这么快就步入下一个时代了？Sora简直太炸裂了」。「这就是电影制作的未来」！谷歌的Gemini Pro 1.5还没出几个小时的风头，天一亮，全世界的聚光灯就集中在了OpenAI的Sora身上。...]]></description><category></category></item><item><title><![CDATA[klib，一个加速数据清洗的神器！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/135834383</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/135834383</guid><author>SeizeeveryDay</author><pubDate>Wed, 24 Jan 2024 09:03:48 +0800</pubDate><description><![CDATA[今天给大家分享一个klib库。klib提供了一系列非常易于应用的函数，具有合理的默认值，几乎可以用在任何DataFrame上，用于评估数据质量、获得灵感、执行数据清洗和可视化，从而更轻便、更高效的处理Python Pandas DataFrame数据。klib可视化数据-klib.cat_plot(df)#展示分类特征数量和频率
-klib.corr_mat(df)#相关性矩阵
-kl...]]></description><category></category></item><item><title><![CDATA[优衣库畅销款数据分析案例。]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/135812674</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/135812674</guid><author>SeizeeveryDay</author><pubDate>Tue, 23 Jan 2024 22:03:56 +0800</pubDate><description><![CDATA[内容来源授权转载：知乎@李启方从人、货、场三个维度，即客户维度、产品维度、区域维度对优衣库畅销款商品的销售情况进行数据分析和可视化报告展示。（数据来源：2023年某时段取样)分析维度：人（顾客）维度、货（产品）维度、场（区域维度）、时间维度数据指标：销售额、订单数、销量、客户数、利润、客单价及其派生指标等。1、销售分析A类产品包括T恤、当季新品、配件和毛衣；B类产品包括牛仔裤、裙子；C类产品包括袜...]]></description><category></category></item><item><title><![CDATA[SQL实际执行顺序，你真的懂了吗？]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/135710160</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/135710160</guid><author>SeizeeveryDay</author><pubDate>Fri, 19 Jan 2024 22:03:47 +0800</pubDate><description><![CDATA[来源：网络这是一条标准的查询语句:这是我们实际上SQL执行顺序：我们先执行from,join来确定表之间的连接关系，得到初步的数据where对数据进行普通的初步的筛选group by 分组各组分别执行having中的普通筛选或者聚合函数筛选。然后把再根据我们要的数据进行select，可以是普通字段查询也可以是获取聚合函数的查询结果，如果是集合函数，select的查询结果会新增一条字段将查询结果去重...]]></description><category></category></item><item><title><![CDATA[了解GPT大模型，读这本书就够了！]]></title><link>https://blog.csdn.net/SeizeeveryDay/article/details/135687226</link><guid>https://blog.csdn.net/SeizeeveryDay/article/details/135687226</guid><author>SeizeeveryDay</author><pubDate>Thu, 18 Jan 2024 22:03:08 +0800</pubDate><description><![CDATA[大家好，我是阿粥~今天给大家推荐好友佳哥的新书：《GPT图解大模型是怎样构建的》下面是详细的内容：最近发现，当国外OpenAI的权力的游戏反转再反转的时候，国内的AI创业者们除了吃瓜之外也没闲着。有很多程序员正在AIGC赛道中默默发财，有通过短视频做内容爆火，接广告的；有卖AI解决方案的；有卖AI课程的；也有卖AI产品，慢慢做大做强的......更不必说，那些拿下“人均年薪100万”大模型相关岗位...]]></description><category></category></item></channel></rss>