<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[weixin_53520202的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/weixin_53520202</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; weixin_53520202]]></copyright><item><title><![CDATA[Oracle AI Database 26ai：下一代智能数据革命]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/154174917</link><guid>https://blog.csdn.net/weixin_53520202/article/details/154174917</guid><author>weixin_53520202</author><pubDate>Fri, 31 Oct 2025 10:35:57 +0800</pubDate><description><![CDATA[Oracle AI Database 26ai是甲骨文最新推出的AI原生数据库，深度集成了向量搜索、代理式AI、LLM支持等功能，支持关系型、JSON、图、空间等多模态数据融合。相比MySQL、PostgreSQL等传统数据库，其优势在于AI原生支持、统一数据模型和湖仓集成，但成本较高。该数据库提供免费版用于评估，支持云/本地部署。对于需要高性能AI数据融合的企业，26ai是一个值得考虑的选择，但需权衡其学习曲线和部署成本。]]></description><category></category></item><item><title><![CDATA[PostgreSQL]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/153970826</link><guid>https://blog.csdn.net/weixin_53520202/article/details/153970826</guid><author>weixin_53520202</author><pubDate>Mon, 27 Oct 2025 15:09:28 +0800</pubDate><description><![CDATA[mydb=# \g '/home/test1.txt' /home/test1.txt: 权限不够 解决方法： ①：创建和PGSQL一样的用户名，因Linux用户为root，PGSQL用户为postgres，Linux中没有postgres用户，所以没有创建文件的权限。不是md5密码认证，是peer对等认证 peer 认证（对等认证）： 要求操作系统的用户名（Linux 用户）和数据库用户名 相同 才允许登录。●集群（Cluster）：PostgreSQL 的一个实例，管理一组数据库。]]></description><category></category></item><item><title><![CDATA[Apache Zeppelin：一款强大的数据分析和可视化工具]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/153744413</link><guid>https://blog.csdn.net/weixin_53520202/article/details/153744413</guid><author>weixin_53520202</author><pubDate>Wed, 22 Oct 2025 19:49:17 +0800</pubDate><description><![CDATA[Apache Zeppelin是一款开源的交互式数据分析工具，支持Python、SQL、Scala等多种语言，能与Spark、Hadoop等大数据平台无缝集成。它提供类似Jupyter Notebook的交互式界面，内置丰富的数据可视化功能，并支持团队协作。安装简单，通过Web界面即可快速开始数据分析，尤其适合大数据处理、机器学习和实时分析场景。相比Jupyter Notebook，Zeppelin在大数据生态集成和团队协作方面更具优势，是数据科学家和工程师的理想工具选择。]]></description><category></category></item><item><title><![CDATA[#大数据漏斗模型，什么是漏斗模型？漏斗模型有什么用？#Hive#MySQL]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/153416035</link><guid>https://blog.csdn.net/weixin_53520202/article/details/153416035</guid><author>weixin_53520202</author><pubDate>Thu, 16 Oct 2025 19:22:05 +0800</pubDate><description><![CDATA[漏斗模型是分析用户行为路径转化与流失的重要工具。该模型以倒立漏斗形式呈现，通过量化各环节用户留存率（如电商场景：首页访问100%→浏览商品60%→加购30%→下单12%→支付8%），帮助定位关键流失点。核心价值在于识别转化瓶颈、优化产品路径及评估营销效果，广泛应用于电商、App运营等领域。数据分析需明确步骤逻辑关系，计算分步/整体转化率，重点关注异常流失环节。数据仓库中通常通过DWS/ADS层建模，使用窗口函数统计各阶段用户行为数据。该模型本质是诊断用户未能完成最终转化的关键阻碍点。]]></description><category></category></item><item><title><![CDATA[Hive使用远程DataGrip操作权限问题]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151971957</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151971957</guid><author>weixin_53520202</author><pubDate>Mon, 22 Sep 2025 20:16:18 +0800</pubDate><description><![CDATA[这类报错的核心原因是root 用户并不是 Hive 里的 admin。如果是测试/单机环境 → 修改把 root 加入即可。如果是生产/安全环境 → 一般由 Ranger 或 Sentry 控制，需要去对应的管理平台加权限。这样一来，就可以顺利解决这个问题。✍️ 希望这篇文章能帮你快速定位并解决问题。如果对 Hive 授权机制还有疑惑，欢迎在评论区一起交流！]]></description><category></category></item><item><title><![CDATA[问题：订单表（t_order）大约有10亿条记录，产品表(t_product)大约有1万条记录，统计每个产品所有销售额情况，有没有可能会发生数据倾斜，如果有如何优化？]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151971883</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151971883</guid><author>weixin_53520202</author><pubDate>Mon, 22 Sep 2025 20:09:15 +0800</pubDate><description><![CDATA[本文针对大数据分析中10亿级订单表与1万级产品表关联统计销售额的场景，提出数据倾斜解决方案。当爆款产品导致数据分布不均时，建议采用MapJoin广播小表避免Shuffle倾斜，对热点Key使用两阶段聚合或Salting技术分散计算。通过优化Join和聚合阶段，可有效提升任务执行效率。核心方案：大表小表关联用广播Join，热点数据处理用分阶段聚合或Key拆分。]]></description><category></category></item><item><title><![CDATA[YARN RM故障恢复]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151762655</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151762655</guid><author>weixin_53520202</author><pubDate>Tue, 16 Sep 2025 19:24:40 +0800</pubDate><description><![CDATA[本文分析了YARN集群中ResourceManager（RM）故障后的任务恢复机制。当RM挂掉时，新任务无法调度，运行中的任务虽不会立即停止但状态会丢失。YARN提供两种恢复方案：1）ResourceManagerRestart功能，通过持久化状态到外部存储（如HDFS/ZK）实现单RM重启后状态恢复；2）ResourceManagerHA高可用方案，采用Active/Standby双RM架构，借助ZooKeeper实现自动故障转移。两种方案都依赖状态持久化来保证任务不中断，其中HA方案更适合生产环境，能提]]></description><category></category></item><item><title><![CDATA[ZooKeeper 的选举算法]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151762516</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151762516</guid><author>weixin_53520202</author><pubDate>Tue, 16 Sep 2025 19:14:21 +0800</pubDate><description><![CDATA[Apache ZooKeeper 是分布式系统中常用的协调服务框架，提供配置管理、命名服务、分布式锁和集群管理等功能。Leader：负责事务请求的处理和集群内数据同步。Follower：处理非事务请求，参与投票选举，接受 Leader 的同步。Observer：不参与投票，仅作为读请求的分流节点。ZooKeeper 的核心目标是保证数据一致性。因此，当 Leader 节点宕机或网络分区时，ZooKeeper 必须通过选举算法快速选出新的 Leader，保证系统继续正常运行。]]></description><category></category></item><item><title><![CDATA[HDFS 纠删码 Erasure Coding 技术详解：取代副本机制的新选择]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151762425</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151762425</guid><author>weixin_53520202</author><pubDate>Tue, 16 Sep 2025 19:05:43 +0800</pubDate><description><![CDATA[Hadoop3.x引入纠删码技术(EC)替代传统副本机制，通过数据分块和校验编码降低存储开销。相比3副本300%的存储空间，RS(6,3)方案仅需150%空间，但恢复速度较慢。EC适合冷数据存储，副本机制适用于热数据访问。该技术大幅提升了存储效率，但会增加计算复杂度和恢复时间，是HDFS在大规模冷数据场景下的经济高效容错方案。]]></description><category></category></item><item><title><![CDATA[MapReduce 的执行原理]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151724878</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151724878</guid><author>weixin_53520202</author><pubDate>Mon, 15 Sep 2025 19:53:07 +0800</pubDate><description><![CDATA[本文系统介绍了MapReduce分布式计算模型的执行原理。MapReduce采用&quot;分而治之&quot;思想，将任务分解为Map和Reduce两个阶段：Map阶段并行处理数据分片并生成中间键值对；Shuffle阶段对中间结果进行分区、排序和聚合；Reduce阶段完成最终计算。该模型具有编程简单、并行度高、容错性强等优点，但也存在磁盘I/O依赖、迭代计算效率低等局限。虽然新兴计算框架不断涌现，MapReduce作为大数据处理的基石技术，其核心思想和执行流程仍是分布式计算的重要理论基础。]]></description><category></category></item><item><title><![CDATA[ZooKeeper的选举机制详解]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151724631</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151724631</guid><author>weixin_53520202</author><pubDate>Mon, 15 Sep 2025 19:50:43 +0800</pubDate><description><![CDATA[ZooKeeper通过FastLeaderElection算法实现高效选举：节点启动或Leader宕机时进入LOOKING状态，先投票给自己并广播（含SID、ZXID、Epoch）。投票规则按Epoch＞ZXID＞SID优先级比较，接收更优投票后更新并传播。当获半数以上支持时选举结束，胜者成为Leader。该机制确保集群快速恢复，Epoch防止旧节点干扰选举，Observer角色可提升读性能。典型场景下，5节点集群能快速选出并切换Leader，保证分布式系统高可用。]]></description><category></category></item><item><title><![CDATA[一文读懂 Linux 文件系统的两大基石：inode 与 block]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/151079809</link><guid>https://blog.csdn.net/weixin_53520202/article/details/151079809</guid><author>weixin_53520202</author><pubDate>Mon, 01 Sep 2025 19:32:18 +0800</pubDate><description><![CDATA[文件系统的存储结构基于inode和block两个核心概念。inode是文件的&quot;身份证&quot;，存储元数据（权限、大小、时间戳等）和block地址，但不包含文件名和内容；block是数据存储的最小单位，存放文件实际内容。文件名与inode号的映射记录在目录项中，实现文件名与文件的分离。大文件通过多级索引（直接/间接块）存储block地址。理解inode和block的关系有助于掌握文件存储机制，相关命令如ls -i、df -i可查看inode和block使用情况。简言之，inode管理文件身份和位]]></description><category></category></item><item><title><![CDATA[Java equals方法揭秘：为何必须重写？]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/149124336</link><guid>https://blog.csdn.net/weixin_53520202/article/details/149124336</guid><author>weixin_53520202</author><pubDate>Fri, 04 Jul 2025 20:31:11 +0800</pubDate><description><![CDATA[文章摘要：本文探讨了Java中重写equals方法的重要性及实现细节。通过Student类示例，分析了默认equals方法（比较地址值）与重写后方法（比较内容值）的区别。重写后的equals方法包含三部分逻辑：快速判断同一引用、类型校验和核心字段值比较。重点指出业务场景中通常需要依据核心字段（如学生ID）来判断对象语义相等性，而非内存地址。文中还介绍了Java 16+的instanceof增强语法和Java 9的紧凑字符串优化机制。]]></description><category></category></item><item><title><![CDATA[编程实现三角形面积计算]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/149077828</link><guid>https://blog.csdn.net/weixin_53520202/article/details/149077828</guid><author>weixin_53520202</author><pubDate>Wed, 02 Jul 2025 20:37:32 +0800</pubDate><description><![CDATA[本文介绍了三角形分类及编程实现面积计算的原理与方法。首先概述了等腰三角形、直角三角形和其他三角形的分类，指出编程计算面积时需先验证三条边能否构成三角形（两边之和大于第三边）。为解决底边选择难题，文章推荐使用海伦公式，通过半周长简化计算。最后给出Java代码示例，包含三角形验证、周长计算及利用海伦公式求面积的实现方法。该方案通过数学公式优化，有效减少了编程中的判断逻辑和计算量。]]></description><category></category></item><item><title><![CDATA[数组遍历技巧：快速定位元素首次与末次位置]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/149031144</link><guid>https://blog.csdn.net/weixin_53520202/article/details/149031144</guid><author>weixin_53520202</author><pubDate>Mon, 30 Jun 2025 20:44:58 +0800</pubDate><description><![CDATA[摘要：本文介绍了两种在数组中查找元素位置的遍历方法。第一种是正向查找元素首次出现的位置，通过顺序遍历数组返回匹配元素的索引。第二种是反向查找元素末次出现的位置，通过倒序遍历数组实现。两种方法在未找到元素时分别返回-1和-2作为标识。代码示例展示了这两种简单实用的数组遍历技巧。]]></description><category></category></item><item><title><![CDATA[Java循环打印1-100奇数技巧]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/148932458</link><guid>https://blog.csdn.net/weixin_53520202/article/details/148932458</guid><author>weixin_53520202</author><pubDate>Thu, 26 Jun 2025 20:26:32 +0800</pubDate><description><![CDATA[本文探讨了在Java中使用循环语句输出1-100奇数的实现方法。作者对比了for循环和while循环的不同实现方式，发现while循环中使用continue语句会导致循环变量无法自增的问题。最终提出了在while循环中直接判断奇数输出的解决方案，避免了continue带来的问题。文章建议编程时不要局限于单一思路，应考虑多种实现方法，并欢迎读者分享其他解决方案。]]></description><category></category></item><item><title><![CDATA[揭秘&与&&的本质区别]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/148905806</link><guid>https://blog.csdn.net/weixin_53520202/article/details/148905806</guid><author>weixin_53520202</author><pubDate>Wed, 25 Jun 2025 19:54:06 +0800</pubDate><description><![CDATA[Java逻辑运算符&amp;和&amp;&amp;的区别：&amp;既是逻辑与也是位运算符，需计算两边表达式；&amp;&amp;是短路逻辑与，若第一个表达式为false则直接返回false不计算第二个表达式。代码示例中，&amp;&amp;先判断第一个布尔值，若false直接输出结果；&amp;则必须输入两个布尔值进行判断。短路运算符&amp;&amp;效率更高，适合逻辑判断场景。]]></description><category></category></item><item><title><![CDATA[IntelliJ IDEA独特注释技巧揭秘]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/148877835</link><guid>https://blog.csdn.net/weixin_53520202/article/details/148877835</guid><author>weixin_53520202</author><pubDate>Tue, 24 Jun 2025 19:50:25 +0800</pubDate><description><![CDATA[IntelliJ IDEA的注释功能可以添加带边框按键提示和图标，使用&lt;shortcutActionId&gt;和&lt;icon src&gt;标签实现。其中actionId可自定义文字显示醒目提示，支持Run、Debug等操作；icon则需使用预定义图标如AllIcons.Actions.Execute等，且仅对src目录下的类有效。该功能不同于普通注释，是IDE提供的智能提示，可用于重要方法注释展示。]]></description><category></category></item><item><title><![CDATA[Java变量与常量的核心原理]]></title><link>https://blog.csdn.net/weixin_53520202/article/details/148877248</link><guid>https://blog.csdn.net/weixin_53520202/article/details/148877248</guid><author>weixin_53520202</author><pubDate>Tue, 24 Jun 2025 19:27:54 +0800</pubDate><description><![CDATA[本文介绍了Java中常量和变量的概念及区别。常量使用final关键字修饰，其值不可改变；变量则可在程序运行中改变值。文章指出变量初始值实际上是一个常量，并通过int sum=10的例子说明这种关系。从存储原理看，常量存入常量池，变量存入栈内存，变量存储的是常量的地址。最后用桌面快捷方式作类比：快捷方式（变量）可修改指向的路径（常量），而路径本身不变，形象解释了变量与常量的本质区别。]]></description><category></category></item></channel></rss>