<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[qq_41915623的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/qq_41915623</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; qq_41915623]]></copyright><item><title><![CDATA[白话生成式推荐二：MiniOneRec之SFT]]></title><link>https://blog.csdn.net/qq_41915623/article/details/160474645</link><guid>https://blog.csdn.net/qq_41915623/article/details/160474645</guid><author>qq_41915623</author><pubDate>Sat, 25 Apr 2026 15:30:52 +0800</pubDate><description><![CDATA[MiniOneRec SFT 深度分析摘要 MiniOneRec的sft.py脚本实现了基于LLM的序列推荐系统监督微调，将推荐任务重构为语言生成问题。核心流程包括：加载预训练LLM并扩展词表（添加商品语义ID token），构建多任务训练数据（SID序列推荐、SID与商品标题对齐、融合推荐），配置训练器进行微调。关键技术点包括：通过TokenExtender管理新增token，可选冻结LLM仅训练新token embedding，以及多任务数据集的联合训练策略。该方法突破了传统推荐系统在固定embeddi]]></description><category></category></item><item><title><![CDATA[白话生成式推荐二：MiniOneRec之RQ-VAE]]></title><link>https://blog.csdn.net/qq_41915623/article/details/160474397</link><guid>https://blog.csdn.net/qq_41915623/article/details/160474397</guid><author>qq_41915623</author><pubDate>Sat, 25 Apr 2026 15:29:10 +0800</pubDate><description><![CDATA[RQ-VAE是一种残差量化变分自编码器，将高维文本向量（如2048维）压缩为离散的多级语义ID（SID）。其核心流程包含：1）通过MLP编码器降维至32维；2）进行3层残差向量量化（每层256个码本），逐级逼近输入向量；3）通过镜像解码器重建原始向量。最终输出3维离散索引（SID）和32维量化向量，同时计算重建损失和量化损失。该架构通过自监督训练，使离散编码能有效保留原始语义信息。]]></description><category></category></item><item><title><![CDATA[2025年年终总结：工作、开源、运动、请教交流、读书、理财]]></title><link>https://blog.csdn.net/qq_41915623/article/details/157101940</link><guid>https://blog.csdn.net/qq_41915623/article/details/157101940</guid><author>qq_41915623</author><pubDate>Sun, 18 Jan 2026 20:01:17 +0800</pubDate><description><![CDATA[本文分享了作者2025年的工作与生活总结。作为211本硕毕业生，作者在互联网中厂从事推荐算法工作，通过调整工作态度顺利晋升并获得超预期涨薪。业余时间开源了推荐系统学习项目EasyDeepRecommand，获得47星。全年完成165次运动，养成晨跑习惯。通过与人交流打破信息茧房，阅读4.5本理财类书籍，践行长期主义理念。理财收益达2.5，跑赢定存。作者为2025年打90分，2026年计划继续精进推荐技术、稳定运动频率并学习经济知识。全文展现了积极进取的工作态度和平衡发展的生活理念。]]></description><category></category></item><item><title><![CDATA[白话生成式推荐系列一：Tiger-Recommender Systems with Generative Retrieval]]></title><link>https://blog.csdn.net/qq_41915623/article/details/155646041</link><guid>https://blog.csdn.net/qq_41915623/article/details/155646041</guid><author>qq_41915623</author><pubDate>Sat, 06 Dec 2025 19:27:27 +0800</pubDate><description><![CDATA[本文提出了一种基于生成式检索的推荐系统TIGER，通过语义ID替代传统随机ID表示物品。该方法首先利用RQ-VAE将物品内容特征编码为分层语义ID，再使用Transformer模型自回归预测用户下一交互物品的语义ID。实验表明，TIGER在多个数据集上显著优于现有SOTA模型，并展现出更好的泛化能力，尤其在冷启动和多样性推荐场景中表现突出。该方法通过语义结构打破传统推荐系统的反馈环路，实现了相似物品间的知识共享。]]></description><category></category></item><item><title><![CDATA[一文读懂 Hive、Trino 和 SparkSQL：三大大数据 SQL 引擎的全面对比]]></title><link>https://blog.csdn.net/qq_41915623/article/details/150149147</link><guid>https://blog.csdn.net/qq_41915623/article/details/150149147</guid><author>qq_41915623</author><pubDate>Sun, 10 Aug 2025 16:08:10 +0800</pubDate><description><![CDATA[本文对比了三大分布式SQL引擎Hive、Trino和SparkSQL的核心差异。Hive作为最早的SQL-on-Hadoop工具，适合离线批处理和元数据管理；Trino采用MPP架构，支持多数据源联邦查询，延迟极低；SparkSQL则与Spark框架深度集成，擅长批流一体的ETL和机器学习任务。在性能上，Trino适合实时查询，SparkSQL适合大规模计算，Hive稳定性强但速度较慢。建议根据具体场景混合使用：Hive管理元数据，SparkSQL处理ETL，Trino提供实时查询。三者各有所长，选择需结合]]></description><category></category></item><item><title><![CDATA[白话推荐系统(三)：一文看懂DCN-v2(DeepCrossNet-v2)]]></title><link>https://blog.csdn.net/qq_41915623/article/details/148999994</link><guid>https://blog.csdn.net/qq_41915623/article/details/148999994</guid><author>qq_41915623</author><pubDate>Sun, 29 Jun 2025 16:54:14 +0800</pubDate><description><![CDATA[DCN-V2（Deep & Cross Network V2）是谷歌提出的一种用于Web规模排序学习（Learning to Rank）的深度模型，是对原始 DCN（Deep & Cross Network）模型的改进版本。该模型专为工业级大规模推荐系统和广告排序系统设计，旨在高效、精确地捕捉特征之间的交叉信息。]]></description><category></category></item><item><title><![CDATA[激活函数为何能增强神经网络的非线性表达能力？]]></title><link>https://blog.csdn.net/qq_41915623/article/details/148829764</link><guid>https://blog.csdn.net/qq_41915623/article/details/148829764</guid><author>qq_41915623</author><pubDate>Sun, 22 Jun 2025 17:15:50 +0800</pubDate><description><![CDATA[神经网络依靠激活函数突破线性限制，获得强大的非线性表达能力。线性模型（如y=3x+5）只能处理简单关系，但现实问题（如图像识别、语义理解）需要非线性映射（如曲线、交互效应）。若无激活函数，多层网络仅是线性叠加，无法学习复杂模式。ReLU、Sigmoid等激活函数引入非线性变换，使网络能拟合任意连续函数（通用逼近定理）。例如，图像识别需捕捉边缘、纹理等非线性特征，自然语言需理解语义反转等复杂逻辑。激活函数是神经网络实现智能的核心，赋予其解决非线性任务的能力。（149字）]]></description><category></category></item><item><title><![CDATA[抛硬币背后的秘密-通俗玩转二项分布]]></title><link>https://blog.csdn.net/qq_41915623/article/details/147537384</link><guid>https://blog.csdn.net/qq_41915623/article/details/147537384</guid><author>qq_41915623</author><pubDate>Sat, 26 Apr 2025 15:23:19 +0800</pubDate><description><![CDATA[二项分布（Binomial Distribution）是一种离散型概率分布，用于描述在固定次数的独立重复试验中，某事件出现“成功”次数的概率规律。每次试验只有两种可能结果：成功（success）或失败（failure），因此也称为伯努利试验的多次重复。]]></description><category></category></item><item><title><![CDATA[一文看懂矩阵的秩和奇异值及其作用附python实现]]></title><link>https://blog.csdn.net/qq_41915623/article/details/147377480</link><guid>https://blog.csdn.net/qq_41915623/article/details/147377480</guid><author>qq_41915623</author><pubDate>Sun, 20 Apr 2025 23:10:50 +0800</pubDate><description><![CDATA[矩阵的秩和奇异值在数据压缩、降维（如主成分分析）、信号处理和机器学习中具有重要作用，能有效提取数据的主要特征，降低噪声，提高计算效率。]]></description><category></category></item><item><title><![CDATA[解决谷歌浏览器设置bing搜索引擎后搜索白屏问题]]></title><link>https://blog.csdn.net/qq_41915623/article/details/146521533</link><guid>https://blog.csdn.net/qq_41915623/article/details/146521533</guid><author>qq_41915623</author><pubDate>Wed, 26 Mar 2025 10:27:18 +0800</pubDate><description><![CDATA[本人介绍了谷歌浏览器如何设置Bing搜索引擎，以及解决bing搜索引擎白屏的问题]]></description><category></category></item><item><title><![CDATA[白话推荐系统(二)：一文看懂DCN(DeepCrossNet)]]></title><link>https://blog.csdn.net/qq_41915623/article/details/145951277</link><guid>https://blog.csdn.net/qq_41915623/article/details/145951277</guid><author>qq_41915623</author><pubDate>Sat, 01 Mar 2025 18:30:12 +0800</pubDate><description><![CDATA[DCN（Deep & Cross Network，深度交叉网络）是一种用于点击率预估（CTR）的深度学习模型，由Google和斯坦福大学于2017年提出。它结合了显式特征交叉和深度神经网络的优势，能够高效地学习低阶和高阶特征交互，而无需手动特征工程。]]></description><category></category></item><item><title><![CDATA[深入理解Python中的常用数据格式（如csv、json、pickle、npz、h5等）：存储机制与性能解析]]></title><link>https://blog.csdn.net/qq_41915623/article/details/144895200</link><guid>https://blog.csdn.net/qq_41915623/article/details/144895200</guid><author>qq_41915623</author><pubDate>Thu, 02 Jan 2025 21:18:30 +0800</pubDate><description><![CDATA[Feather：最快的读写速度，适合跨语言高效传输。Parquet：高效的列式存储与压缩，适合大规模数据分析。HDF5 (.h5)：强大的数据管理能力，适用于科学计算和工程应用。NPZ (.npz)：专为NumPy数组优化，适合数值计算任务。：灵活的Python对象序列化，适合内部数据持久化。：嵌入式数据库，适合需要SQL查询的小型应用。：灵活的文本格式，适合嵌套数据和配置文件。CSV (.csv)：最简单的文本格式，适合小规模、轻量级的数据交换。]]></description><category></category></item><item><title><![CDATA[开源协议介绍]]></title><link>https://blog.csdn.net/qq_41915623/article/details/143980952</link><guid>https://blog.csdn.net/qq_41915623/article/details/143980952</guid><author>qq_41915623</author><pubDate>Fri, 22 Nov 2024 19:04:02 +0800</pubDate><description><![CDATA[在 GitHub 上，开源项目通常会选择不同的开源许可证（License）来规定代码的使用、分发和修改规则。GPL 是一种“强制开源”的许可证，要求所有基于该代码的衍生项目也必须使用 GPL 协议。BSD 许可证是一种宽松的许可证，与 MIT 类似，但在不同版本间存在一些差异。LGPL 是 GPL 的一个较为宽松的变体，允许在闭源项目中使用开源代码的库。根据具体版本决定，例如 CC-BY 允许商用，CC-BY-NC 不允许商用。MIT 许可证是最常见和最简单的开源许可证之一，强调自由使用和最少限制。]]></description><category></category></item><item><title><![CDATA[全网最全文件格式详解：npy/npz/h5/hdf5/pkl/hdf/tfrecord/parquet/csv/txt/feather]]></title><link>https://blog.csdn.net/qq_41915623/article/details/143220443</link><guid>https://blog.csdn.net/qq_41915623/article/details/143220443</guid><author>qq_41915623</author><pubDate>Thu, 24 Oct 2024 21:51:54 +0800</pubDate><description><![CDATA[在数据科学和机器学习领域，选择合适的文件格式来存储和读取数据是至关重要的。不同的文件格式各有优缺点，适用于不同的应用场景，读取速度和空间占用大小也各有不同。以下将对几种常见文件格式及其介绍：]]></description><category></category></item><item><title><![CDATA[图像金字塔的作用]]></title><link>https://blog.csdn.net/qq_41915623/article/details/141691098</link><guid>https://blog.csdn.net/qq_41915623/article/details/141691098</guid><author>qq_41915623</author><pubDate>Thu, 29 Aug 2024 23:58:32 +0800</pubDate><description><![CDATA[图像金字塔是图像多尺度表达的一种，主要应用与图像分割，是一种以多分辨率来解释图像的有效但概念简单的结构。图像金字塔实际上是一张图片在不同尺度下的集合，即原图的上采样和下采样集合。金字塔的底部是高分辨率图像，而顶部是低分辨率图像。我们将一层一层的图像比喻成金字塔，层级越高，则图像越小，分辨率越低。]]></description><category></category></item><item><title><![CDATA[结合数学原理详解交叉熵损失（Cross Entropy Loss）]]></title><link>https://blog.csdn.net/qq_41915623/article/details/141293051</link><guid>https://blog.csdn.net/qq_41915623/article/details/141293051</guid><author>qq_41915623</author><pubDate>Sun, 18 Aug 2024 10:21:33 +0800</pubDate><description><![CDATA[如：使用Sigmoid激活函数时，假设给定输入为x，label为y，其中y的取值为0或者1，是一个分类问题。再回到神经网络上，神经网络可以看作是一个黑盒，每个类别的输出是一个概率，每个样本的输出可以看作是一次独立抽样，每个label可以看出是一次观测值。当输出a接近0或者1时，Sigmoid函数的梯度时候是非常小的，接近0故导致在使用最小均方差Loss时，模型参数w会学习的非常慢。所以，当与预测值y_hat的概率和真实概率一致，则满足信息熵的最短特性，从而损失最小。根据图中右侧公式，求导后可得p=0.8.]]></description><category></category></item><item><title><![CDATA[算法面试合集：DDPM、DDIM、Transformer、Wide&Deep......]]></title><link>https://blog.csdn.net/qq_41915623/article/details/141086723</link><guid>https://blog.csdn.net/qq_41915623/article/details/141086723</guid><author>qq_41915623</author><pubDate>Sat, 10 Aug 2024 10:19:35 +0800</pubDate><description><![CDATA[算法面试合集：transformer、Swin-T， Wide&Deep等等]]></description><category></category></item><item><title><![CDATA[安卓Android & JAVA校招/实习面试合集:多线程、强软弱虚引用、进程、内存管理、Activity、Fragment......]]></title><link>https://blog.csdn.net/qq_41915623/article/details/141086584</link><guid>https://blog.csdn.net/qq_41915623/article/details/141086584</guid><author>qq_41915623</author><pubDate>Sat, 10 Aug 2024 10:05:30 +0800</pubDate><description><![CDATA[安卓Android、java面试资料合集：内存管理、多线程、进程、强软弱虚应用、Activity]]></description><category></category></item><item><title><![CDATA[深度学习之激活函数]]></title><link>https://blog.csdn.net/qq_41915623/article/details/139618812</link><guid>https://blog.csdn.net/qq_41915623/article/details/139618812</guid><author>qq_41915623</author><pubDate>Wed, 12 Jun 2024 10:09:53 +0800</pubDate><description><![CDATA[激活函数（Activation Function）是一种添加到人工神经网络中的函数，旨在帮助网络学习数据中的复杂模式。在神经元中，输入的input经过一系列加权求和后作用于另一个函数，这个函数就是这里的激活函数。]]></description><category></category></item><item><title><![CDATA[Swin-Transformer白话详解]]></title><link>https://blog.csdn.net/qq_41915623/article/details/139412685</link><guid>https://blog.csdn.net/qq_41915623/article/details/139412685</guid><author>qq_41915623</author><pubDate>Mon, 03 Jun 2024 13:55:49 +0800</pubDate><description><![CDATA[（2）再进行位置编码，这里的位置编码，有一维位置编码，二维位置编码，相对位置编码。实验表明，一维位置编码相对更好；2D(分别计算行和列的编码，然后求和)的效果还不如1D的每一层都加共享的位置编码也没啥太大用!（1）Vit就是将图片切割各个patch, 然后拉平，进行线性映射（linear线性层）；结论:编码有用，但是怎么编码影响不大，干脆用简单的得了。二、ViT(图像transformer)在检测任务中：可能使用2D更好。2.位置编码的作用和选择。]]></description><category></category></item></channel></rss>