<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[DrLai的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/DrLai</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; DrLai]]></copyright><item><title><![CDATA[什么是推荐系统中的负反馈？用户的“踩“和“不感兴趣“怎么用？]]></title><link>https://blog.csdn.net/DrLai/article/details/160199704</link><guid>https://blog.csdn.net/DrLai/article/details/160199704</guid><author>DrLai</author><pubDate>Thu, 16 Apr 2026 09:28:54 +0800</pubDate><description><![CDATA[你有没有遇到过这种情况：刷短视频时，系统反复推送你讨厌的内容，你点了"不感兴趣"，结果过一会儿类似的视频又冒出来了？或者你明明点了"踩"，那个博主的内容还是不断出现在推荐流里？]]></description><category></category></item><item><title><![CDATA[什么是特征交叉？为什么它是推荐系统的秘密武器？]]></title><link>https://blog.csdn.net/DrLai/article/details/160198852</link><guid>https://blog.csdn.net/DrLai/article/details/160198852</guid><author>DrLai</author><pubDate>Thu, 16 Apr 2026 09:17:21 +0800</pubDate><description><![CDATA[想象一下，你去餐厅点菜。服务员问你："您喜欢辣吗？"你说喜欢。又问："您喜欢海鲜吗？"你也喜欢。但如果服务员直接问："您喜欢麻辣小龙虾吗？"——这个组合问题的答案，可能比单独问"辣"和"海鲜"更能预测你的选择。]]></description><category></category></item><item><title><![CDATA[什么是实时竞价(RTB)？广告竞价的毫秒级博弈]]></title><link>https://blog.csdn.net/DrLai/article/details/160153179</link><guid>https://blog.csdn.net/DrLai/article/details/160153179</guid><author>DrLai</author><pubDate>Tue, 14 Apr 2026 17:43:11 +0800</pubDate><description><![CDATA[想象一下，你正在浏览一个新闻网站，页面加载的瞬间，右上角出现了一条精准匹配你兴趣的广告——可能是你昨天刚搜索过的跑鞋，或是你关注已久的电子产品。你有没有想过，这条广告是如何在毫秒之间"空降"到你的屏幕上的？]]></description><category></category></item><item><title><![CDATA[内容推荐和协同过滤各有什么优缺点？]]></title><link>https://blog.csdn.net/DrLai/article/details/160152989</link><guid>https://blog.csdn.net/DrLai/article/details/160152989</guid><author>DrLai</author><pubDate>Tue, 14 Apr 2026 17:40:33 +0800</pubDate><description><![CDATA[想象一下，你走进一家书店。店员A说："你喜欢科幻小说？那我推荐这本，也是科幻题材，讲的是太空探索。"店员B说："很多和你一样喜欢《三体》的读者，后来都买了这本书，虽然它是悬疑题材。"]]></description><category></category></item><item><title><![CDATA[图神经网络(GNN)怎么用在推荐系统里？]]></title><link>https://blog.csdn.net/DrLai/article/details/160114920</link><guid>https://blog.csdn.net/DrLai/article/details/160114920</guid><author>DrLai</author><pubDate>Mon, 13 Apr 2026 15:39:38 +0800</pubDate><description><![CDATA[文章摘要 图神经网络（GNN）通过将用户、商品及其交互建模为图结构，利用消息传递机制捕捉高阶关系，显著提升推荐系统效果。相比传统协同过滤仅分析直接交互，GNN能发现&quot;朋友的朋友&quot;等潜在关联，并融合多源异构数据（如用户画像、商品属性）。典型应用包括Pinterest的PinSage（随机游走采样）、阿里的EGES（异构图建模）和轻量级LightGCN。尽管面临计算成本高、过平滑等挑战，GNN通过邻居采样、图分区等技术已在电商、社交、内容推荐等场景取得突破，成为解决稀疏性和冷启动问题的有效方]]></description><category></category></item><item><title><![CDATA[什么是大模型推荐的成本控制与推理加速？]]></title><link>https://blog.csdn.net/DrLai/article/details/160114732</link><guid>https://blog.csdn.net/DrLai/article/details/160114732</guid><author>DrLai</author><pubDate>Mon, 13 Apr 2026 15:36:52 +0800</pubDate><description><![CDATA[摘要 大模型推荐系统面临高成本与低效的挑战，本文提出了一套优化方案。通过漏斗架构分层处理，大模型仅需处理0.1%的数据，成本降低两个数量级；采用模型蒸馏技术，让小模型学习大模型的能力，推理成本可降10倍；结合量化技术将模型压缩为INT8/INT4格式，速度提升2-3倍；利用推理引擎优化和缓存策略，进一步提升吞吐量和响应速度。这些方法可在保持90%效果的同时，将成本降至1/10，推理速度提高3-5倍，为电商、新闻、视频等推荐场景提供了实用的解决方案。]]></description><category></category></item><item><title><![CDATA[怎么用大模型生成推荐的训练数据？Data Augmentation怎么做？]]></title><link>https://blog.csdn.net/DrLai/article/details/160047891</link><guid>https://blog.csdn.net/DrLai/article/details/160047891</guid><author>DrLai</author><pubDate>Sat, 11 Apr 2026 11:18:11 +0800</pubDate><description><![CDATA[想象你开了一家新餐厅，开业第一天几乎没有顾客评价。这时候你该怎么办？是等着慢慢积累口碑，还是想个办法先让菜单看起来更诱人？推荐系统也面临同样的困境。一个推荐模型要训练得好，需要海量的用户行为数据——谁点了什么、看了什么、买了什么。但现实中，冷启动问题无处不在：新用户没有历史记录，新商品没有交互数据，小众品类样本稀疏。没有足够的数据，模型就像没有食材的厨师，再厉害的算法也做不出好菜。大语言模型（LLM）的出现，给这个问题提供了一个全新的解法。它不仅能"理解"数据，还能"创造"数据。]]></description><category></category></item><item><title><![CDATA[什么是大模型多轮对话式推荐？如何维护对话上下文？]]></title><link>https://blog.csdn.net/DrLai/article/details/160046648</link><guid>https://blog.csdn.net/DrLai/article/details/160046648</guid><author>DrLai</author><pubDate>Sat, 11 Apr 2026 11:09:10 +0800</pubDate><description><![CDATA[大模型多轮对话式推荐是一种利用大语言模型能力，通过自然语言对话逐步理解用户需求并提供个性化推荐的系统。其核心特点是主动引导、语义理解和上下文关联。系统通过分层管理对话上下文（会话级状态、用户级画像和系统级知识），采用Prompt拼接、向量检索或状态总结等技术方案维护上下文。相比传统推荐系统，它具有自然交互、灵活性强等优势，但也存在响应延迟、成本高等挑战。这种技术特别适合旅游规划、高客单价商品咨询等复杂场景。未来发展趋势包括Agent架构、RAG增强和多模态扩展。维护对话上下文需要在信息完整性和成本之间找到平]]></description><category></category></item><item><title><![CDATA[什么是连续特征离散化？分桶(Bucketing)有什么技巧？]]></title><link>https://blog.csdn.net/DrLai/article/details/160014005</link><guid>https://blog.csdn.net/DrLai/article/details/160014005</guid><author>DrLai</author><pubDate>Fri, 10 Apr 2026 11:07:51 +0800</pubDate><description><![CDATA[摘要 连续特征离散化是将连续数值转化为有限离散类别的技术，如将年龄分段为&quot;青年&quot;、&quot;中年&quot;等。主要方法包括等宽分桶（均匀划分区间）、等频分桶（保证每桶样本数相近）和基于业务规则的分桶。该技术能增强模型鲁棒性、引入非线性关系并提升可解释性，但可能造成信息损失。实际应用中需结合WOE编码、IV值分析等技巧，并注意训练与预测的一致性。典型应用场景包括风控评分卡和推荐系统，未来趋势是自动化分桶和自适应调整边界。离散化的本质是通过合理&quot;模糊&quot;来提取数据关键特]]></description><category></category></item><item><title><![CDATA[大模型能直接做推荐吗？和传统推荐模型有什么区别？]]></title><link>https://blog.csdn.net/DrLai/article/details/160013107</link><guid>https://blog.csdn.net/DrLai/article/details/160013107</guid><author>DrLai</author><pubDate>Fri, 10 Apr 2026 11:01:29 +0800</pubDate><description><![CDATA[想象一下，你走进一家书店。

**传统推荐**就像一位经验丰富的店员。他记得你上次买了《三体》，所以推荐你买《流浪地球》；他看到很多买《百年孤独》的人也买了《霍乱时期的爱情》，于是把这两本书放在一起。这种推荐很精准，但有个问题——如果店里新到了一本小众的科幻小说，他无法立即推荐给你，因为他没有这本书的销售数据。]]></description><category></category></item><item><title><![CDATA[什么是用户短期兴趣和长期兴趣建模？]]></title><link>https://blog.csdn.net/DrLai/article/details/159982184</link><guid>https://blog.csdn.net/DrLai/article/details/159982184</guid><author>DrLai</author><pubDate>Thu, 09 Apr 2026 12:14:27 +0800</pubDate><description><![CDATA[想象这样一个场景：你平时喜欢看科技评测视频，这是你的长期爱好。但某天你突然对露营产生了兴趣，连续看了几个露营装备的视频。这时候，推荐系统应该怎么给你推荐内容？]]></description><category></category></item><item><title><![CDATA[什么是曝光去偏(Exposure Debiasing)？怎么处理没曝光的物品？]]></title><link>https://blog.csdn.net/DrLai/article/details/159978966</link><guid>https://blog.csdn.net/DrLai/article/details/159978966</guid><author>DrLai</author><pubDate>Thu, 09 Apr 2026 10:57:06 +0800</pubDate><description><![CDATA[想象你开了一家书店，店员总是把畅销书摆在最显眼的位置，而那些小众但优质的书籍被藏在角落里。久而久之，畅销书越来越畅销，好书却无人问津——这不是因为书不好，而是因为它们根本没被看到。]]></description><category></category></item><item><title><![CDATA[推荐系统的多样性(Diversity)怎么衡量？怎么避免推荐结果太单一？]]></title><link>https://blog.csdn.net/DrLai/article/details/159958631</link><guid>https://blog.csdn.net/DrLai/article/details/159958631</guid><author>DrLai</author><pubDate>Wed, 08 Apr 2026 15:22:34 +0800</pubDate><description><![CDATA[本文探讨推荐系统多样性的衡量与优化方法。首先解释多样性概念，指出其重要性在于打破信息茧房、提升用户体验和平台生态健康。然后详细介绍多样性衡量指标，包括个体层面的ILD、类别覆盖度、时间分散度，以及整体层面的基尼系数、香农熵和覆盖率。文章分析多样性优化的优缺点，并给出实际应用方案：多路召回、MMR重排序算法、业务规则打散、探索机制等。最后强调多样性不仅是技术问题，更是生态治理问题，需要在&quot;给用户想要的&quot;和&quot;给用户需要的&quot;之间寻找平衡。推荐系统应既懂用户偏好，又有勇气带用]]></description><category></category></item><item><title><![CDATA[什么是LLM做推荐的三种范式？Prompt-based、Embedding-based、Fine-tuning深度解析]]></title><link>https://blog.csdn.net/DrLai/article/details/159956925</link><guid>https://blog.csdn.net/DrLai/article/details/159956925</guid><author>DrLai</author><pubDate>Wed, 08 Apr 2026 15:03:10 +0800</pubDate><description><![CDATA[第一种：服务员直接问你"想吃什么"，然后根据你的描述现场思考推荐（像Prompt-based）第二种：餐厅已经把所有菜品的特色标签化，快速匹配你的口味偏好（像Embedding-based）第三种：服务员跟你相处久了，记住了你每次来点的菜，越来越懂你的口味（像Fine-tuning）这就是大语言模型（LLM）做推荐的三种核心范式。随着ChatGPT的爆火，越来越多人开始探索：能不能让"懂一切"的LLM来帮我们做推荐？本文将深入解析这三种技术路线，帮你理解它们各自的优势和适用场景。]]></description><category></category></item><item><title><![CDATA[什么是信息茧房？推荐系统怎么平衡个性化和多样性？]]></title><link>https://blog.csdn.net/DrLai/article/details/159752931</link><guid>https://blog.csdn.net/DrLai/article/details/159752931</guid><author>DrLai</author><pubDate>Thu, 02 Apr 2026 10:17:23 +0800</pubDate><description><![CDATA[你有没有这样的经历：刷短视频时，刚点了几条猫咪视频，接下来满屏都是猫；看了几篇科技新闻，推荐流里再也看不到其他类型的内容。久而久之，你发现自己被困在一个"舒适区"里，看到的东西越来越单一，观点也越来越固化。]]></description><category></category></item><item><title><![CDATA[什么是RAG文档切分策略？]]></title><link>https://blog.csdn.net/DrLai/article/details/159752146</link><guid>https://blog.csdn.net/DrLai/article/details/159752146</guid><author>DrLai</author><pubDate>Thu, 02 Apr 2026 09:36:58 +0800</pubDate><description><![CDATA[想象一下你正在图书馆查资料写论文。你面前有100本书，每本都有500页厚，但你要找的答案可能只在某本书的第237页的一段落里。如果让你一本一本从头到尾翻，可能要花上几天时间。但如果有人把这些书提前拆成了章节甚至页码摘要，你就能在5分钟内锁定目标。这正是RAG（检索增强生成）系统中文档切分的魔力所在。]]></description><category></category></item><item><title><![CDATA[什么是Semantic Chunking？与固定长度切分有什么区别？]]></title><link>https://blog.csdn.net/DrLai/article/details/159716016</link><guid>https://blog.csdn.net/DrLai/article/details/159716016</guid><author>DrLai</author><pubDate>Wed, 01 Apr 2026 09:42:54 +0800</pubDate><description><![CDATA[文章摘要： Semantic Chunking是一种基于语义理解的智能文本切分技术，通过分析句子间的语义相似度，在主题转换处自然切分，确保每个文本块语义完整。相比固定长度切分（机械按字符数切割），它能避免关键信息被截断，提升问答系统、知识库等场景的检索准确性。实现时需对句子进行向量化并计算相似度，虽然计算成本较高，但对语义连贯性要求高的应用（如法律、医疗文本）价值显著。固定长度切分则更适合实时处理或成本敏感场景。随着大模型发展，Semantic Chunking正与自适应切分等技术结合，成为处理复杂文本的重]]></description><category></category></item><item><title><![CDATA[知识融合(Knowledge Fusion)是什么？多个知识源怎么整合？]]></title><link>https://blog.csdn.net/DrLai/article/details/159714422</link><guid>https://blog.csdn.net/DrLai/article/details/159714422</guid><author>DrLai</author><pubDate>Wed, 01 Apr 2026 09:38:26 +0800</pubDate><description><![CDATA[知识融合是将多个异构知识源的信息进行统一整合，消除冲突并补充缺失，形成一致完整的知识表示。其核心流程包括模式对齐（统一术语和结构）、实体对齐（识别相同实体）、冲突消解（解决信息矛盾）和知识补全（整合互补信息）。关键技术涵盖字符串相似度计算、属性匹配、结构分析和深度学习嵌入等。虽然能提升信息完整性和准确性，但面临技术复杂度高、计算量大、数据质量依赖源等挑战。适用于需要整合多源数据的智能系统，如搜索引擎、推荐系统和知识图谱构建。]]></description><category></category></item><item><title><![CDATA[什么是GraphRAG？知识图谱如何增强RAG系统？]]></title><link>https://blog.csdn.net/DrLai/article/details/159677312</link><guid>https://blog.csdn.net/DrLai/article/details/159677312</guid><author>DrLai</author><pubDate>Tue, 31 Mar 2026 10:15:12 +0800</pubDate><description><![CDATA[本文介绍了GraphRAG技术，它通过将知识图谱与检索增强生成（RAG）系统相结合，解决了传统RAG在处理知识关联方面的局限性。GraphRAG首先从文档中抽取实体和关系构建知识图谱，在用户查询时进行图结构检索和多跳推理，从而提供更有组织性和关联性的答案。相比传统RAG仅依赖向量相似度检索，GraphRAG具有关系感知、多跳推理和消歧能力强等优势，特别适用于金融风控、医疗问答、电商推荐等需要复杂关联分析的场景。尽管构建和维护成本较高，GraphRAG仍展现出解决复杂知识关联问题的巨大潜力，未来可能发展为与传]]></description><category></category></item><item><title><![CDATA[什么是RAG中的幻觉问题？引用溯源如何实现？]]></title><link>https://blog.csdn.net/DrLai/article/details/159673687</link><guid>https://blog.csdn.net/DrLai/article/details/159673687</guid><author>DrLai</author><pubDate>Tue, 31 Mar 2026 09:35:36 +0800</pubDate><description><![CDATA[本文探讨了RAG（检索增强生成）系统中的幻觉问题及其解决方案。RAG幻觉指系统生成看似合理但实际与检索文档不符或缺乏依据的回答，这种&quot;披着事实外衣的谎言&quot;比传统LLM幻觉更具误导性。文章从检索层、理解层和生成层分析了幻觉成因，并提出混合检索策略、重排序模型、优化chunk切分等缓解方法。在引用溯源方面，介绍了chunk打标签、后处理验证等技术方案，以及inline标注、脚注引用等展示形式。最后分析了企业知识库、医疗咨询等典型应用场景，并指出当前局限性与改进方向。通过系统性的技术手段，可以]]></description><category></category></item></channel></rss>