<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[liulanba的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/liulanba</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; liulanba]]></copyright><item><title><![CDATA[# Checkpoint 与 ONNX 详解：区别、关系、转换方式与原理]]></title><link>https://blog.csdn.net/liulanba/article/details/158432583</link><guid>https://blog.csdn.net/liulanba/article/details/158432583</guid><author>liulanba</author><pubDate>Thu, 26 Feb 2026 22:16:40 +0800</pubDate><description><![CDATA[PyTorch的Checkpoint（.pth）和ONNX（.onnx）是两种不同的模型保存格式。.pth文件仅保存模型权重，依赖原始代码才能重建完整模型；而.onnx文件包含计算图、权重和输入输出约定，可独立运行。 关键区别： .pth是权重快照，需配合PyTorch代码使用 .onnx是完整计算图，支持跨平台部署 转换过程：先用.pth加载权重，再通过前向传播生成.onnx文件。 .pth适用于训练恢复，.onnx更适合生产部署，无需依赖原始框架。]]></description><category></category></item><item><title><![CDATA[大模型微调完全指南：从理论到实践]]></title><link>https://blog.csdn.net/liulanba/article/details/157687254</link><guid>https://blog.csdn.net/liulanba/article/details/157687254</guid><author>liulanba</author><pubDate>Tue, 03 Feb 2026 11:13:33 +0800</pubDate><description><![CDATA[本文全面解析大语言模型微调技术，涵盖从基本原理到工业实践的关键内容。文章首先阐述微调的必要性，指出预训练模型在领域专业性、输出控制等方面的局限，并通过ROI分析展示微调带来的显著性能提升（准确率可提高25-35%）。随后系统介绍训练全流程，对比全参微调与参数高效方法（PEFT）的优劣，重点剖析LoRA和QLoRA的核心原理与数学推导。最后提供工业级代码实现指南，强调数据工程、评估调优和部署优化的关键要点，为不同应用场景（如智能客服、代码生成等）提供针对性解决方案。]]></description><category></category></item><item><title><![CDATA[AI Agent技术指南--Agentic RAG]]></title><link>https://blog.csdn.net/liulanba/article/details/157686533</link><guid>https://blog.csdn.net/liulanba/article/details/157686533</guid><author>liulanba</author><pubDate>Tue, 03 Feb 2026 10:34:50 +0800</pubDate><description><![CDATA[RAG技术演进：从传统到智能代理的完全指南 本文系统介绍了检索增强生成(RAG)技术的演进过程，重点对比了传统RAG与新型Agentic RAG的差异。传统RAG通过向量检索结合LLM生成答案，但存在单次检索、固定策略、无质量评估等五大局限性。Agentic RAG引入自主AI代理能力，具备问题规划、多工具调用、结果反思等智能特性，能够动态调整检索策略，处理复杂查询场景。文章详细阐述了两种架构的核心组件、实现方式，并提供了完整代码示例，最后总结了RAG技术的最佳实践和未来发展方向。]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第五部分：Memory、Retrieval 与 Tool/Action]]></title><link>https://blog.csdn.net/liulanba/article/details/149584004</link><guid>https://blog.csdn.net/liulanba/article/details/149584004</guid><author>liulanba</author><pubDate>Fri, 23 Jan 2026 16:56:21 +0800</pubDate><description><![CDATA[本文介绍了AI Agent系统的三大核心模块：Memory（记忆模块）、Retrieval（检索模块）和Tool/Action（工具/动作模块）。其中重点阐述了Memory模块的实现，包括其层次结构（短期记忆和长期记忆）、存储方式（内存缓存、向量数据库等）以及具体的ContextDataCache实现方案。该缓存服务支持TTL过期机制、LRU淘汰策略等特性，能有效提升系统性能。文章还提供了Python代码示例，展示了如何实现一个智能缓存系统，包括数据获取、缓存更新和降级处理等关键功能。]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第四部分：Transformer架构与实践]]></title><link>https://blog.csdn.net/liulanba/article/details/122405296</link><guid>https://blog.csdn.net/liulanba/article/details/122405296</guid><author>liulanba</author><pubDate>Fri, 23 Jan 2026 11:32:39 +0800</pubDate><description><![CDATA[Transformer架构与实践指南摘要 本文系统介绍了Transformer架构及其在Agent系统中的核心应用。主要内容包括： Transformer基础：解释其基于注意力机制的序列处理能力，以及作为大语言模型(LLM)的实现形式。 Agent系统架构：展示Transformer与Prompt、RAG等模块的协同关系，形成完整的智能对话系统。 核心功能：详细说明Transformer在Agent中的三大作用：语义理解、文本生成和上下文记忆。 实现流程：从输入处理到输出生成的完整工作流程，包括分词、编码、]]></description><category></category></item><item><title><![CDATA[OCR技术全流程详解：从原理到实现]]></title><link>https://blog.csdn.net/liulanba/article/details/156617449</link><guid>https://blog.csdn.net/liulanba/article/details/156617449</guid><author>liulanba</author><pubDate>Mon, 05 Jan 2026 22:13:40 +0800</pubDate><description><![CDATA[本文深入解析OCR技术全流程，重点介绍了CRNN模型的架构原理和实现细节。文章首先概述OCR技术的发展历程，从传统方法到深度学习模型如CRNN、PaddleOCR等。然后详细剖析CRNN的三层结构：CNN特征提取层通过非对称池化处理文本图像；RNN层使用双向LSTM捕获字符间依赖关系；分类层映射到字符概率。特别讲解了CTC Loss如何解决序列对齐问题，通过空白符机制处理变长文本识别。全文涵盖从数据准备到模型训练、验证评估的完整流程，为OCR技术实现提供了全面指导。]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第六部分：实战项目]]></title><link>https://blog.csdn.net/liulanba/article/details/127665362</link><guid>https://blog.csdn.net/liulanba/article/details/127665362</guid><author>liulanba</author><pubDate>Wed, 31 Dec 2025 22:45:43 +0800</pubDate><description><![CDATA[本文介绍了电影解说AI Agent项目的设计与实现，通过LangChain框架构建了一个能够生成专业电影解说文案的智能系统。项目核心特点包括结构化输出（基于Pydantic模型）、多API支持（OpenAI/DeepSeek）、对话记忆功能和多轮对话能力。系统架构包含LLM引擎、输出解析器、记忆系统等组件，采用JSON解析和Pydantic验证机制确保输出质量。文章详细展示了MovieResponse数据模型定义和输出解析器实现，为开发者提供了构建专业领域AI Agent的完整参考方案。]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第一部分：基础理论]]></title><link>https://blog.csdn.net/liulanba/article/details/149584046</link><guid>https://blog.csdn.net/liulanba/article/details/149584046</guid><author>liulanba</author><pubDate>Wed, 31 Dec 2025 22:37:40 +0800</pubDate><description><![CDATA[本文档全面介绍了AI Agent的技术体系，涵盖从基础理论到实践应用的关键组件。AI Agent作为智能系统，其核心架构包括大语言模型(LLM)、LangChain框架、提示工程、RAG技术、向量数据库等。文档详细解析了LLM的发展历程和在AI Agent中的核心作用，包括意图理解、任务规划等关键功能，并展示了LLM的工作原理和使用模式。此外，还介绍了技术栈概览和学习路径，为开发者提供从基础到实践的完整指导。]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第二部分：开发框架]]></title><link>https://blog.csdn.net/liulanba/article/details/149584983</link><guid>https://blog.csdn.net/liulanba/article/details/149584983</guid><author>liulanba</author><pubDate>Wed, 31 Dec 2025 22:14:00 +0800</pubDate><description><![CDATA[AI Agent技术指南：从基础到实践 本指南全面介绍了构建AI Agent所需的核心技术栈，涵盖理论基础、开发框架和实战应用三大模块。主要内容包括： 基础理论：详细解析大语言模型(LLM)原理、提示工程技巧、RAG检索增强生成技术及向量数据库知识 开发框架：深入讲解LangChain框架、LangGraph图工作流和Agent智能代理的实现方法 监控管理：介绍可观测性概念及LangSmith监控平台、PromptLayer管理平台的使用 实战案例：通过电影解说AI Agent项目演示完整开发流程 技术栈涵]]></description><category></category></item><item><title><![CDATA[AI Agent技术完整指南 第三部分：Agent Observability]]></title><link>https://blog.csdn.net/liulanba/article/details/156465738</link><guid>https://blog.csdn.net/liulanba/article/details/156465738</guid><author>liulanba</author><pubDate>Wed, 31 Dec 2025 22:12:44 +0800</pubDate><description><![CDATA[AI Agent可观测性指南摘要 可观测性（Observability）通过日志、指标和追踪三大支柱帮助诊断AI Agent系统行为，解决LLM黑盒性、非确定性和复杂调用链等挑战。核心指标包括： LLM调用指标（Token用量、延迟、成本） Agent执行指标（成功率、工具调用、迭代次数） RAG检索指标（相关性分数、检索时间） 可观测性能显著提升问题定位效率（90%）、降低成本（30%）并优化Prompt效果（50%），是AI Agent系统高效运维的关键基础设施。]]></description><category></category></item><item><title><![CDATA[机器学习模型训练参数调优完整指南]]></title><link>https://blog.csdn.net/liulanba/article/details/149583912</link><guid>https://blog.csdn.net/liulanba/article/details/149583912</guid><author>liulanba</author><pubDate>Wed, 31 Dec 2025 21:17:04 +0800</pubDate><description><![CDATA[《大模型训练参数调优指南》摘要：本文全面介绍大模型训练的关键参数调优方法，涵盖硬件资源配置、核心训练参数和优化策略。重点解析Batch Size、学习率、优化器等12个核心参数的调优技巧，提供GPU显存管理、梯度累积等实用方案。指南包含YOLO训练实战案例，通过可视化对比不同参数效果，帮助开发者平衡训练速度、资源利用率和模型性能。针对常见问题提供解决方案，如显存不足时采用混合精度训练和梯度累积技术，实现高效稳定的大模型训练。]]></description><category></category></item><item><title><![CDATA[机器学习评估指标详解 - 高级篇]]></title><link>https://blog.csdn.net/liulanba/article/details/127498755</link><guid>https://blog.csdn.net/liulanba/article/details/127498755</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:40:40 +0800</pubDate><description><![CDATA[本文深入探讨机器学习系统的高级评估指标，涵盖后处理优化、模型量化、部署监控等全流程关键环节。主要内容包括：1）后处理指标如NMS效果评估和Soft-NMS改进；2）模型量化与压缩指标；3）生产环境中的部署指标；4）全流程性能监控方法。文章通过Python代码示例和可视化图表，展示了如何在实际项目中应用这些指标来优化模型精度、推理速度和生产环境稳定性。这些高级评估指标为构建高效的机器学习系统提供了全面的性能评估框架。]]></description><category></category></item><item><title><![CDATA[机器学习评估指标详解 - 进阶篇]]></title><link>https://blog.csdn.net/liulanba/article/details/122074791</link><guid>https://blog.csdn.net/liulanba/article/details/122074791</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:38:14 +0800</pubDate><description><![CDATA[本文深入探讨机器学习模型评估的进阶指标，分为训练过程指标、模型参数指标、超参数调优指标和模型验证指标四大类。训练过程指标包括训练损失和验证损失的监控与分析，通过损失函数类型（分类、回归、目标检测）实现不同任务的优化。模型参数指标关注参数量和计算量评估，超参数调优指标指导参数优化，模型验证指标则采用交叉验证等方法评估泛化能力。文章提供了完整的Python实现代码和可视化工具，帮助开发者全面理解机器学习模型的训练优化过程，有效解决过拟合、欠拟合等问题，平衡模型性能与计算资源。]]></description><category></category></item><item><title><![CDATA[机器学习评估指标详解 - 入门篇]]></title><link>https://blog.csdn.net/liulanba/article/details/122074755</link><guid>https://blog.csdn.net/liulanba/article/details/122074755</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:37:26 +0800</pubDate><description><![CDATA[本文是机器学习评估指标系列的第一篇入门指南，全面介绍了机器学习全流程中的基础评估指标。文章系统讲解了数据质量评估（缺失值率、数据覆盖率、重复值率）、数据一致性检查、数据分布指标（如偏度）等核心概念，并提供了详细的Python实现代码和可视化方法。通过数据质量评估、前处理指标、分类/回归/聚类任务指标等模块，帮助初学者建立完整的评估指标体系认知，确保从数据准备到模型评估各环节的质量监控。文章强调全面指标的重要性，包括避免&quot;垃圾进垃圾出&quot;、评估预处理效果、监控训练过程、验证模型泛化能力等关键]]></description><category></category></item><item><title><![CDATA[十大基础机器学习算法详解与实践]]></title><link>https://blog.csdn.net/liulanba/article/details/121305026</link><guid>https://blog.csdn.net/liulanba/article/details/121305026</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:35:33 +0800</pubDate><description><![CDATA[本文系统介绍了十大经典机器学习算法（非深度学习），涵盖线性回归、逻辑回归、SVM、朴素贝叶斯、决策树、随机森林、KNN、K-Means、PCA和梯度提升树。针对每个算法详细解析了原理、数学公式、数据预处理方法和Python实现（基于Python 3.11）。以线性回归为例，重点阐述了模型公式、损失函数、求解方法（最小二乘法和梯度下降）、评估指标（R²、RMSE）以及正则化技术（Ridge/Lasso）。文档提供完整的可运行代码示例，包括数据生成、模型训练、评估和可视化，适合机器学习初学者系统学习基础算法。]]></description><category></category></item><item><title><![CDATA[YOLOv6 端到端详解]]></title><link>https://blog.csdn.net/liulanba/article/details/120590043</link><guid>https://blog.csdn.net/liulanba/article/details/120590043</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:30:32 +0800</pubDate><description><![CDATA[YOLOv6端到端详解：工业级实时目标检测创新 摘要：YOLOv6是美团视觉团队提出的新一代实时目标检测框架，通过多项创新技术实现了精度与速度的平衡。该模型采用可重参数化的RepVGG架构，训练时多分支提升精度，推理时融合为单分支提升速度；设计高效解耦头和Anchor-free检测方案；引入动态标签分配优化样本匹配。YOLOv6提供N/T/S/M/L多种规模变体，满足不同应用场景需求，在保持高精度的同时显著提升推理效率，特别适合工业部署。]]></description><category></category></item><item><title><![CDATA[深入理解 Python 异步编程：async、await 与同步函数详解]]></title><link>https://blog.csdn.net/liulanba/article/details/156242877</link><guid>https://blog.csdn.net/liulanba/article/details/156242877</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:30:21 +0800</pubDate><description><![CDATA[本文深入解析Python异步编程核心概念，对比同步与异步函数的差异，重点介绍async和await关键字的使用方法。同步函数顺序执行但效率低，适合CPU密集型任务；异步函数通过非阻塞并发提升I/O密集型任务性能。async定义协程函数，await暂停协程并让出控制权，配合事件循环实现高效并发。文章通过处理100个网络请求的对比示例，展示异步编程的显著性能优势（1秒vs100秒），并指出常见误区与最佳实践，帮助开发者掌握现代Python高效编程的关键技术。]]></description><category></category></item><item><title><![CDATA[YOLO-World 端到端详解]]></title><link>https://blog.csdn.net/liulanba/article/details/120590018</link><guid>https://blog.csdn.net/liulanba/article/details/120590018</guid><author>liulanba</author><pubDate>Wed, 24 Dec 2025 22:27:09 +0800</pubDate><description><![CDATA[YOLO-World是一种突破性的实时开放词汇目标检测模型，它通过创新性地融合视觉和文本特征，解决了传统YOLO系列模型只能检测预定义类别的局限性。该模型采用YOLOv8骨干网络提取多尺度视觉特征，结合CLIP文本编码器处理任意文本提示，并通过可重参数化的视觉-语言路径聚合网络(RepVL-PAN)实现高效的特征融合。YOLO-World支持零样本检测，无需重新训练即可识别新类别，同时保持了YOLO系列的高效实时性能。]]></description><category></category></item><item><title><![CDATA[八股取士--JVM]]></title><link>https://blog.csdn.net/liulanba/article/details/150801724</link><guid>https://blog.csdn.net/liulanba/article/details/150801724</guid><author>liulanba</author><pubDate>Tue, 26 Aug 2025 00:38:11 +0800</pubDate><description><![CDATA[JVM 核心概念摘要 内存结构与数据区 JVM运行时数据区分为5大核心部分：程序计数器（线程私有）、虚拟机栈（栈帧存储）、本地方法栈、Java堆（对象实例存储）和方法区（类元信息）。其中堆内存又细分为新生代（Eden+Survivor）和老年代，采用分代设计提高GC效率。 关键区别对比 堆vs方法区：堆存储对象实例，方法区存储类元数据；两者都线程共享但回收策略不同 栈vs堆：栈存储基本类型和引用（线程私有/快速访问），堆存储对象实例（线程共享/GC主要区域） 分代设计：基于对象生命周期特性，新生代用复制算法]]></description><category></category></item><item><title><![CDATA[Java 线程安全从入门到精通：实现方式、适用场景与优缺点（实战指南）]]></title><link>https://blog.csdn.net/liulanba/article/details/150805319</link><guid>https://blog.csdn.net/liulanba/article/details/150805319</guid><author>liulanba</author><pubDate>Tue, 26 Aug 2025 00:19:42 +0800</pubDate><description><![CDATA[Java线程安全实现方式全面解析 摘要：本文系统介绍Java中线程安全的实现方式，包括不可变对象、synchronized、显式锁、volatile、原子类、并发集合等8种方法。通过对比分析各方式的优缺点，指出适用场景：不可变对象适合值类配置，synchronized适合小规模并发，原子类适合计数器，并发集合适合共享缓存等。文章还提供线程安全计数器和线程池任务协调两个典型示例，展示AtomicLong与LongAdder的性能差异，以及CountDownLatch的实际应用。最后给出最佳实践建议，如读多写少]]></description><category></category></item></channel></rss>