<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[uncle_ll的博客]]></title><description><![CDATA[keep healthy, keep going.]]></description><link>https://blog.csdn.net/uncle_ll</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; uncle_ll]]></copyright><item><title><![CDATA[基于LlamaIndex本地知识库 RAG 实战]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164757953</link><guid>https://blog.csdn.net/uncle_ll/article/details/164757953</guid><author>uncle_ll</author><pubDate>Wed, 09 Sep 2026 23:09:00 +0800</pubDate><description><![CDATA[本文基于LlamaIndex实现无需微调的大模型私有知识增强方案，通过构建本地知识库与高阶RAG架构（混合检索、交叉重排序、智能分块、查询重写、Agentic RAG），有效解决医疗、法律、企业知识等场景下的幻觉与知识截止问题。结合Streamlit快速搭建可视化交互界面，实测表明RAG可将幻觉率降至近乎零，具备强泛化性与生产落地能力。]]></description><category></category></item><item><title><![CDATA[语音 AI 落地指南：从 Wav2Vec2 特征提取实战]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164632698</link><guid>https://blog.csdn.net/uncle_ll/article/details/164632698</guid><author>uncle_ll</author><pubDate>Tue, 08 Sep 2026 23:25:08 +0800</pubDate><description><![CDATA[本文系统梳理语音AI四大核心技术（ASR、KWS、SV、音频生成）的边界与落地：从16kHz音频采样基础出发，剖析Wav2Vec2自监督特征提取原理，详解ASR/KWS/SV工程流程、向量数据库选型，并延伸至扩散模型音频生成逻辑，结合PyTorch代码构建完整知识闭环。]]></description><category></category></item><item><title><![CDATA[从 localStorage 到 Chrome 商店：一个 HTML 文件的 7 次重构]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164484817</link><guid>https://blog.csdn.net/uncle_ll/article/details/164484817</guid><author>uncle_ll</author><pubDate>Mon, 07 Sep 2026 18:44:54 +0800</pubDate><description><![CDATA[用WorkBuddy构建健康打卡+记账工具，从单文件HTML到Chrome扩展，7次重构皆因坑：在线页非云端、SDK lint限制、多用户数据隔离、Supabase RLS验证、MV3 CSP禁内联脚本、扩展ID算法编码差异。坑点隐蔽，踩后顿悟，终成功打包上架。]]></description><category></category></item><item><title><![CDATA[【SenseNova U1.5 Lite 实战】]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164451372</link><guid>https://blog.csdn.net/uncle_ll/article/details/164451372</guid><author>uncle_ll</author><pubDate>Mon, 07 Sep 2026 10:00:49 +0800</pubDate><description><![CDATA[SenseNova-U1 不只是又一个开源多模态模型。去掉 VE 和 VAE，直接在像素-词元空间做端到端统一，是可行且高效的。无编码器设计能同时保留语义和像素表征（COCO 重建 PSNR 31.56）原生 MoT 让理解和生成协同进化，本质冲突极小原生多模态架构展现出极高的数据规模化效率如果这条路线在更多工作中被复现和验证，未来的多模态架构会简化很多——一个模型、一套权重、一次推理，覆盖理解、生成、编辑的完整闭环。目前图文交错生成仍是 beta 特性，效果还没达到独立文生图流水线的水平；]]></description><category></category></item><item><title><![CDATA[智能客服实践：微调+RAG双引擎架构落地]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164426796</link><guid>https://blog.csdn.net/uncle_ll/article/details/164426796</guid><author>uncle_ll</author><pubDate>Sun, 06 Sep 2026 13:03:54 +0800</pubDate><description><![CDATA[针对采购智能客服场景，提出微调+RAG双引擎融合架构：固定问答用QLoRA小样本微调，确保标准合规；动态数据用LlamaIndex实时检索，解决幻觉与滞后；高精度场景以检索兜底。]]></description><category></category></item><item><title><![CDATA[大模型交付必备评测体系OpenCompass]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164398535</link><guid>https://blog.csdn.net/uncle_ll/article/details/164398535</guid><author>uncle_ll</author><pubDate>Sat, 05 Sep 2026 11:52:30 +0800</pubDate><description><![CDATA[大模型微调后需标准化评测，OpenCompass作为工业级综合评测基准支持通用与私有业务数据集，提供多维度指标和生成式任务评估。通过虚拟环境部署、自定义JSONL数据集及CLI配置，可生成可溯源的验收报告，并支持vLLM加速调优，是模型交付与选型的关键工具。]]></description><category></category></item><item><title><![CDATA[本地大模型私有化落地实战｜心理问诊系统全流程开发]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164203196</link><guid>https://blog.csdn.net/uncle_ll/article/details/164203196</guid><author>uncle_ll</author><pubDate>Mon, 31 Aug 2026 06:59:47 +0800</pubDate><description><![CDATA[本项目旨在搭建一套纯本地化、隐私绝对可控、具备高共情能力的智能心理问诊系统。该系统需实现用户情绪疏导、心理问题答疑以及基础心理咨询辅助功能。此架构具备极强的泛化能力，可无缝迁移至企业智能客服、行业专属问答机器人等各类生成式 AI 场景。掌握需求分析 ➔ 数据治理 ➔ 模型微调 ➔ 效果评估 ➔ 量化部署的全链路 AI 工程能力。在架构博弈中，核心在于技术为场景服务。对于需要快速迭代、量化评估以及复杂对齐策略的规模化落地，LLaMA Factory 是最佳选择；]]></description><category></category></item><item><title><![CDATA[零代码搭建多智能体协作系统：AutoGen Studio 从入门到实战全教程]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164135961</link><guid>https://blog.csdn.net/uncle_ll/article/details/164135961</guid><author>uncle_ll</author><pubDate>Fri, 28 Aug 2026 07:22:40 +0800</pubDate><description><![CDATA[在菜单中，点击New ModelSkills 是赋能智能体执行真实动作的核心机制。技能本质为一段合规的 Python 代码。在菜单中，点击New Skillimport os"""将智能体生成的最终分析报告保存为本地 Markdown 文件。]]></description><category></category></item><item><title><![CDATA[从零落地离线私有化 RAG：LlamaIndex 0.10.x + 本地开源大模型工程实战]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164066738</link><guid>https://blog.csdn.net/uncle_ll/article/details/164066738</guid><author>uncle_ll</author><pubDate>Tue, 25 Aug 2026 23:36:28 +0800</pubDate><description><![CDATA[本文介绍了离线私有化RAG（检索增强生成）技术在企业级应用中的优势，包括数据零泄露、无API调用成本以及实时知识更新能力。文章基于LlamaIndex 0.10.x重构后的架构，详细拆解了从环境隔离、模型选型到本地向量索引构建的全流程工程方案。对比了RAG与监督微调（SFT）的优缺点，重点阐述了LlamaIndex的核心演进、虚拟环境搭建、依赖版本锁定、本地模型下载与配置，以及私有知识库构建的完整链路。方案采用HuggingFace本地模型，确保数据隐私与高效检索生成能力。]]></description><category></category></item><item><title><![CDATA[LlamaIndex 全栈实战指南：架构解构、RAG 核心原理与私有知识库工程化落地方案]]></title><link>https://blog.csdn.net/uncle_ll/article/details/164034727</link><guid>https://blog.csdn.net/uncle_ll/article/details/164034727</guid><author>uncle_ll</author><pubDate>Mon, 24 Aug 2026 22:45:24 +0800</pubDate><description><![CDATA[本文介绍了大语言模型（LLM）面临的三大工程瓶颈及检索增强生成（RAG）作为私有数据问答的最佳解决方案。重点剖析了LlamaIndex框架的核心架构和配置革新，提供了本地私有知识库落地的完整实践方案。 关键内容： RAG技术相比微调（SFT）在数据更新成本、幻觉抑制等方面优势明显 LlamaIndex五大核心组件构成的数据处理闭环 新版采用模块化设计，以Settings对象替代ServiceContext 详细演示了从文档加载、向量存储到检索问答的全流程实现 支持ChromaDB持久化存储和多格式文档处理 ]]></description><category></category></item><item><title><![CDATA[多模态大模型视听生成本地实战]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163998608</link><guid>https://blog.csdn.net/uncle_ll/article/details/163998608</guid><author>uncle_ll</author><pubDate>Sun, 23 Aug 2026 16:00:48 +0800</pubDate><description><![CDATA[从纯文本交互到跨模态感知，多模态大模型（MLLM）正成为 AI 从语言对话走向全场景智能的关键枢纽。本文从核心分类、对齐机制、任务矩阵到本地部署，系统拆解多模态技术的工程化落地全流程。]]></description><category></category></item><item><title><![CDATA[大模型落地选型GGUF 量化与 Ollama 部署指南]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163969547</link><guid>https://blog.csdn.net/uncle_ll/article/details/163969547</guid><author>uncle_ll</author><pubDate>Sat, 22 Aug 2026 15:30:00 +0800</pubDate><description><![CDATA[摘要： 本文探讨生成式AI工程化落地中的关键权衡与技术方案，提供从微调选型到本地部署的完整链路。首先对比SFT微调与RAG检索增强的适用场景，推荐采用SFT+RAG复合架构。随后解析LoRA与QLoRA的高效微调原理及实测性能，QLoRA可在4-bit量化下显存降低45%且精度损失≤1%。模型评估需结合客观指标（BLEU-4、ROUGE-L）与主观评判（GPT-4o打分）。]]></description><category></category></item><item><title><![CDATA[大模型量化落地全解：原理、实操、效果对比与评估调优指南]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163967754</link><guid>https://blog.csdn.net/uncle_ll/article/details/163967754</guid><author>uncle_ll</author><pubDate>Sat, 22 Aug 2026 09:50:17 +0800</pubDate><description><![CDATA[大模型量化技术解析与实践指南 本文系统介绍了大语言模型(LLM)量化技术的核心原理、算法演进和落地实践。量化技术通过将高精度浮点权重映射为低精度整数，可显著降低显存占用(50%-75%)并提升推理速度。文章详细阐述了非对称均匀量化的数学表达、GPTQ/AWQ等主流PTQ算法的演进，以及不同量化等级(INT8/INT4/INT2)的取舍边界。实践部分提供了稳定的环境构建方案，并通过LLaMA Factory工具展示了GPTQ量化流程。]]></description><category></category></item><item><title><![CDATA[数字人JoyVASA 实战记录]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163924582</link><guid>https://blog.csdn.net/uncle_ll/article/details/163924582</guid><author>uncle_ll</author><pubDate>Thu, 20 Aug 2026 23:30:00 +0800</pubDate><description><![CDATA[JoyVASA是一个由京东健康与浙江大学联合开源的扩散模型驱动的音频驱动肖像动画框架，能够将单张静态图像与一段音频合成为具有表情、唇形同步和头部运动的视频。该框架支持真人肖像和动物动画，适配中英文音频，并通过两阶段解耦技术实现长视频稳定性。其技术核心包括：解耦面部表征、扩散Transformer生成运动序列，以及基于关键点的渲染。环 ]]></description><category></category></item><item><title><![CDATA[数字人EchoMimicV3 落地实践]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163890108</link><guid>https://blog.csdn.net/uncle_ll/article/details/163890108</guid><author>uncle_ll</author><pubDate>Wed, 19 Aug 2026 20:00:00 +0800</pubDate><description><![CDATA[模型下载、库版本兼容、显存精细化管控、参数调优、输入素材标准化。大量报错不是模型本身缺陷，而是环境与参数配置问题。彻底抛弃 RetinaFace+TensorFlow，使用 dlib 人脸检测，规避大量底层算子报错；mmgp 显存优化脚本虽能降低权重显存，但补丁劫持极易带来版本冲突，生产环境谨慎使用；Flash 版本仅适合快速预览，正式业务输出优先 Preview 原版；32G 显卡优先 512 分辨率，不要直接上 768，减少 OOM 概率。demo。]]></description><category></category></item><item><title><![CDATA[Llama 3 私有化落地全栈实战：从 Ollama 极速部署到 LLaMA Factory LoRA 定制微调]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163801427</link><guid>https://blog.csdn.net/uncle_ll/article/details/163801427</guid><author>uncle_ll</author><pubDate>Sun, 16 Aug 2026 17:44:05 +0800</pubDate><description><![CDATA[本文介绍了一套基于Llama 3大模型的本地化部署与轻量微调完整方案。主要内容包括： 推理部署：使用Ollama实现零门槛本地API服务，详细对比了Ollama与vLLM的特性差异，并提供环境配置、模型拉取和OpenAI风格流式对话的工程实现代码。 轻量微调：通过LLaMA Factory框架实现低算力消耗的LoRA微调，对比分析了全量微调、局部微调和LoRA三种范式的参数更新量与显存需求，深入讲解LoRA的数学原理，并给出训练数据集构造和微调流程的完整指导。 该方案显著降低了生成式AI落地的硬件门槛和技术]]></description><category></category></item><item><title><![CDATA[大模型开发实战：Llama 3 本地部署完整指南]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163800818</link><guid>https://blog.csdn.net/uncle_ll/article/details/163800818</guid><author>uncle_ll</author><pubDate>Sun, 16 Aug 2026 16:43:16 +0800</pubDate><description><![CDATA[本文探讨了开源大语言模型（LLM）的工程化落地，重点分析了模型参数规模分类、Transformer架构演进及主流开源生态。文章提出端侧小模型（<3B）、中型轻量大模型（7B-14B）和前沿强推理大模型（>70B）的三级分类框架，并详细对比了Meta Llama 3和通义千问Qwen 2.5的技术特性与应用场景。针对实际部署，文章提供了Llama 3 8B模型的本地部署全流程方案]]></description><category></category></item><item><title><![CDATA[服务器选型、微调范式、训练优化与环境搭建]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163452324</link><guid>https://blog.csdn.net/uncle_ll/article/details/163452324</guid><author>uncle_ll</author><pubDate>Mon, 03 Aug 2026 23:56:25 +0800</pubDate><description><![CDATA[本文系统梳理了从云端到本地的模型微调全流程解决方案。首先对比了ModelScope免费平台与AutoDL付费平台的特性，并介绍VS Code远程开发配置方法。其次详细分析了全量微调、局部微调、增量微调三种范式的适用场景与性能差异。然后提供了工业级训练优化技巧，包括后台训练、可视化监控和混合精度训练。最后针对常见问题给出排查建议，并详细说明本地环境搭建步骤，涵盖Anaconda安装、PyTorch版本匹配和CUDA配置等关键技术要点，为不同阶段的开发者提供从入门到进阶的实践指南。]]></description><category></category></item><item><title><![CDATA[GPT 中文文本生成指南：从开箱调用到定制化微调，吃透 Transformer 解码器核心 logic]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163451761</link><guid>https://blog.csdn.net/uncle_ll/article/details/163451761</guid><author>uncle_ll</author><pubDate>Mon, 03 Aug 2026 22:50:33 +0800</pubDate><description><![CDATA[本文深入探讨了Transformer解码器架构在生成式大模型（如GPT系列）中的核心作用，重点解析了自回归生成的底层原理与工程实践。文章首先对比了编码器与解码器的关键差异，强调因果注意力机制如何确保单向信息流。随后基于Hugging Face生态，详细演示了GPT-2的中文生成实践，包括五种核心解码策略（贪婪搜索、Top-P/K采样、温度调节、重复惩罚）的应用。通过数学公式揭示了自回归建模的本质，并完整展示了古诗词生成任务的微调全流程，涵盖数据集构建、标签错位处理、混合精度训练等关键技术要点。]]></description><category></category></item><item><title><![CDATA[BERT 进阶微调实战：多分类改造、超长文本适配与自定义词表全流程指南]]></title><link>https://blog.csdn.net/uncle_ll/article/details/163418017</link><guid>https://blog.csdn.net/uncle_ll/article/details/163418017</guid><author>uncle_ll</author><pubDate>Sun, 02 Aug 2026 17:04:16 +0800</pubDate><description><![CDATA[本文针对BERT模型在工业级NLP任务中的三大进阶问题（多分类任务、超长文本处理、自定义词表扩展）提供完整解决方案。通过微博情绪多分类数据集实战，详细讲解自定义Dataset封装、模型结构改造（冻结主干+动态分类层）、训练-验证闭环等流程。针对超长文本场景，提出修改max_position_embeddings配置与增量微调策略，平衡性能与算力消耗。同时对比轻量级模型与大语言模型的适用边界，强调工业落地需结合业务需求与硬件条件选型。]]></description><category></category></item></channel></rss>