<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[weixin_29040367的博客]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/weixin_29040367</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; weixin_29040367]]></copyright><item><title><![CDATA[OpenCalib激光雷达与相机联合标定实操指南：从数据到精度验证]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166127228</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166127228</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:58:19 +0800</pubDate><description><![CDATA[在自动驾驶与机器人感知系统中，激光雷达与相机各自生成不同维度的数据，要实现点云与图像的精准融合，必须解决传感器间的坐标对齐问题，其核心就是求解外参。外参标定本质上是估计三维刚体变换，将雷达坐标系下的点变换到相机坐标系，再结合相机内参投影到像素平面。OpenCalib作为成熟的开源标定工具箱，提供了从特征提取到优化求解的完整链路，并支持多种标定板，能够高效输出高精度外参。标定质量直接影响下游点云投影、目标检测与BEV感知等任务，因此掌握规范的数据采集流程、配置文件编写以及重投影误差分析方法至关重要。本文基于实]]></description><category></category></item><item><title><![CDATA[基于BERT的B站弹幕情感分析系统设计与实现]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166077594</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166077594</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:58:13 +0800</pubDate><description><![CDATA[情感分析是自然语言处理的重要应用领域，通过深度学习方法可以自动识别文本中的情绪倾向。本文以B站弹幕为研究对象，详细介绍了基于BERT预训练模型的情感分析系统实现方案。系统采用微服务架构处理高并发数据流，通过Fine-tuning使模型适配网络用语和颜文字等特殊表达。关键技术包括使用Transformer架构提升序列数据处理效率，结合双向LSTM捕捉时序特征，并针对弹幕场景优化了数据清洗和标注策略。该方案在实时性要求高的视频平台场景中表现优异，准确率达到87%，为内容推荐、用户反馈分析等应用提供了可靠的技术支]]></description><category></category></item><item><title><![CDATA[colibri：纯C实现的MoE模型轻量推理引擎，GLM端侧部署实战]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166044988</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166044988</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:57:50 +0800</pubDate><description><![CDATA[MoE（混合专家）架构通过稀疏激活在控制计算量的同时扩展模型参数量，但其推理面临专家权重内存占用大的挑战。传统方案要么全量加载导致内存溢出，要么粗暴量化破坏路由机制。colibri以纯C实现，采用专家权重按需加载与LRU缓存策略，在有限内存下高效推理GLM系列MoE模型。该方案适用于端侧部署、本地开发等场景，为轻量级推理引擎设计提供了工程实践参考。]]></description><category></category></item><item><title><![CDATA[GPT-5.4原生电脑操控与百万级上下文窗口技术解析]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166093246</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166093246</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:52:24 +0800</pubDate><description><![CDATA[大语言模型的核心突破在于实现人机交互的自然化与复杂任务处理的自动化。GPT-5.4通过原生电脑操控技术，将AI能力延伸到系统级操作层面，无需编写脚本即可完成文件整理、格式转换等自动化流程，大幅降低技术门槛。其百万级上下文窗口则采用分层注意力机制和动态记忆压缩等创新技术，使模型能精准处理超长技术文档和法律文书。这些技术进步在自动化办公、医疗诊断等场景展现出巨大价值，特别是结合沙盒环境管理系统和安全模式设计，既保障了系统安全又提升了工程实践效率。]]></description><category></category></item><item><title><![CDATA[教育AI工具落地指南：十组真实用例让课堂效率翻倍]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166059134</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166059134</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:52:17 +0800</pubDate><description><![CDATA[教育信息化进程中，工具数量并不稀缺，真正稀缺的是将技术转化为教学生产力的具体用例。AI服务的本质是基于自然语言交互的任务自动化，其技术价值体现在对重复劳动的替代与教学数据的结构化沉淀，应用场景则覆盖备课、课堂互动、作业批改与教研管理。从教材拆解、演示文稿生成到班级答疑智能体搭建，每一个环节都需要将“任务、工具、操作、验证”绑定为可复用的方法，而非停留在工具清单层面。本文聚焦教学流程中的高价值介入点，梳理十组经过一线实测的AI教育用例，帮助教师快速找到适合自身场景的落地路径，让技术真正服务于师生互动质量的提升]]></description><category></category></item><item><title><![CDATA[RAG系统性能优化实战：从QPS 3到800+的调优全记录]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166085565</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166085565</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:49:38 +0800</pubDate><description><![CDATA[大模型应用正从原型走向生产，检索增强生成（RAG）作为连接外部知识库的关键技术，其响应速度和吞吐量直接影响用户体验。面对复杂的检索链路，包括查询分析、向量召回、重排与生成，任何环节的阻塞都会拖累整体性能，导致QPS低下、服务不稳定。理解向量索引（如HNSW）的查找原理、embedding调用的资源消耗以及应用层并发模型的影响，是解决瓶颈的基础。针对企业知识库问答、语义检索等典型场景，通过索引选型、缓存设计、连接池优化和异步化改造，能够在不牺牲准确率的前提下实现数量级的性能提升。这套方法论既适用于基于pgve]]></description><category></category></item><item><title><![CDATA[昇思大模型转换工具实战：PyTorch权重迁移到MindSpore全指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166054835</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166054835</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:42:19 +0800</pubDate><description><![CDATA[在深度学习工程落地中，跨框架模型迁移是常见刚需。大模型权重并非单一文件，而是参数名、张量形状与数据类型的映射集合。PyTorch与HuggingFace生态训练的模型，若需在MindSpore及昇腾NPU上继续微调或部署，必须理解权重转换的本质。昇思提供Ckpt、MindIR与.ms三条转换路径，分别对应训练微调、跨框架推理与端侧部署。实际转换中，需关注模块前缀、RMSNorm参数epsilon、分词器一致性等细节，否则易出现加载失败或生成质量劣化。从原理到实践，完整迁移流程包括环境准备、脚本执行、结果校验]]></description><category></category></item><item><title><![CDATA[LLM Wiki实操：用Markdown给大模型打造外置记忆，告别重复解释上下文]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166066049</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166066049</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:40:19 +0800</pubDate><description><![CDATA[大模型应用中的常见痛点是“失忆”：每次对话都从零开始，上下文窗口关闭后，历史结论与规则全部丢失。传统RAG虽然能检索外部知识，但知识库依赖人工维护，模型不会主动写入新经验。Karpathy提出的LLM Wiki方案，将Markdown文件作为模型的外置记忆，结合向量检索与自动写入机制，让模型既能读取历史沉淀，也能在对话中提炼新结论并回写知识库。这种设计解决了上下文窗口的容量与成本限制，同时实现记忆的私有化、可编辑和可追溯。配合chunk切分、top-k召回、低temperature等参数调优，以及密钥泄露、]]></description><category></category></item><item><title><![CDATA[从NPU到YOLOv5实战：Atlas 300V 24G推理加速卡部署全指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166091425</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166091425</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:35:51 +0800</pubDate><description><![CDATA[在AI推理加速领域，NPU（神经网络处理单元）正凭借其高能效比成为GPU之外的重要选择。与通用GPU不同，NPU从设计之初就聚焦于神经网络计算，在视频分析、目标检测等固定计算模式中展现出显著的单位功耗算力优势。华为昇腾Atlas 300V 24G便是一款基于昇腾310P芯片的NPU推理加速卡，常被问及它是否属于“运算加速卡”——本质上，它是一款专为深度学习模型高效推理设计的专用加速设备。本文从该卡的真实定位出发，对比其与GPU在成本、功耗、生态上的差异，并详细讲解在x86服务器上完成驱动、固件、CANN环境]]></description><category></category></item><item><title><![CDATA[LibreChat自托管AI对话平台：多模型接入与插件系统实战指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166054490</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166054490</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:34:49 +0800</pubDate><description><![CDATA[自托管AI对话平台是一种将大模型调用、多模型切换、对话历史管理与插件扩展整合到本地服务器的技术方案，其核心原理是通过统一转发层对接不同厂商的模型接口，实现数据自主可控与功能按需裁剪。在工程实践中，这类平台的技术价值在于降低多模型对比与团队协作的门槛，典型应用场景包括个人开发者的私有AI工作台、小团队的共享模型入口以及技术爱好者的多模型评测环境。LibreChat作为该领域的代表性开源项目，凭借Docker快速部署、自定义端点配置与插件工具调用能力，成为自托管对话平台中兼顾多模型支持与数据隔离的优选方案。]]></description><category></category></item><item><title><![CDATA[建筑工程档案数字化归档全流程：PDF/A转换与元数据实践]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166047452</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166047452</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:32:13 +0800</pubDate><description><![CDATA[在城建档案管理领域，建筑工程资料归档是最复杂的业务场景之一，涉及立项决策、勘察设计、施工过程、竣工备案及监理合同等多阶段文件。档案数字化过程中，PDF作为长期保存格式需要遵循PDF/A标准，通过OCR技术实现检索文本层，并依靠元数据映射完成卷内目录与电子文件的严格对应。掌握扫描参数底线、图像处理步骤及档号命名规则，能有效提升电子档案合规性与移交效率。本文从建设工程文件归档规范出发，解析苏州市档案馆接收标准下的案卷结构、PDF/A转换工具链及自动化命名脚本，结合Ghostscript与veraPDF实战验证，]]></description><category></category></item><item><title><![CDATA[RAG企业落地实战：LangChain选型、切块策略、混合检索与部署]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166069563</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166069563</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:25:33 +0800</pubDate><description><![CDATA[检索增强生成（RAG）正成为企业构建知识库问答系统的核心范式，其原理是通过外部检索为大模型补充实时、专业的上下文，从而缓解模型幻觉并覆盖私有知识。在实际工程落地中，RAG并非单一模型或框架问题，而是涉及文档切块、向量索引、混合检索、结果重排等多个环节的复杂链路。以LangChain、LangGraph编排流程，搭配pgvector存储向量，可以构建生产级AI Agent服务。同时，多轮对话中的指代消解、表格数据的结构化转述，以及元数据权限过滤，都是决定回答准确率与安全性的关键细节。结合IT服务台工单分派项目]]></description><category></category></item><item><title><![CDATA[企业研发Agent架构设计全复盘：从需求到落地避坑指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166040610</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166040610</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:25:07 +0800</pubDate><description><![CDATA[在人工智能工程化落地进程中，智能体（Agent）正成为企业提升研发效能的关键载体。其核心价值在于将大模型能力与业务工具链深度耦合，通过任务编排实现复杂研发场景的自动化处理。从技术原理看，Agent系统涉及意图识别、工具调用、知识检索与状态管理等关键模块，其中RAG（检索增强生成）与LangGraph等编排框架的合理运用，直接影响系统的稳定性与准确率。在实际工程中，企业研发场景下的Agent建设需重点关注需求边界定义、提示词版本管理、异步任务调度以及可观测性体系构建等环节。以真实项目实践为例，系统复盘了一个企]]></description><category></category></item><item><title><![CDATA[零基础玩转Hermes Agent：多场景自动化实战指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166086335</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166086335</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:23:23 +0800</pubDate><description><![CDATA[自动化测试与接口自动化是现代软件交付中的高频需求，但传统脚本往往难以应对动态变化的流程。基于大语言模型的智能代理（Agent）框架，通过“意图理解-工具调用-结果反馈”的循环，将繁琐的操作转化为自然语言指令驱动的自动化流程。本文以 Hermes Agent 为例，介绍其作为多场景自动化中枢的工作原理、环境搭建与关键配置，并覆盖接口自动化、浏览器端到端测试、内容生成、数据归集、运维巡检等典型场景。同时提供任务描述模板、工具权限边界、参数调优及常见问题排查经验，帮助零基础开发者快速构建可靠、可扩展的自动化体系。]]></description><category></category></item><item><title><![CDATA[用WorkBuddy自动化简历筛选：50份简历30分钟出评估报告]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166078388</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166078388</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:18:27 +0800</pubDate><description><![CDATA[在招聘流程中，简历筛选往往是HR和业务负责人最耗时的重复性劳动。随着AI Agent与自动化工作台的发展，这类结构化任务已可以交由智能工具批量处理。大模型擅长从非结构化文本中抽取关键字段，再通过规则化评分输出统一结论，这正是自动化工作流的典型应用场景。从环境配置、模型接入到指令设计，再到评估维度与输出格式，一套完整的筛选链路不仅能大幅压缩简历初筛时间，还能确保评分标准的一致性和可追溯性。本文以WorkBuddy为工具，完整复盘了50份简历在30分钟内生成评估报告的全部过程，并总结了文件解析、标准漂移、上下文]]></description><category></category></item><item><title><![CDATA[Luma AI Camera Angles：AI 3D模型多角度渲染与运镜实战指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166075550</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166075550</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:12:55 +0800</pubDate><description><![CDATA[3D内容创作中，摄像机角度调整常依赖手动拖拽或脚本编写，效率低且门槛高。Luma AI Camera Angles 通过预设与自定义机位，在云端直接对AI生成的3D模型进行多角度渲染，无需导出或切换软件。其原理是在模型周围虚拟放置摄像机，结合方位角、仰角、距离等参数，快速输出静帧或环绕视频。该功能将3D建模与镜头语言表达无缝衔接，显著降低从模型到视觉素材的时间成本。适用于电商产品展示、游戏资产预览、建筑方案汇报及社交媒体3D内容创作，让创作者无需专业3D软件基础也能高效产出多视角素材。]]></description><category></category></item><item><title><![CDATA[LibreChat + MCP：构建可落地的企业级AI Agent平台]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166031930</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166031930</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:11:58 +0800</pubDate><description><![CDATA[AI Agent 是指具备工具调用、状态记忆与自主决策能力的智能执行体，其核心原理在于将大语言模型作为‘大脑’，通过标准化协议协调外部工具执行真实任务。MCP（Model Control Protocol）作为新兴的模型-工具通信规范，解决了多模型、多工具异构集成的协议碎片化问题，显著降低Agent开发与维护成本。技术价值体现在解耦模型调度、会话管理与业务逻辑，支撑数据库查询、Figma设计、通达信行情等私有数据场景的本地闭环。本文聚焦 LibreChat 这一生产级开源平台，详解其如何原生集成 MCP 协]]></description><category></category></item><item><title><![CDATA[让Agent学会“看视频”：claude-video Skill开发实战]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166059621</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166059621</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:06:02 +0800</pubDate><description><![CDATA[AI Agent正逐步成为企业自动化流程的核心载体，然而，传统文本模型在处理视频这类高密度、多模态信息时存在明显感知盲区。所谓视频理解，本质上是将连续画面转化为可被模型消费的结构化文本序列，通过关键帧抽取、OCR字符识别、ASR语音转写与视觉语义描述等管道，实现画面、语音与时间线的三重对齐。这项能力不仅将多模态数据转化为可检索的视频知识库，还能支撑内容审核、产品演示分析、直播监控等高价值工程场景。在工程实践中，利用Agent Skill机制为模型装配“外部眼睛”，让模型驱动抽帧、并发调度、结果汇总，是低成本]]></description><category></category></item><item><title><![CDATA[MCP实战：将Agent工具层彻底解耦的架构改造指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166036483</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166036483</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:01:54 +0800</pubDate><description><![CDATA[在Agent应用开发中，随着工具数量增加和业务方共享，工具函数与核心流程的耦合逐渐成为维护噩梦。MCP（模型上下文协议）作为一种标准化的工具接入协议，为工具层提供了统一的描述、调用与传输规范，使得Agent无需关心工具的具体实现语言与环境。通过MCP Server将文件检索、任务管理等能力独立封装，开发者可以实现工具的即插即用、多Agent复用与权限隔离。本文从工具耦合症状出发，剖析MCP原语机制，展示基于FastMCP构建本地工具的完整路径，并探讨超时、上下文过载、安全边界等实践问题，助力团队在Agent]]></description><category></category></item><item><title><![CDATA[Atlas 300V 24G推理卡实战：YOLO模型转换与部署全指南]]></title><link>https://blog.csdn.net/weixin_29040367/article/details/166092119</link><guid>https://blog.csdn.net/weixin_29040367/article/details/166092119</guid><author>weixin_29040367</author><pubDate>Sat, 19 Sep 2026 16:00:34 +0800</pubDate><description><![CDATA[AI推理加速卡是深度学习模型落地的关键硬件，与训练卡侧重并行浮点运算不同，它更强调低延迟、高吞吐和功耗控制。昇腾Atlas 300V 24G就是一款基于昇腾310P芯片的PCIe接口推理加速卡，24GB内存和百TOPS级INT8算力使其成为视觉推理场景的高性价比选择。通过CANN工具链与ATC模型转换，开发者可将YOLO等ONNX模型高效部署到该卡上，并利用AIPP硬件预处理节省CPU资源。本文从推理卡选型逻辑切入，系统梳理环境配置、模型转换、pyACL推理脚本和性能优化三板斧，并总结常见报错排查方法，为使]]></description><category></category></item></channel></rss>