<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[deephub]]></title><description><![CDATA[]]></description><link>https://blog.csdn.net/m0_46510245</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; m0_46510245]]></copyright><item><title><![CDATA[DeepSeek Harness 架构解析：从 Preset、Tool Pipeline 到 Agent Runtime]]></title><link>https://blog.csdn.net/m0_46510245/article/details/164268174</link><guid>https://blog.csdn.net/m0_46510245/article/details/164268174</guid><author>m0_46510245</author><pubDate>Tue, 01 Sep 2026 20:58:44 +0800</pubDate><description><![CDATA[Agent 能力怎样进入当前 Session？Tool Call 怎样经过策略、批准和执行环境？插件怎样随依赖变化而加载和卸载？Session 怎样记录模型真正看到的内容？Code Mode 和 Subagent 怎样复用同一套能力边界？这些问题不会随着某个 API 改名而消失。它们共同构成了 Agent Runtime 的工程基础。]]></description><category></category></item><item><title><![CDATA[用 Scikit-LLM 和 Groq 搭建情感分析 pipeline]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162912801</link><guid>https://blog.csdn.net/m0_46510245/article/details/162912801</guid><author>m0_46510245</author><pubDate>Wed, 15 Jul 2026 20:42:31 +0800</pubDate><description><![CDATA[本文介绍如何用Scikit-LLM集成Groq的Llama 3.1模型，构建零样本情感分析Pipeline：基于IMDB数据集，通过文本清洗、零样本分类与scikit-learn标准接口，实现高效、易用的LLM驱动文本分类，兼顾简洁性与实用性。]]></description><category></category></item><item><title><![CDATA[4D Gaussian Splatting 是怎么工作的：从规范 Gaussian 到形变场的原理拆解]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162705794</link><guid>https://blog.csdn.net/m0_46510245/article/details/162705794</guid><author>m0_46510245</author><pubDate>Wed, 08 Jul 2026 21:06:40 +0800</pubDate><description><![CDATA[4D-GS创新性地将3D高斯泼溅扩展至动态场景：摒弃逐帧存储，仅维护一组规范高斯，通过轻量因子分解形变场（6个2D平面+双线性插值）预测时序位移、旋转与缩放，避免显存爆炸；锁定颜色/不透明度以保障物理真实性，兼顾实时渲染与几何一致性。]]></description><category></category></item><item><title><![CDATA[OpenSpec 三阶段工作流实操：从 Propose 到 Archive让代码返工率降到三分之一以下]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162672650</link><guid>https://blog.csdn.net/m0_46510245/article/details/162672650</guid><author>m0_46510245</author><pubDate>Tue, 07 Jul 2026 19:48:52 +0800</pubDate><description><![CDATA[OpenSpec是AI原生规范驱动开发（SDD）框架，以Propose→Apply→Archive三阶段强制工作流，将需求精准转为AI可读、可验、可追溯的结构化规范，实测降低代码返工率超2/3。]]></description><category></category></item><item><title><![CDATA[Agent Harness 到底是什么：模型之外的那层控制系统]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162641802</link><guid>https://blog.csdn.net/m0_46510245/article/details/162641802</guid><author>m0_46510245</author><pubDate>Mon, 06 Jul 2026 20:34:31 +0800</pubDate><description><![CDATA[AI Agent Harness 是包裹大模型的“运行支架”，提供工具调用、记忆管理、权限控制、安全护栏、可观测性与故障恢复等能力，将聪明但无约束的模型，转化为安全、可控、可审计的生产级智能体。]]></description><category></category></item><item><title><![CDATA[十个 AI Agent 工作流模板，照着搭就能用]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162560553</link><guid>https://blog.csdn.net/m0_46510245/article/details/162560553</guid><author>m0_46510245</author><pubDate>Fri, 03 Jul 2026 21:08:36 +0800</pubDate><description><![CDATA[AI Agent 不是高级聊天机器人，而是能自动执行完整工作流的智能协作者：读取、核对、决策、起草、更新，仅高风险环节交由人工拍板。文末分享10个开箱即用的模板——从邮件分类、研究简报到CRM补全、QA审查，聚焦解决重复性数字劳动，强调“先设计工作流，再写Prompt”，兼顾效率与可控性。]]></description><category></category></item><item><title><![CDATA[白得 2 到 3 倍加速的投机采样机制解析：草稿模型和目标模型是怎么配合的]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162528084</link><guid>https://blog.csdn.net/m0_46510245/article/details/162528084</guid><author>m0_46510245</author><pubDate>Thu, 02 Jul 2026 21:10:12 +0800</pubDate><description><![CDATA[LLM自回归解码因内存带宽瓶颈而缓慢：每生成1个token均需重载全部权重（如70B模型达140GB）。投机采样通过小模型快速“猜”多token，大模型一次并行验证，接受率高时可获2–3倍无损加速。]]></description><category></category></item><item><title><![CDATA[Harness Engineering 实践案例：如何Agent 写一份行为规范]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162495817</link><guid>https://blog.csdn.net/m0_46510245/article/details/162495817</guid><author>m0_46510245</author><pubDate>Wed, 01 Jul 2026 19:50:48 +0800</pubDate><description><![CDATA[本文展示Harness Engineering落地实践：通过`AGENTS.md`（行为总纲）、`ARCHITECTURE.md`（系统骨架）等结构化文档，为编码Agent建立可追溯、可审计、防幻觉的工作规范，实现RAG+微调系统的可控开发。]]></description><category></category></item><item><title><![CDATA[注意力架构变迁总结：稀疏、线性、SSM、混合架构如何摆脱 O(L²) 的代价]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162464586</link><guid>https://blog.csdn.net/m0_46510245/article/details/162464586</guid><author>m0_46510245</author><pubDate>Tue, 30 Jun 2026 21:34:10 +0800</pubDate><description><![CDATA[自注意力是Transformer的基石，却因O(L²)计算瓶颈制约长上下文。业界正通过稀疏注意力（如NSA、DSA）、线性注意力（如Lightning Attention）、状态空间模型（Mamba）及混合架构四大路径破局，在保持性能的同时大幅降本提速。]]></description><category></category></item><item><title><![CDATA[Polars vs Pandas 在生产 Pipeline 中的对比]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162430632</link><guid>https://blog.csdn.net/m0_46510245/article/details/162430632</guid><author>m0_46510245</author><pubDate>Mon, 29 Jun 2026 20:57:24 +0800</pubDate><description><![CDATA[Pandas作为Python数据处理基石，设计于单核时代；而Polars以Rust+Arrow重构架构，支持多线程惰性执行、列式存储与查询优化，10GB数据处理快94倍，是GB级ETL的现代之选。]]></description><category></category></item><item><title><![CDATA[UV vs pip vs Conda:Python环境管理应该怎么选]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162397500</link><guid>https://blog.csdn.net/m0_46510245/article/details/162397500</guid><author>m0_46510245</author><pubDate>Sun, 28 Jun 2026 20:38:44 +0800</pubDate><description><![CDATA[Python包管理已进化：pip是标准但慢，conda专精数据科学与跨语言依赖，而uv——Rust打造的极速新锐，10~100倍提速，一站式替代pip+venv+pyenv+pip-tools，AI/大模型开发首选。]]></description><category></category></item><item><title><![CDATA[用 LangGraph 改造单一 RAG 架构：让 Agent 决定调用向量、图遍历还是网络搜索]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162315362</link><guid>https://blog.csdn.net/m0_46510245/article/details/162315362</guid><author>m0_46510245</author><pubDate>Thu, 25 Jun 2026 21:49:18 +0800</pubDate><description><![CDATA[本文介绍如何用LangGraph构建智能体，突破传统RAG流水线局限：针对不同问题（如政策查询→向量搜索、关系分析→图遍历、实时资讯→网络搜索），自动路由至最适工具，并通过状态机实现记忆、决策、重试与幻觉校验，让AI真正“思考”而非机械执行。]]></description><category></category></item><item><title><![CDATA[为什么Kriging 与高斯过程回归出自同一数学框架，但实际效果却差很远]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162281718</link><guid>https://blog.csdn.net/m0_46510245/article/details/162281718</guid><author>m0_46510245</author><pubDate>Wed, 24 Jun 2026 21:56:35 +0800</pubDate><description><![CDATA[本文对比Kriging与高斯过程回归（GPR）在SPE9渗透率空间插值任务中的性能，涵盖多种变体与交叉验证。结果揭示：GPR精度更高但计算昂贵；嵌套Kriging以极低成本提升稳定性；R²为负并非异常，而是模型劣于均值预测的明确警示。]]></description><category></category></item><item><title><![CDATA[百亿参数模型的并行训练：节点内张量并行、节点间数据并行]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162245441</link><guid>https://blog.csdn.net/m0_46510245/article/details/162245441</guid><author>m0_46510245</author><pubDate>Tue, 23 Jun 2026 21:02:41 +0800</pubDate><description><![CDATA[训练百亿参数模型，显存瓶颈远超算力限制：100B模型仅权重（bfloat16）就需200GB，叠加梯度、优化器状态与激活值，总内存需求达800GB–1.2TB。单纯堆GPU无效，关键在于科学切分——张量并行降单卡参数、流水线并行减层内存、数据并行扩样本，混合策略才是破局核心。]]></description><category></category></item><item><title><![CDATA[DiffusionGemma：用离散文本扩散和双向注意力，把推理瓶颈从内存带宽转移到算力]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162213434</link><guid>https://blog.csdn.net/m0_46510245/article/details/162213434</guid><author>m0_46510245</author><pubDate>Mon, 22 Jun 2026 23:17:43 +0800</pubDate><description><![CDATA[DiffusionGemma是谷歌推出的实验性开源模型，首创离散文本扩散架构，可并行生成256-token画布，突破自回归模型的序列瓶颈；本地推理速度提升4倍，兼顾效率与质量，专为端侧低延迟场景优化。]]></description><category></category></item><item><title><![CDATA[微调LocateAnything-3B 实现超高密度的目标检测]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162177280</link><guid>https://blog.csdn.net/m0_46510245/article/details/162177280</guid><author>m0_46510245</author><pubDate>Sun, 21 Jun 2026 21:45:47 +0800</pubDate><description><![CDATA[本文介绍如何微调NVIDIA LocateAnything-3B模型，应对300+密集重叠种子的精准定位难题。依托并行框解码（PBD）与半监督Pipeline（点标注→SAM2转框→YOLO伪标→定向微调），大幅降低人工成本，实现高精度、可落地的密集目标检测方案。]]></description><category></category></item><item><title><![CDATA[10 个 AI 工程师必须掌握的 LangChain & LangGraph 概念]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162045908</link><guid>https://blog.csdn.net/m0_46510245/article/details/162045908</guid><author>m0_46510245</author><pubDate>Tue, 16 Jun 2026 21:17:32 +0800</pubDate><description><![CDATA[本文详解2026年构建生产级AI Agent的10大核心架构原则：状态管理、函数化节点、图编排替代线性链、智能路由、多层检索、结构化输出、操作型记忆、检查点恢复、人机协同等。强调可靠AI系统的关键不在模型调优，而在健壮的工作流设计。]]></description><category></category></item><item><title><![CDATA[Flash-KMeans：快速且内存高效的精确 K-Means，可在单张 GPU 进行亿级数据的聚类]]></title><link>https://blog.csdn.net/m0_46510245/article/details/162014767</link><guid>https://blog.csdn.net/m0_46510245/article/details/162014767</guid><author>m0_46510245</author><pubDate>Mon, 15 Jun 2026 20:59:55 +0800</pubDate><description><![CDATA[Flash-KMeans是面向GPU的K-Means革新框架，突破显存IO墙与原子竞争瓶颈：通过FlashAssign（在线Argmin、零距离矩阵物化）和Sort-Inverse Update（排序驱动规约），实现10亿级数据无损极速聚类，端到端最高加速17.9×，内存开销降至传统方案的极小比例。]]></description><category></category></item><item><title><![CDATA[AI Agent的三重记忆机制：打造高可用的多维记忆系统]]></title><link>https://blog.csdn.net/m0_46510245/article/details/161984762</link><guid>https://blog.csdn.net/m0_46510245/article/details/161984762</guid><author>m0_46510245</author><pubDate>Sun, 14 Jun 2026 22:10:09 +0800</pubDate><description><![CDATA[本文深度解析AI Agent三大核心记忆架构：RAG（聚焦“来源说了什么”，保障答案可溯源）、Agent Memory（解决“该记住什么”，实现跨会话连续性）与知识图谱（厘清“事物如何关联”，支撑多跳推理）。三者定位迥异，需依问题本质精准选型，避免技术错配。]]></description><category></category></item><item><title><![CDATA[相关性与因果性：识别伪相关以提升模型在真实环境的可用性]]></title><link>https://blog.csdn.net/m0_46510245/article/details/161935302</link><guid>https://blog.csdn.net/m0_46510245/article/details/161935302</guid><author>m0_46510245</author><pubDate>Fri, 12 Jun 2026 20:48:33 +0800</pubDate><description><![CDATA[本文剖析相关性与因果性的本质区别，揭示“同步变动≠因果关联”的认知陷阱；详解反向因果、混杂变量等三大误导机制，并提供“方向可逆吗？有第三因素吗？符合常理吗？”三问自查法，助你在数据决策中避开伪因果陷阱。]]></description><category></category></item></channel></rss>