<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[专注大数据与人工智能技术分享，欢迎私信加群互相学习！]]></title><description><![CDATA[强烈推荐博主的知识星球:  GoAI的学习社区  CV、NLP、大模型、多模态、AIGC、大数据]]></description><link>https://blog.csdn.net/qq_36816848</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; qq_36816848]]></copyright><item><title><![CDATA[别再手搓 Prompt 了：一套让 AI 自己调 Prompt 的完整框架]]></title><link>https://blog.csdn.net/qq_36816848/article/details/166594746</link><guid>https://blog.csdn.net/qq_36816848/article/details/166594746</guid><author>qq_36816848</author><pubDate>Thu, 24 Sep 2026 15:38:25 +0800</pubDate><description><![CDATA[手工调 Prompt 本质是在高维、带噪声、反馈滞后的空间里"人肉梯度下降"，既低效又难复现。本文系统拆解自动化 Prompt 调优（APO）的完整方法论：先讲认知升级——优化早已从"改一句话"转向五类系统性问题，且**评估器（Judge）才是真正的瓶颈，必须先校准 Judge 再优化 Prompt**；再用一张表梳理从经典基线（APE、OPRO、ProTeGi）到 2024—2026 前沿方法（TextGrad、PromptWizard、MIPROv2、GEPA 等）的谱系与适用场景.]]></description><category></category></item><item><title><![CDATA[DeepSeek-Harness 深度解读报告：基于时空可组合性的自进化智能体框架与理论基座]]></title><link>https://blog.csdn.net/qq_36816848/article/details/164431713</link><guid>https://blog.csdn.net/qq_36816848/article/details/164431713</guid><author>qq_36816848</author><pubDate>Sun, 06 Sep 2026 23:18:11 +0800</pubDate><description><![CDATA[&lt;think&gt;我们根据要求生成一篇≤150字的文章摘要。需要概括DeepSeek-Harness深度解读报告的核心内容，包括自进化智能体框架、时空可组合性理论、Cordis引擎、热更新回滚等。控制在150字以内，简洁有力。&lt;/think&gt;DeepSeek-Harness以“一切皆插件”为哲学，基于Cordis元框架与时空可组合性理论，实现智能体动态扩展、无损热更新与事务级回滚。其形式化微积分确保并发确定性，三阶段事务引擎支持自进化，为AgentOS奠定细粒度自治基座。]]></description><category></category></item><item><title><![CDATA[# AI Agent 记忆框架横向对比报告总结]]></title><link>https://blog.csdn.net/qq_36816848/article/details/163478711</link><guid>https://blog.csdn.net/qq_36816848/article/details/163478711</guid><author>qq_36816848</author><pubDate>Tue, 04 Aug 2026 17:32:40 +0800</pubDate><description><![CDATA[本文对10个主流AI Agent记忆框架（Claude Code、DeerFlow 2.0等）进行了横向对比。报告从框架定位、记忆架构分层、20个核心维度评测等方面展开分析，揭示了四大主流记忆范式：文件层次型、结构化数据库型、知识图谱型和扁平置信度型。关键发现包括：知识图谱型（Zep/Cognee）推理能力最强但部署成本高，结构化数据库型（MemGPT/claude-mem）在检索效率上表现突出，文件层次型（Claude Code）适合编程场景，而扁平置信度型（DeerFlow）则简单易用。报告还提供了选型]]></description><category></category></item><item><title><![CDATA[AI Agent 记忆机制综述]]></title><link>https://blog.csdn.net/qq_36816848/article/details/162424858</link><guid>https://blog.csdn.net/qq_36816848/article/details/162424858</guid><author>qq_36816848</author><pubDate>Mon, 29 Jun 2026 16:07:02 +0800</pubDate><description><![CDATA[本文系统梳理了AI Agent记忆机制的研究进展，基于《Memory in the Age of AI Agents》论文提出的三维分类框架（记忆形式、功能与动态），分析了当前主流技术方案与挑战。记忆对Agent实现连续性、效率性和适应性至关重要，现有方案包括Token级（向量数据库）、参数级（LoRA）和潜在状态记忆三类，各具优缺点。论文还探讨了记忆功能分类（情节/语义/程序记忆）及动态演化机制，并配套开源了200+篇论文清单。当前主要挑战在于跨会话持久化、高效检索与动态更新，这将成为未来Agent实用化]]></description><category></category></item><item><title><![CDATA[《深入浅出Agent》：项目深度解析Autoresearch]]></title><link>https://blog.csdn.net/qq_36816848/article/details/160635207</link><guid>https://blog.csdn.net/qq_36816848/article/details/160635207</guid><author>qq_36816848</author><pubDate>Wed, 29 Apr 2026 20:38:37 +0800</pubDate><description><![CDATA[autoresearch 是 Andrej Karpathy 于 2026 年 3 月发布的自主 AI 科研 Agent 实验框架。其核心理念是：把一个真实的 LLM 训练环境交给 AI Agent，让它在你睡觉时自主做实验——修改代码、跑训练、评估结果、保留改进、丢弃失败，周而复始，而你只需要早上来看实验日志和（期望中）更好的模型。核心数字。]]></description><category></category></item><item><title><![CDATA[《深入浅出Agent》：项目深度解析Autoresearch]]></title><link>https://blog.csdn.net/qq_36816848/article/details/160635107</link><guid>https://blog.csdn.net/qq_36816848/article/details/160635107</guid><author>qq_36816848</author><pubDate>Wed, 29 Apr 2026 20:29:13 +0800</pubDate><description><![CDATA[Autoresearch是Andrej Karpathy于2026年发布的自主AI科研框架，通过在nanochat基础上添加AI Agent实现自动化实验。该框架允许AI Agent自主修改代码、运行训练并评估结果，人类仅需通过program.md文件指导研究方向。在首次测试中，Agent完成了700次实验，筛选出20个有效改进，将训练时间缩短11%（2.02小时→1.80小时）。项目采用三大设计原则：单文件可编辑、固定5分钟时间预算、统一评估指标（val_bpb）。]]></description><category></category></item><item><title><![CDATA[《深入浅出Agent》: Harness Agent 前沿论文深度调研报告]]></title><link>https://blog.csdn.net/qq_36816848/article/details/160182518</link><guid>https://blog.csdn.net/qq_36816848/article/details/160182518</guid><author>qq_36816848</author><pubDate>Wed, 15 Apr 2026 15:17:14 +0800</pubDate><description><![CDATA[本文调研了AI Agent领域中的Harness（执行框架）技术前沿发展。报告显示，Harness作为包裹LLM模型的外层控制系统，其设计优劣对Agent系统性能的影响可达6-10个百分点。清华大学提出NLAH将Harness外部化为可移植自然语言文档，在OSWorld测试中性能提升16.8个百分点；Stanford IRIS Lab的Meta-Harness通过外循环优化Harness代码实现自动调优；Google DeepMind的AutoHarness实现了LLM自动合成Harness代码。研究表明，]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》（十二）之多模态经典模型：KOSMOS系列]]></title><link>https://blog.csdn.net/qq_36816848/article/details/149017101</link><guid>https://blog.csdn.net/qq_36816848/article/details/149017101</guid><author>qq_36816848</author><pubDate>Fri, 11 Jul 2025 14:00:00 +0800</pubDate><description><![CDATA[| 强调视觉与语言融合 | | GPT-4V | OpenAI | 2（文本+图片） | 大模型推理、多模态理解 | 视觉对话、逻辑推理 | 闭源，商业API | | Gemini | Google | 3+（文本+图片+视频） | 跨模态检索、动态推理 | 视频问答、跨模态搜索 | 多模态能力最强，但未开源 | | LLaVA | 微软/开源 | 2（文本+图片） | 高效轻量化、指令微调 | 视觉对话、多模态推理 | 开源社区广泛使用 | 五、快速体验KOSMOS 官方渠道： 目前KOSMOS-1、KO]]></description><category></category></item><item><title><![CDATA[面经总结系列（十七）： 淘天阿里妈妈部门内容风控算法工程师]]></title><link>https://blog.csdn.net/qq_36816848/article/details/138007353</link><guid>https://blog.csdn.net/qq_36816848/article/details/138007353</guid><author>qq_36816848</author><pubDate>Fri, 11 Jul 2025 11:00:00 +0800</pubDate><description><![CDATA[本文分享了淘天阿里妈妈部门内容风控算法工程师的两轮面试问题及答案。 技术问题： Transformer：解析了其结构、多模态处理能力、图像分类应用（ViT）、编码器与解码器差异，以及Mask编码的作用。 深度学习基础：包括Batch Normalization的稳定训练作用、Dropout的防过拟合机制、梯度消失的成因及ResNet通过残差连接缓解梯度消失的原理。 算法题：求解最小连续子数组和（双指针/前缀和+二分）与数值的N次幂（快速幂），以及全排列生成（回溯法）。 项目与趋势：二面探讨了多模态图像生成的]]></description><category></category></item><item><title><![CDATA[面经总结系列（十五）： 九维数据计算机视觉算法工程师]]></title><link>https://blog.csdn.net/qq_36816848/article/details/138006561</link><guid>https://blog.csdn.net/qq_36816848/article/details/138006561</guid><author>qq_36816848</author><pubDate>Fri, 04 Jul 2025 11:00:00 +0800</pubDate><description><![CDATA[本文介绍了AI领域专家信息及算法工程师面试经验。作者为CSDN、阿里云博客专家，专注AI知识分享，运营学习社区和公众号。面试内容涵盖：1）项目细节讨论；2）模型优化方法（结构调整、数据平衡、集成学习等）；3）Transformer结构解析与参数计算（自注意力层、前馈网络等）；4）房屋图片物体检测场景题解决方案（预训练模型微调）；5）无位置标注数据的处理方法（弱监督学习、CAM技术等）。文章为AI从业者提供实用面试技巧和技术方案参考。]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》（十一）之多模态经典模型：Flamingo系列]]></title><link>https://blog.csdn.net/qq_36816848/article/details/149017387</link><guid>https://blog.csdn.net/qq_36816848/article/details/149017387</guid><author>qq_36816848</author><pubDate>Mon, 30 Jun 2025 14:30:00 +0800</pubDate><description><![CDATA[《深入浅出多模态》系列之Flamingo模型解析： Flamingo是DeepMind推出的多模态视觉语言大模型，以少样本/零样本学习为核心突破。2022年首版通过模块化架构（冻结的ViT视觉编码器+Perceiver Resampler+语言模型）实现图文跨模态交互，支持连续对话和上下文学习。2024年Flamingo-2进一步开放权重，增强视频理解能力，在VQA等任务表现优异。其技术亮点包括：可插拔视觉模块、高效特征降维、端到端联合训练，影响了LLaVA等后续模型发展。]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》（十一）之多模态经典模型：Flamingo系列]]></title><link>https://blog.csdn.net/qq_36816848/article/details/148828582</link><guid>https://blog.csdn.net/qq_36816848/article/details/148828582</guid><author>qq_36816848</author><pubDate>Mon, 30 Jun 2025 10:09:07 +0800</pubDate><description><![CDATA[《深入浅出多模态》系列文章聚焦多模态AI领域，本篇重点解析Flamingo系列模型。Flamingo由DeepMind研发，是few-shot/zero-shot视觉语言大模型的开创性工作，通过模块化架构（视觉编码器+Perceiver Resampler+语言模型）实现图文/视频多模态理解。2022年Flamingo-1支持上下文学习，2024年Flamingo-2开源权重并强化视频处理能力。该系列模型具备少样本泛化、多轮对话等特性，影响了LLaVA等后续工作。文章涵盖技术细节、发展脉络及开源资源。]]></description><category></category></item><item><title><![CDATA[面经总结系列（十六）： 元象科技大模型推理优化工程师]]></title><link>https://blog.csdn.net/qq_36816848/article/details/138007322</link><guid>https://blog.csdn.net/qq_36816848/article/details/138007322</guid><author>qq_36816848</author><pubDate>Mon, 30 Jun 2025 10:00:00 +0800</pubDate><description><![CDATA[本文介绍了算法工程师面试中的常见问题及解答，涵盖大模型推理优化相关内容。首先解析了欠拟合的原因（模型复杂度不足、特征不足等）及解决方法（增加模型复杂度、改进数据质量等）。其次探讨了Transformer模型效果更好的原因，包括自注意力机制和Q、K、V三向量的作用。还介绍了大数据查找与排序算法（哈希查找、归并排序等），以及TCP/UDP在通信中的选择依据（可靠性需求）。全文聚焦AI技术面试核心知识点，提供实用解决方案。]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》下：多模态模型项目实战]]></title><link>https://blog.csdn.net/qq_36816848/article/details/144807859</link><guid>https://blog.csdn.net/qq_36816848/article/details/144807859</guid><author>qq_36816848</author><pubDate>Mon, 30 Dec 2024 14:00:00 +0800</pubDate><description><![CDATA[本篇内容承接前两篇《深入浅出多模态》之多模态技术总结（上）、《深入浅出多模态》中：多模态模型原理总结，首先将围绕不同多模态模型的对齐方法对经典多模态模型进行对比与总结，并挑选主流的多模态模型CLIP、BLIP、BLIP2等展开详细介绍，最后引入厂内多模态框架PaddleMIX进行多任务实战，帮助大家快速了解多模态技术。]]></description><category></category></item><item><title><![CDATA[面经总结系列（十四）：58同城大模型算法岗]]></title><link>https://blog.csdn.net/qq_36816848/article/details/144397967</link><guid>https://blog.csdn.net/qq_36816848/article/details/144397967</guid><author>qq_36816848</author><pubDate>Mon, 30 Dec 2024 11:00:00 +0800</pubDate><description><![CDATA[本专栏主要为总结各小中大厂的面经系列总结，内容涵盖了多个热门技术领域，包括但不限于算法、机器学习、CV、NLP、大模型、测开、大数据、数分等，内容包括问题及详细答案。]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》之多模态技术知识总结（中）]]></title><link>https://blog.csdn.net/qq_36816848/article/details/143837126</link><guid>https://blog.csdn.net/qq_36816848/article/details/143837126</guid><author>qq_36816848</author><pubDate>Mon, 02 Dec 2024 14:00:00 +0800</pubDate><description><![CDATA[本作者推出全新系列《深入浅出多模态》专栏，具体章节如导图所示（导图后续更新），将分别从各个多模态模型的概念、经典模型、创新点、论文综述、发展方向、数据集等各种角度展开详细介绍，欢迎大家关注。]]></description><category></category></item><item><title><![CDATA[面经总结系列（十三）： 平安寿险算法工程师面经]]></title><link>https://blog.csdn.net/qq_36816848/article/details/138007458</link><guid>https://blog.csdn.net/qq_36816848/article/details/138007458</guid><author>qq_36816848</author><pubDate>Mon, 02 Dec 2024 01:49:55 +0800</pubDate><description><![CDATA[本专栏主要为总结各小中大厂的面经系列总结，内容涵盖了多个热门技术领域，包括但不限于算法、机器学习、CV、NLP、大模型、测开、大数据、数分等，内容包括问题及详细答案，此外金邀请了行业内经验丰富的技术专家和面试官，分享面试经验和技巧，帮助求职者顺利通关各类技术面试。]]></description><category></category></item><item><title><![CDATA[《深入浅出多模态》之多模态技术知识总结（上）]]></title><link>https://blog.csdn.net/qq_36816848/article/details/143692406</link><guid>https://blog.csdn.net/qq_36816848/article/details/143692406</guid><author>qq_36816848</author><pubDate>Mon, 11 Nov 2024 18:34:43 +0800</pubDate><description><![CDATA[本文为《深入浅出多模态》系列总览篇，分为上下两篇，本期分享从多模态概念与意义、任务类型及数据集和基础知识等方面介绍多模态技术，主要对模型进行详述，从具体论文、数据集、代码、模型结构、结果等角度分析，本专栏适合从事多模态小白及爱好者学习，欢迎关注及订阅！]]></description><category></category></item><item><title><![CDATA[面经总结系列（十二）： 美团自驾仿真算法工程师]]></title><link>https://blog.csdn.net/qq_36816848/article/details/143690125</link><guid>https://blog.csdn.net/qq_36816848/article/details/143690125</guid><author>qq_36816848</author><pubDate>Mon, 11 Nov 2024 16:58:12 +0800</pubDate><description><![CDATA[本专栏主要为总结各小中大厂的面经系列总结，内容涵盖了多个热门技术领域，包括但不限于算法、机器学习、CV、NLP、大模型、测开、大数据、数分等，内容包括问题及详细答案，此外金邀请了行业内经验丰富的技术专家和面试官，分享面试经验和技巧，帮助求职者顺利通关各类技术面试。]]></description><category></category></item><item><title><![CDATA[《深入浅出LLM基础篇》（五）：Propmt工程优化（上）]]></title><link>https://blog.csdn.net/qq_36816848/article/details/142821504</link><guid>https://blog.csdn.net/qq_36816848/article/details/142821504</guid><author>qq_36816848</author><pubDate>Thu, 10 Oct 2024 15:01:52 +0800</pubDate><description><![CDATA[本篇为《深入浅出LLM基础篇》：Propmt工程优化，主要讨论各Propmt优化的tips，与效果差进行对比展示。由于 OpenAI模型的训练方式，特定的提示格式效果特别好，可以产生更有用的模型输出。OpenAI 的官方提示工程指南通常是提示技巧的最佳起点，大家有好的也可以在评论区交流学习。]]></description><category></category></item></channel></rss>