自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(65)
  • 收藏
  • 关注

原创 CrewAI实战:构建高效的Agent团队

CrewAI框架深度解析:构建高效Multi-Agent协作系统 摘要: CrewAI是一个面向任务的Multi-Agent协作框架,通过团队化管理模式解决AutoGen等工具在角色定义、任务分配和工作流程标准化方面的痛点。该框架采用Agent-Task-Crew三层结构,支持顺序执行和分层处理两种流程模式,具有记忆机制和缓存优化等高级特性。文章通过市场调研、内容创作等实战案例,详细演示了如何定义专业Agent角色、建立任务依赖关系,并对比了与AutoGen的适用场景差异。CrewAI特别适合结构化任务场景

2026-05-20 09:20:39 640

原创 AutoGen框架详解:微软Multi-Agent开发利器

本文介绍了微软开源的AutoGen框架,这是一个用于构建Multi-Agent系统的强大工具。AutoGen支持多Agent协作、代码执行、工具集成和角色定制,适用于复杂任务如代码生成、数据分析和决策流程。文章详细讲解了核心概念(ConversableAgent、GroupChat)、快速入门示例以及高级特性(自定义Agent、嵌套聊天)。通过实战案例展示了如何构建自动化数据分析Pipeline,并分析了AutoGen的优缺点及适用场景。最后提供了最佳实践建议和相关资源,帮助开发者快速上手这一框架。

2026-05-20 09:18:15 1313

原创 Agent开发10个常见陷阱及避免方法(血泪总结)

工具描述太简单description="搜索" # ← 太模糊陷阱严重程度解决难度关键措施工具定义不规范⭐⭐⭐易详细描述+示例Prompt设计不当⭐⭐⭐⭐中明确角色+边界错误处理缺失⭐⭐⭐⭐⭐易全面异常捕获记忆管理混乱⭐⭐⭐⭐中会话隔离+持久化工具调用死循环⭐⭐⭐⭐⭐中迭代限制+监控返回值格式错误⭐⭐⭐易统一返回字符串并发处理问题⭐⭐⭐⭐⭐难锁+独立会话安全性不足⭐⭐⭐⭐⭐难输入验证+权限性能瓶颈⭐⭐⭐中缓存+并行。

2026-05-14 09:21:52 672

原创 LangChain新手必看的10个常见错误及解决方案(建议收藏)

《LangChain初学者10大常见错误及解决方案》摘要 本文总结了LangChain初学者最常遇到的10个错误及解决方法,包括:1)模块导入失败需安装对应子模块包;2)API超时应设置timeout参数;3)记忆丢失需正确传递Memory对象;4)工具定义需详细描述;5)Prompt格式错误需匹配变量;6)向量存储需固定嵌入模型;7)链式调用应使用invoke();8)异步处理需正确使用async/await;9)版本兼容问题需固定版本号;10)性能优化可采用缓存和批量处理。文章提供了具体代码示例和优化建

2026-05-14 09:20:15 683

原创 LangChain vs LlamaIndex vs Haystack:三大Agent框架深度对比与选型指南

本文对比分析了三大主流AI开发框架:LangChain、LlamaIndex和Haystack。LangChain擅长Agent编排,提供灵活的工作流构建;LlamaIndex专精RAG应用,简化私有数据接入;Haystack则专注于生产级搜索系统。文章从架构设计、核心功能、性能表现等维度进行详细对比,并给出选型建议:初学者推荐LlamaIndex,Agent开发首选LangChain,生产部署建议Haystack。最后指出可根据项目需求组合使用不同框架,并提供了各框架的最佳实践建议。

2026-05-13 09:17:30 577

原创 Tree of Thoughts详解:思维树搜索算法

思维树(Tree of Thoughts, ToT)是一种突破传统线性推理的AI框架,通过树状结构探索多路径解决方案。其核心优势在于: 多路径探索:同时生成多个候选思路(如24点游戏中的不同运算组合),避免单一路径的局限性 智能评估:使用LLM自动评估每条路径的质量(0-10分),筛选最优解 灵活回溯:发现无效路径时可退回选择其他分支(如创意写作中的不同故事开头) 实现要点: 支持BFS/DFS/启发式三种搜索策略 包含剪枝、缓存、并行化等优化手段 适用于数学证明、复杂决策等需要多方案对比的场景 典型效果:

2026-05-13 09:04:18 727

原创 AI 入门 30 天挑战 - Day 30 - 毕业项目和职业规划

本文是AI入门30天挑战的毕业总结,包含以下核心内容: 学习成果回顾 完整30天学习路线图:从机器学习基础到深度学习进阶 累计完成11个项目、30篇教程、115+个费曼输出 掌握Python/PyTorch等技术栈,建立完整AI知识体系 毕业项目实战 开发智能股票分析系统(代码量300+行) 功能模块:数据获取→LSTM预测→情感分析→交易信号 综合运用NumPy/Pandas/Matplotlib/LSTM等技术 职业发展规划 4大AI职业方向分析(算法/开发/产品/研究) 分阶段学习计划(1-3个月巩固

2026-05-13 09:02:11 346

原创 ReAct框架深度解析:让Agent会思考再行动

ReAct框架是一种结合推理(Reasoning)和行动(Acting)的AI代理架构,通过交替进行思考和工具调用来解决复杂问题。相比传统方法,ReAct具有以下优势:1)能获取实时外部信息;2)提供清晰的推理过程;3)具备自我修正能力;4)可解释性强。文章详细介绍了ReAct的数学原理(马尔可夫决策过程)、两种实现方案(从零实现和使用LangChain),并提供了优化技巧(提示词工程、工具设计、早期停止策略等)和性能评估指标。该框架特别适合需要多步推理和外部信息的复杂任务,是构建智能代理系统的有效方法。

2026-05-12 09:11:34 719

原创 Agent工具调用:让AI拥有超能力

本文介绍了LLM工具调用的核心技术与实战应用。通过对比纯LLM的局限性(无法获取实时信息、计算易错等)和工具调用的优势(实时数据、精确计算等),阐述了工具调用的必要性。详细讲解了四种实现方案:LangChain基础工具、内置工具集、自定义工具类和智能工具路由,并提供了完整的智能研究助手项目代码。文章还分享了性能优化技巧(并行调用、预筛选、缓存)和最佳实践(单一职责、清晰描述等),最后解答了工具滥用防护、调用失败处理等常见问题。掌握工具调用技术能让AI Agent具备获取实时信息、执行复杂计算等"超

2026-05-12 09:05:28 575

原创 AI 入门 30 天挑战 - Day 29 - 面试准备指南

【AI面试准备指南】本文提供全面的AI岗位面试准备策略,包含四大核心环节:1.简历优化(6大标准+STAR法则项目模板)2.算法题准备(4类高频题型+代码实现)3.项目展示技巧(情境-任务-行动-结果框架)4.模拟面试题库(8类常见问题+应答技巧)。特别强调量化成果、技术沟通能力和持续学习的重要性,并附赠GitHub资源库和费曼学习法指导,帮助求职者在3-4小时内系统提升面试竞争力。

2026-05-12 09:02:49 375

原创 AI 入门 30 天挑战 - Day 28 - 前沿技术概览

Agent = 智能体 = 能自主行动的智能系统传统 AI(被动型):→ 你问它才回答→ 给指令才执行→ 像个工具人AI Agent(主动型):→ 有明确目标→ 能自己规划步骤→ 会使用各种工具→ 能根据反馈调整策略→ 像个得力助手例子:订机票传统 AI:你:帮我查一下北京到上海的航班AI:显示航班列表你:哪个最便宜?AI:显示价格你:那就这个吧AI:出票成功AI Agent:你:下周去上海出差 3 天AI Agent:→ 自动查航班(考虑时间和价格)

2026-05-11 09:13:29 497

原创 Agent记忆系统:让AI拥有长期记忆能力

本文介绍了构建智能Agent记忆系统的关键技术方案,包括: 记忆系统架构设计 采用三层记忆模型:短期记忆(对话缓冲)、工作记忆(任务上下文)、长期记忆(向量数据库) 结合知识图谱存储结构化关系信息 核心实现方案 LangChain Memory基础用法(缓冲记忆/摘要记忆/滑动窗口记忆) 基于向量数据库的长期记忆系统实现 知识图谱记忆的组织与查询方法 混合记忆系统的完整实现 关键技术点 记忆压缩与分层存储策略 智能检索与遗忘机制 隐私保护与性能优化方案 实战案例 个性化助手系统实现 记忆增强的对话流程 用户

2026-05-11 09:10:40 1082

原创 多Agent协作系统:让AI团队协同工作

多Agent协作系统通过专业化分工提升复杂任务处理能力。本文介绍了三种主流架构(中心化/去中心化/层级化)及两种实现方案(CrewAI/LangGraph),并演示了智能投研系统的完整案例。关键优势包括:任务分解实现原子化处理、角色分工确保专业质量、并行执行提高效率。最佳实践强调Agent单一职责原则和任务原子性设计,同时提供性能优化与调试技巧。这种协作模式能有效克服单Agent在专业覆盖、质量稳定性和并行处理方面的局限,是构建复杂AI系统的重要方向。

2026-05-09 09:11:16 673

原创 2026年AI Agent发展趋势预测

2026年AI Agent八大核心趋势:1)多Agent协作成为主流,实现复杂任务团队化处理;2)自主Agent具备目标驱动、自我修正能力;3)具身智能突破虚拟界限,实现物理世界交互;4)企业级平台提供低代码开发与治理能力;5)安全监管体系日趋严格,催生专业中间件;6)成本优化策略(模型路由/语义缓存)降低80%费用;7)垂直领域专业化发展,医疗/法律/金融成热点;8)开源闭源生态并存,形成混合部署方案。技术发展将带来500%市场规模增长,创造年薪百万级的新职业机会。建议开发者重点掌握多Agent协作与垂直

2026-05-09 09:03:59 883

原创 Agent评估与测试:如何确保AI系统的可靠性

本文系统介绍了AI Agent测试的完整框架与实践指南。针对Agent系统的非确定性、主观性和复杂性特点,提出了分层测试金字塔:单元测试(Prompt验证、工具函数、输出解析)、集成测试(RAG系统、工作流、多租户隔离)和端到端测试。详细展示了质量评估方法(RAGAS指标、人工评估、A/B测试)和自动化测试框架实现,包括CI/CD集成和监控告警系统。通过实际案例证明该框架能显著提升系统质量(Bug发现率+60%,用户满意度3.5→4.5),并总结了分层测试、Mock LLM、自动化等最佳实践,为构建可靠Ag

2026-05-09 08:58:21 770

原创 AI 入门 30 天挑战 - Day 27 - AI 伦理和安全

本文是AI入门30天挑战系列的第27天课程,聚焦AI伦理问题。课程通过生动比喻(如"超能力药水"和"驾驶规则")阐释技术开发与伦理规范的关系,详细分析了AI可能带来的四大问题:偏见歧视(如招聘AI性别偏见)、隐私泄露(健康数据滥用)、失控风险(自动驾驶道德困境)和就业冲击。实战部分包含Python代码演示如何检测和缓解招聘模型中的性别偏见,并介绍差分隐私和联邦学习等保护技术。课程通过COMPAS量刑系统、亚马逊招聘AI等真实案例,总结出公平性、透明度、隐私保护等7大伦

2026-05-09 08:56:39 400

原创 Agent安全与防护:防止Prompt注入和数据泄露

多层防护,不要依赖单一机制:- 输入验证 → Prompt清洗 → 权限控制 → 输出过滤 → 审计日志✅输入验证- 防止恶意输入✅Prompt清洗- 防止注入攻击✅权限控制- 确保数据隔离✅输出过滤- 防止信息泄露✅审计日志- 完整的追溯能力采用纵深防御策略遵循最小权限原则持续监控和告警定期安全审计员工安全意识培训实施完整的安全中间件进行渗透测试建立安全响应流程定期更新安全策略👉GitHub仓库。

2026-05-08 08:55:52 737

原创 Agent工作流编排:LangGraph实战指南

本文介绍了LangGraph工作流编排系统的核心概念与实践应用。主要内容包括: LangGraph优势:支持条件分支、循环重试、并行执行和有状态管理,克服传统线性链式处理的局限性。 核心组件: State:使用TypedDict定义结构化状态 Node:实现单一职责的节点函数 Edge:支持条件和普通两种边类型 实战案例: 智能客服工单系统:实现工单分类、知识检索、回复生成、人工审核全流程 多轮对话Agent:具备意图识别、实体提取和人工转接能力 高级特性: 并行执行优化性能 检查点实现断点续传 流式输出增

2026-05-08 08:54:57 380

原创 AI 入门 30 天挑战 - Day 26 - 模型部署和工程化

本文介绍了AI模型部署的核心概念与实践方法。主要内容包括:1)模型部署与训练的区别,通过餐馆经营等生活化比喻解释;2)Flask API开发详解,包含RESTful接口设计、错误处理和健康检查;3)模型优化技术(量化、ONNX转换);4)实战股票分析服务项目。教程采用费曼学习法,强调概念解释和代码实践结合,提供完整项目代码和GitHub资源。适合AI初学者在3-4小时内掌握模型部署的关键技能,为Day27的AI伦理学习打下基础。

2026-05-08 08:53:34 500

原创 AI 入门 30 天挑战 - Day 25 - 强化学习入门

"""DQN = Deep Q-Network(深度 Q 网络)解决的问题:Q-learning 只能处理小状态空间→ 状态多了,Q-table 太大存不下→ 比如围棋:10^170 种状态→ 比如图像:每个像素都是状态解决方案:用神经网络代替 Q-table!

2026-05-07 09:02:29 449

原创 Agent监控与日志:生产环境的可观测性

这篇文章详细介绍了基于Prometheus+Grafana+ELK+Jaeger的生产级监控方案,主要内容包括: 监控架构设计 采用Metrics(Prometheus)、Logs(ELK)、Traces(Jaeger)三大支柱 通过Grafana实现统一可视化 核心功能实现 指标监控:定义QPS、响应时间、错误率等关键指标 结构化日志:采用JSON格式记录请求全生命周期 链路追踪:集成OpenTelemetry实现分布式追踪 告警系统 配置错误率、慢请求、缓存命中率等告警规则 支持Slack和邮件通知渠道

2026-05-07 08:58:18 692

原创 AI 入门 30 天挑战 - Day 24 费曼学习法版 - 情感分析实战

第 1 步:回顾今天的内容(5 分钟)情感分析的基本概念BERT 情感分类原理股票评论监控系统第 2 步:合上教程,尝试完整教授(15 分钟)⭐任务:假装你在给一个完全不懂的人上第二十四堂课情感分析是怎么工作的(用至少 2 个比喻)BERT 相比传统方法的优势演示舆情监控系统讲解实际应用价值方式:写一篇 800 字左右的文章,或录一段 10-15 分钟的视频第 3 步:标记卡壳点(5 分钟)

2026-05-06 08:12:57 408

原创 多租户RAG架构:如何服务1000+企业客户

企业级多租户RAG系统架构指南 本文详细介绍了构建支持1000+租户的企业级RAG系统架构方案。核心内容包括: 多租户隔离:提供Schema隔离(安全优先)和Row隔离(性能优先)两种方案,推荐混合使用策略 权限管理:基于RBAC模型的精细权限控制,包含Admin/Editor/Viewer等角色定义 资源调度:配额管理、限流机制和优先级队列实现公平资源分配 性能优化:连接池、缓存策略和异步处理等关键技术 实战案例:分享SaaS客服平台和企业知识库平台的成功实施经验 系统采用JWT认证、自动扩缩容和灰度发布

2026-05-06 07:55:24 1007

原创 AI 入门 30 天挑战 - Day 23 - GPT 和文本生成

第 1 步:回顾今天的内容(5 分钟)GPT 的自回归生成机制Masked Attention 原理文本生成温度和采样股票报告自动生成第 2 步:合上教程,尝试完整教授(15 分钟)⭐任务:假装你在给一个完全不懂的人上第二十三堂课GPT 是怎么写文章的(用至少 2 个比喻)为什么 GPT 只能用单向 Attention温度和采样的作用演示股票报告自动生成方式:写一篇 800 字左右的文章,或录一段 10-15 分钟的视频第 3 步:标记卡壳点(5 分钟)

2026-05-06 07:52:13 399

原创 GPT-4o 的 Agent 能力评测:全面测试与深度分析

本文为原创文章,首发于 CSDN 平台,转载请联系作者授权。Lee |2026-04-27| 本系列共 8 篇,持续更新中...

2026-04-30 12:17:51 872

原创 AI 入门 30 天挑战 - Day 22 - Transformer 进阶应用

第 1 步:回顾今天的内容(5 分钟)□ Multi-Head Attention 原理□ Attention 可视化□ 股票新闻情感分析第 2 步:合上教程,尝试完整教授(15 分钟)⭐假装你在给一个完全不懂的人上第二十二堂课Multi-Head Attention 的工作原理(用至少 2 个比喻)为什么要用多个头演示 Attention 可视化的意义讲解股票新闻分析系统📝 写一篇 800 字左右的文章🎤 录一段 10-15 分钟的视频👥 找个朋友,给他讲一遍。

2026-04-30 12:15:13 539

原创 Agent性能优化:从秒级到毫秒级的提速技巧

本文介绍了AI Agent性能优化的全面指南,重点围绕四大核心策略: 缓存优化:通过内存缓存、Redis分布式缓存和语义缓存三级架构,可将响应时间从3-5秒降至200-500ms,缓存命中率达50-80%时性能提升6-10倍。 异步处理:采用asyncio异步IO、多线程和消息队列技术,使并发处理能力从10QPS提升至100+QPS,任务处理时间缩短5-10倍。 批处理技术:通过合并API请求,减少60-80%的调用次数,同时结合流式响应改善用户体验,平均响应时间降低40-60%,成本节约50-70%。 模

2026-04-29 09:22:30 860

原创 AI 入门 30 天挑战 - Day 21 - week3综合项目

□ Week 3 学了什么?列出所有技术和方法□ 目标检测和图像分割的区别是什么?□ GAN 的核心思想是什么?怎么训练的?□ Transformer 相比 RNN 有什么优势?□ BERT 和 GPT 各适合什么场景?□ 语音识别的关键技术有哪些?□ 如果让你选择一个方向深入研究,你会选什么?为什么?⏰ 时间:35 分钟如果能答出 80% 以上,我们开始今天的毕业项目!如果不够,花 5 分钟快速翻阅 Week 3 的笔记。你要向朋友展示你做的毕业项目说明为什么选择这个项目。

2026-04-29 09:12:48 520

原创 AI Agent实战专栏导读:6周掌握智能代理开发(含完整代码)

【摘要】AIAgent实战专栏是国内首个系统化智能代理开发教程,包含8篇深度教程和5个开源项目。专栏分四周递进式教学:基础概念→核心技术→进阶实战→总结展望,涵盖RAG知识库、多智能体协作、多模态应用等核心内容。所有教程和代码完全免费,采用MIT许可证,支持商业用途。学习者可通过GitHub获取完整项目代码,包括智能客服、数据分析Agent等实用案例。专栏提供三种学习路径(快速上手/系统学习/深度实践),适合开发者、产品经理等不同背景的学习者,帮助掌握从基础到企业级的Agent开发能力。(149字)

2026-04-28 10:37:34 408

原创 RAG实战:让AI拥有企业知识库

检索增强生成简单来说,就是让AI在回答问题之前,先从你的知识库中查找相关信息,然后基于这些信息生成答案。✅ 让LLM拥有"记忆",可以访问私有知识✅ 减少幻觉,提高答案准确性✅ 成本低,无需微调模型✅ 灵活性强,知识库可随时更新选择合适的Embedding模型合理分割文档,保持语义完整优化提示词,引导LLM基于资料回答添加引用来源,提高可信度持续迭代,根据反馈优化检索策略尝试完整项目代码接入真实业务数据优化检索和生成效果部署到生产环境👉GitHub仓库。

2026-04-28 10:22:11 471

原创 多模态大模型实战:用 GPT-4o API 打造 AI 助手,能看、能听、能说!

多模态AI技术解析与实战指南(2024版) 摘要:本文深入解析当前主流多模态大模型(GPT-4o、Gemini1.5、Claude3.5等)的技术特性与成本对比,提供完整的Python实战代码。重点演示了四大核心场景:1)拍照解题(图像理解);2)代码调试(截图分析);3)文档处理(PDF解析);4)语音交互(实时对话)。特别对比了不同模型的性价比,推荐GPT-4o mini方案(成本降低16倍),并给出本地部署的Llama3.2开源方案。文章包含GitHub完整项目,涵盖多模态API调用、错误处理、批量操

2026-04-28 09:01:17 646

原创 AI 入门 30 天挑战 - Day 20 费曼学习法版 - 语音识别基础

这篇教程是AI入门30天挑战系列的第20天课程,主要讲解语音识别技术。文章首先通过生活场景引入语音识别的概念,然后详细解析了从声波到文字的转换过程,包括声音数字化、特征提取等关键技术。教程重点介绍了端到端语音识别的两种核心方法:CTCLoss和Attention机制,并通过Whisper实战演示了完整的语音识别流程。最后提供了实际应用建议和学习总结模板,帮助学习者巩固知识。课程采用费曼学习法,强调通过通俗比喻来理解复杂概念,适合AI初学者循序渐进地掌握语音识别技术。

2026-04-28 08:58:57 554

原创 AutoGPT 实战:让 AI 自主完成任务的终极指南

AutoGPT技术解析与实战指南 摘要:AutoGPT作为2023年爆红的开源AI项目,通过自主任务分解和执行机制实现了革命性突破。本文详细剖析了AutoGPT的核心架构,包含四大关键组件:任务规划器将目标拆解为可执行步骤;记忆系统记录执行过程;执行器完成具体操作;反思机制持续优化决策。实战部分展示了从零构建简化版AutoGPT的全过程,包括环境配置、记忆系统实现、任务规划器开发等关键环节,并提供了自动写博客、市场调研等典型应用场景的完整代码示例。相比传统交互式AI,AutoGPT可将工作效率提升20-30

2026-04-27 09:02:02 663

原创 AI 入门 30 天挑战 - Day 19 费曼学习法版 - GAN 生成对抗网络

就是用卷积神经网络做的 GAN特点:✓ 用卷积层代替全连接层✓ 生成效果更好✓ 训练更稳定✓ 适合生成图片架构:生成器:从噪声逐渐放大成图片判别器:从图片逐渐压缩成判断第 1 步:回顾今天的内容(5 分钟)□ GAN 的核心思想(猫鼠游戏)□ 生成器和判别器的作用□ DCGAN 的架构□ 训练流程和技巧□ 实际应用场景第 2 步:合上教程,尝试完整教授(15 分钟)⭐假装你在给一个完全不懂的人上第十七堂课GAN 的基本原理(用至少 2 个比喻)生成器和判别器各做什么工作。

2026-04-27 09:00:31 606

原创 优化器进化史:从 SGD 到 AdamW,到底该用哪个?

《深度学习优化器全面指南:从SGD到AdamW》摘要 本文系统介绍了主流优化器的发展历程和特点: 基础优化器:SGD(1951)及其改进版SGD+Momentum(1964),通过加入惯性减少震荡 自适应优化器:RMSProp(2012)实现参数级学习率调整,Adam(2014)结合动量和自适应学习率 当前最佳方案:AdamW(2017)通过修正权重衰减实现更好的泛化能力 关键对比: 收敛速度:SGD最慢,Adam/AdamW最快(10倍提升) 泛化能力:SGD最好(85%),AdamW次之(85%),Ad

2026-04-23 09:05:34 509

原创 AI 入门 30 天挑战 - Day 18 费曼学习法版 - 图像分割基础

本文介绍了图像分割技术的核心概念和应用方法。主要内容包括:1)图像分割与目标检测的区别,前者实现像素级精确识别;2)两种分割类型:语义分割(分类像素)和实例分割(区分个体);3)三大核心算法:FCN(开创全卷积)、U-Net(医学图像首选)和Mask R-CNN(检测分割一体);4)通过代码实践展示了U-Net结构的实现过程,包括编码器-解码器架构和跳跃连接机制。文章采用生活化比喻解释技术原理,并提供了完整的PyTorch实现代码,帮助读者理解如何从图像中精确分离目标物体,适用于医疗影像分析、自动驾驶等需要

2026-04-23 09:00:58 667

原创 损失函数大全:从 MSE 到 Focal Loss,到底该用哪个?

文章摘要:本文系统介绍了深度学习中常用的损失函数及其应用场景。从回归任务的MSE、MAE、Huber Loss,到分类任务的CrossEntropy和解决类别不平衡的FocalLoss,再到分割任务的DiceLoss,详细分析了每种损失函数的数学原理、代码实现、优缺点及适用场景。特别强调了损失函数选择对模型性能的关键影响,如FocalLoss如何解决目标检测中的类别不平衡问题。文章还提供了损失函数选择指南、实战调试技巧和常见组合方案,并附有完整代码实现和对比实验。适合AI开发者作为损失函数选择的实用参考手册

2026-04-23 08:57:41 865

原创 Claude Code 底层原理:如何实现多文件编辑?揭秘 Agent 工作流!

上下文层:- 项目扫描(智能过滤)- 依赖分析(AST 解析)- 相关性排序规划层:- ReAct 框架升级- 任务拆解- 风险评估执行层:- 代码生成(LLM)- Diff 应用- 并行修改验证层:- 自动测试- 静态检查- 纠错循环安全层:- Docker 沙箱- 权限控制- 操作日志未来展望:更智能- 理解业务逻辑(不仅是代码)更安全- 形式化验证更快速- 本地模型加速更通用- 支持更多语言。

2026-04-22 09:08:27 316

原创 用 Agent 做智能投研助手:从 20 小时到 15 分钟的效率革命

Agent 不是替代证券分析师,而是增强证券分析师。60% 的重复工作→ Agent 自动完成40% 的创造性工作→ 你专注深度思考和决策效率提升:27 倍成本降低:99.95%错误率降低:80%下载源码,跑通示例接入真实数据源(Tushare)定制化的研究模板持续优化 Prompt这套系统我已经用在实际学习中,效果非常好。在 GitHub 提 Issue在 CSDN 评论区讨论。

2026-04-22 09:04:31 810

原创 AI 入门 30 天挑战 - Day 15 费曼学习法版 - Faster R-CNN

场景:一张足球比赛的照片图像分类(Week 2 学的):你问:"这是什么场景?AI 答:"足球场" ❌ 只有整体标签问题:- 场上有多少人?不知道- 球在哪里?不知道- 球门在哪个位置?不知道目标检测(今天要学的):你问:"图里有什么?在哪里?AI 答:- 左上角有个人(边界框 + 95% 置信度)✅- 中间有个足球(边界框 + 88% 置信度)✅- 右下角有球门(边界框 + 92% 置信度)✅既知道是什么,又知道在哪里!

2026-04-22 09:00:18 381

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除