成为AI产品经理
文章平均质量分 88
一深思AI
这个作者很懒,什么都没留下…
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
提示工程已死,指令架构永生:深度复盘 GPT-5.5 与 Claude 4.7 带来的范式转移
文章摘要:随着GPT-5.5与Claude4.7的发布,生成式AI正从"概率机器"转变为"确定性执行引擎",提示工程进入"指令架构"新范式。核心变化包括:Claude4.7采用"搜索优先"策略强化事实验证,极端字面主义要求显式指令,"零引用"机制规避版权风险,指令顺序优化可提升30%输出质量,推理努力度分级实现智能按需分配。这些变革标志着AI交互从直觉艺术升级为严谨的逻辑设计,开发者需构建精确的边界条件和认知原创 2026-06-13 22:33:14 · 289 阅读 · 0 评论 -
揭秘大模型之心:Transformer 架构的演进与核心原理
本文系统梳理了大语言模型(LLM)的技术演进与Transformer架构的核心突破。文章首先指出LLM的崛起是计算系统的质变飞跃,随后分四个阶段解析语言模型发展历程:从早期统计模型到千亿参数规模的现代LLM。重点剖析了Transformer的核心创新——自注意力机制,其模块化设计(自注意力层、前馈网络和层归一化)实现了对长程语义的全局捕捉。文章还探讨了Transformer向多模态(如CLIP模型)的扩展,以及预训练-微调范式在模型专业化中的作用。最后强调Transformer不仅是NLP的基石,更为AGI原创 2026-06-13 22:28:48 · 519 阅读 · 0 评论 -
【系统学AI】论文导读 ③:Building Effective Agents——Anthropic 的 Agent 设计圣经
Anthropic发布的工程指南《Building Effective Agents》系统阐述了AI智能体的工业实践方法论。核心观点包括:严格区分预定义工作流与自主Agent,提出6种递进式设计模式(增强型LLM、提示链、路由分发、并行化、编排-工作者、自主Agent),强调"先简后繁"的选型原则。指南特别指出工具设计比框架选择更重要,并总结了可靠Agent的三大工程原则。文章还定义了新型"Computer Use"模式(通过视觉界面操作),分析了常见失败模式及解决方案。该指南因其实用性和系统性被主流Age原创 2026-06-02 10:53:57 · 294 阅读 · 0 评论 -
【系统学AI】论文导读 ②:GraphRAG 与 DPO——检索增强和对齐训练的两大突破
文章摘要 微软GraphRAG(2024)通过构建知识图谱和分层聚类,解决传统RAG在全局性问题检索上的不足,显著提升回答全面性(覆盖率达70-80%)。其两阶段架构(索引构建+全局/局部检索)虽成本较高,但适用于综合分析场景。 斯坦福DPO(2023)简化了RLHF流程,通过数学映射直接利用偏好数据优化模型,省去奖励模型训练和PPO步骤,效果接近RLHF但更稳定高效。后续衍生出IPO、KTO等变体,成为对齐领域主流方法。 两篇论文分别从检索和对齐角度推动AI技术进步:GraphRAG让模型"找得到",DP原创 2026-06-02 10:52:53 · 252 阅读 · 0 评论 -
【系统学AI】25 论文导读 ①:两篇改变 AI 的开山之作——Attention Is All You Need & ReAct
摘要: 本文对比两篇奠定AI发展基石的论文:《Attention Is All You Need》(2017)提出Transformer架构,通过自注意力机制解决RNN的序列建模缺陷,成为GPT、BERT等大模型的引擎;《ReAct》(2022)则构建"推理-行动-观察"循环框架,赋予大模型动态决策能力,成为Agent技术的方向盘。前者定义"大模型如何思考",后者定义"大模型如何行动",二者共同推动AI从静态推理迈向主动交互的Agent时代。Transformer支撑模型底层计算(如并行处理、长程依赖),R原创 2026-06-02 10:46:18 · 466 阅读 · 0 评论 -
【系统学AI】24 ITSM 的 AI 化革命:从 ServiceNow Now Assist 到 Salesforce Agentforce 360 全景拆解(2026)
如果你问一个 AI 产品经理:「2026 年企业级 AI Agent 第一个跑出 PMF 的场景是什么?答案大概率是 ITSM(IT Service Management,IT 服务管理)和它的两个亲戚——CSM(Customer Service Management,客户服务管理)、HRSD(HR Service Delivery,HR 服务交付)。为什么?场景闭环性极强:工单流入 → 分类派单 → 知识检索 → 回复处理 → 关闭归档,每个环节都有标准动作和明确产出。原创 2026-06-02 10:37:49 · 1288 阅读 · 0 评论 -
【系统学AI】23 AI 时代产品运营与获客全景:CRM SaaS 大变局 + 增长新范式(2026 调研报告)
AI 获客与 CRM 变革:2025-2026 年核心趋势(摘要) 获客范式迁移:从传统 SEO/SEM 转向生成式引擎优化(GEO),AI 直接推荐品牌成为决策入口,用户无需点击网站即可完成决策。 CRM 升级为自主执行系统:Salesforce、HubSpot、Zoho 等平台全面“Agent 化”,AI 从辅助工具转变为自主执行销售、客服等任务。 AI SDR 工具成熟:11x、Clay、Apollo 等工具组成完整获客栈,部分场景可替代初级销售,冷邮件回复率提升至 40%(行业平均 2-5%)。 定原创 2026-06-01 00:28:49 · 694 阅读 · 0 评论 -
【系统学AI】22 AI 时代 12 大创新商业模式全景拆解:从 a16z、硅谷案例到中国实践(2026)
2026 年我们正处在一个分水岭基础设施层已经打完价格战(Token 成本暴跌 90%+)应用层刚刚开始探索"结果定价"广告模型刚启动第一步(OpenAI 2026.02)FTE 替代的万亿市场才刚刚被打开我的终局预判层次2028 年大概率的商业模式基础设施(OpenAI/Anthropic/DeepSeek API)免费 / 极低价(赢在规模)平台层(Salesforce/ServiceNow/Dify)信用池 + Marketplace 抽成应用层(垂直 Agent 公司)原创 2026-06-01 00:25:26 · 319 阅读 · 0 评论 -
【系统学AI】21 AI产品定位:April Dunford方法在AI红海中的应用
本文深入探讨了2024年AI产品如何通过精准定位在红海市场中突围。作者基于April Dunford的《Obviously Awesome》方法论,结合Cursor、Perplexity等案例,提出五步定位框架: 竞争对手分析:需包含直接竞品、间接方案和用户现状("做没做"选项) 差异化挖掘:要超越表层功能,寻找数据资产、工作流集成等系统性优势 价值翻译:采用From-To叙事,将技术能力转化为用户可感知的情感价值 用户聚焦:通过分析高价值客户特征定义理想用户画像(ICP),避免"服务所有人"陷阱 类别选择原创 2026-06-01 00:22:50 · 307 阅读 · 0 评论 -
【系统学AI】20 Agent计费策略:从Devin到Manus的5大定价案例
2026年AI Agent定价分化出五大流派,各自匹配不同产品形态:Devin(订阅+任务复杂度)、Manus(订阅+海外定价)、Claude Code(按Token+订阅混合)、Cursor(订阅+按座位)、Intercom Fin(按结果付费)。核心差异在于成本预测性(按Token vs 订阅)和价值量化难度(固定收费 vs 按效果)。Devin对标人力成本,Manus抢占通用心智,Claude Code作为API入口,Cursor创新快慢请求机制,Intercom Fin实现价值完全对齐。定价策略需结原创 2026-06-01 00:19:27 · 992 阅读 · 0 评论 -
【系统学AI】19 AI定价模式全解(2026版):从Token到Outcome的6种模式
AI定价模式全景解析(2026趋势) 核心摘要: AI服务定价呈现6大模式演进路径: 按Token计费(API场景主流,但面临用户体验挑战) 订阅制(ChatGPT等C端产品标配,需平衡配额与成本) 按席位收费(企业级SaaS首选,匹配传统采购流程) 按调用次数(适合GPT Store等平台型市场) ⭐按结果付费(2026爆发趋势,如Intercom Fin按$0.99/次解决问题计价) 混合模式(如Claude Pro Max结合订阅+超量Token计费) 关键洞见: 定价选择取决于成本可预测性(企业需求原创 2026-06-01 00:15:16 · 1577 阅读 · 0 评论 -
【系统学AI】18 AI Native设计原则(2026版):10大原则+反模式+落地清单
AI Native设计原则:10大正向原则与10大反模式 本文提炼了AI原生产品的10大设计原则及对应反模式,帮助产品团队构建真正以AI为核心的应用: 核心原则 意图驱动:用户表达目标,AI理解执行 上下文最大化:主动采集多维度上下文 多入口设计:AI能力无缝嵌入工作流 可干预性:透明化AI决策过程 持续学习:建立多层记忆系统 关键补充原则 优雅处理失败(明确原因+降级方案) 输出可验证(引用+推理链+diff) 渐进式自主(按信任度调节自动化) 支持异步操作(长任务管理) 人机协作赋能(避免替代叙事) 1原创 2026-06-01 00:12:30 · 408 阅读 · 0 评论 -
【系统学AI】17 Claude Code范例:AI Native产品如何重塑软件开发
AI Native编程革命:Claude Code重塑软件开发模式 这篇文章介绍了Anthropic公司开发的Claude Code如何通过AI Native设计重塑软件开发流程。主要内容包括: 产品定位:Claude Code是一个命令行形态的Agent操作系统,采用极简CLI界面实现强大的自主编程能力,将程序员角色转变为"系统设计+代码审阅"。 核心创新: 直接暴露10个基础工具给AI,而非封装抽象层 使用文件系统作为记忆存储,而非专用数据库 采用Subagents并行处理机制 实现渐进式自主和记忆压缩原创 2026-05-31 13:05:24 · 356 阅读 · 0 评论 -
【系统学AI】16 AI产品化:从套壳到原生的产品思维革命
AI Native = 从0开始为AI设计的产品,AI不是辅助而是核心交互方式。Wrapper是给现有产品贴个AI补丁,Native是产品的每一寸都被AI重构。判断标准很简单——把AI抽掉产品还能用吗?能用就是Wrapper,不能用就是Native。Cursor看起来就是VSCode + AI设计点VSCode + Copilot(Wrapper思路)Cursor(Native思路)AI入口侧边栏插件每个交互都是AI入口(Tab补全/Cmd-K/Cmd-L/Composer)上下文当前文件。原创 2026-05-31 13:03:03 · 356 阅读 · 0 评论 -
【系统学AI】15 RAG评测体系:RAGAS四维+TruLens+ARES全套方案
本文介绍了2026年RAG评测的最佳实践方案,核心是通过分层归因方法将RAG系统的评估拆解为"检索质量"和"生成质量"两个维度,并重点推荐RAGAS四维评测框架(Faithfulness/Answer Relevancy/Context Precision/Context Recall)。文章指出单一指标容易产生误导,建议结合多维度评估、真实流量分析和人工抽检。同时介绍了TruLens的轨迹评测方法和ARES自动化评测系统,强调生产环境应建立持续监控和A/B测试机制。RAGAS框架的四个关键指标及其健康阈值原创 2026-05-30 13:22:18 · 238 阅读 · 0 评论 -
【系统学AI】14 RAG工程实践(2026版):从0到生产的全栈技术选型
生产级RAG系统包含7大技术环节:文档解析(50%质量影响)、Chunking(20%)、Embedding(15%)、向量库存储、Reranker(10%)、混合检索策略和生成层优化。2026年主流方案包括: 文档解析:Docling(企业级)、MinerU(PDF专精)、Unstructured(多格式) Chunking:推荐Late Chunking新技术,保留全文语义上下文 Embedding:BGE-M3(开源综合最强)、bge-large-zh(中文专原创 2026-05-30 13:20:06 · 390 阅读 · 0 评论 -
【系统学AI】12 GraphRAG深度解析(2026版):当RAG遇上知识图谱
GraphRAG = 把文档转成知识图谱+社区检测+分层摘要。传统RAG搜文本片段,GraphRAG搜知识结构。适合全局性问题、多跳推理、跨文档综合分析——但索引成本是传统RAG的5-10倍,小数据集别用。对每个社区,调用LLM生成结构化摘要这个社区的核心内容关键实体主要关系最终产物:一张分层的、带摘要的知识图谱——相当于给文档画了一张从宏观到微观的知识地图。维度要点核心思想文档→知识图谱→社区检测→分层摘要索引阶段切块→提取实体关系→构图→Leiden社区检测→生成摘要查询阶段。原创 2026-05-30 10:53:35 · 572 阅读 · 0 评论 -
【系统学AI】12 GraphRAG深度解析:当RAG遇上知识图谱
GraphRAG:知识图谱赋能的下一代RAG技术 摘要 GraphRAG是微软2024年开源的一种新型检索增强生成(RAG)技术,通过构建知识图谱解决传统RAG"只见树木不见森林"的局限性。其核心创新在于: 将文档转换为结构化知识图谱,支持全局视角和多跳推理 采用Leiden算法进行社区检测和分层摘要 提供三种查询模式(全局/局部/漂移搜索)应对不同问题类型 相比传统RAG,GraphRAG在回答跨文档、全局性问题时优势明显,但索引成本高出5-10倍。目前已有LightRAG等优化版本,降低77%的计算开销原创 2026-05-30 09:23:23 · 403 阅读 · 0 评论 -
【系统学AI】11 Agent开发框架选型(2026版):最新的11大框架地图“
2026年没有"通用最佳"框架,只有"按生态/语言/复杂度"匹配的最佳生产首选:LangGraph(最成熟)Anthropic生态OpenAI生态TypeScript团队:Mastra类型安全Python快速原型:CrewAI极简学习不用框架:80%场景反而最优框架定位最适合学习难度Anthropic生态Claude优先团队中OpenAI生态OpenAI优先团队低LangGraph状态机框架生产级Agent中高MastraTypeScript框架TS团队中类型安全框架。原创 2026-05-30 09:03:31 · 598 阅读 · 0 评论 -
【系统学AI】10 Anthropic Agent设计理念:从五种模式到Computer Use的进化
Anthropic Agent设计演进与实践(2024-2026) Anthropic在《Building Effective Agents》中提出Agent设计的核心原则:优先采用简单Workflow方案,仅在必要时增加自主性。文章系统介绍了六种设计模式,从基础的Prompt串联到2025新增的Computer Use(通过屏幕操作真实软件),并强调模式选型应根据任务复杂度逐步升级。2026年重要更新包括: Subagents架构成为多Agent系统的稳定实现方案 Constitutional AI 2.原创 2026-05-29 10:59:19 · 637 阅读 · 0 评论 -
【系统学AI】09 Multi-Agent架构(2026版):从学术理论到工业级实践
2026年Multi-Agent生态呈现出三大趋势:1)工业级方案从学术框架向标准化演进(OpenAI Swarm/Google A2A);2)主从架构(Subagents)成为生产环境首选;3)跨厂商互操作需求催生A2A协议。核心洞见是Multi-Agent的价值在于解耦而非堆砌**,2026年成熟方案普遍采用"轻量编排+隔离执行"设计,避免早期方案的复杂性和不可靠问题。实践建议优先考虑Anthropic Subagents模式,仅在跨系统协作时引入A2A协议,谨慎评估真正需要平等Multi-Agent的原创 2026-05-29 10:55:39 · 1145 阅读 · 0 评论 -
【系统学AI】08 Plan-then-Execute范式:先想好再做,比ReAct强在哪
摘要:Plan-then-Execute(P-t-E)范式显著优于ReAct的"边想边做"模式,尤其在Web Agent场景成功率提升80%。其核心优势在于: 两阶段解耦:Planner全局规划完整步骤,Executor专注执行,避免ReAct的局部最优陷阱 动态适应性:执行遇阻时可触发重规划,而ReAct只能在当前步骤补救 工业实践验证: OpenAI Codex桌面端采用显式P-t-E处理代码重构 Claude Opus 4.7通过隐式思考实现规划 GLM-5.1创下8小时1700步长链任务纪录 关键结原创 2026-05-28 15:47:56 · 615 阅读 · 0 评论 -
【系统学AI】07 ReAct范式:从奠基之作到Reflexion/RAF的演进
ReAct:2026年AI代理的演进与局限 150字摘要: ReAct框架通过"思考-行动-观察"循环(Thought-Action-Observation)实现了推理与行动的协同,解决了纯推理(CoT)无法获取实时信息和纯行动(Act-only)缺乏规划的痛点。但其存在步骤冗余、错误累积、上下文膨胀和循环死锁四大硬伤。2026年业界已转向更先进的替代方案:Reflexion通过自我反思实现错误恢复,RAF采用多层元认知架构,而Anthropic Subagents则通过多智能体分工突破单循环限制。当前最佳原创 2026-05-28 15:46:03 · 500 阅读 · 0 评论 -
【系统学AI】06 AI Agent学习总览:从Chatbot到Agent OS的进化
AI Agent = LLM + 感知 + 规划 + 工具调用 + 记忆 + 长程自主。它不只是聊天,而是能自主完成多步骤任务。从Chatbot到Agent,是从"回答问题"到"解决问题"的质变;2026年的Agent又进一步——从"调用API"进化到"操作真实电脑",AI正在从"答题层"变成"操作层"。Agent是一个能感知环境、做出决策、采取行动以实现目标的自主系统。LLM(大脑)+ 工具(手和脚)+ 记忆(经验)+ 规划(策略)+ 长程自主(耐力)= Agent💡2026年的关键变化。原创 2026-05-27 19:21:22 · 1172 阅读 · 0 评论 -
【系统学AI】05 LLM模型评测体系:从Benchmark到Agent全链路评测
2026年大模型评测体系已高度专业化,需从7个维度综合评估:通用能力(LiveBench/MMLU-Pro)、编程(SWE-Bench Pro)、推理(AIME/GPQA)、Agent能力、长上下文、安全和中文。关键趋势包括:1)抗污染动态评测(LiveBench)取代静态榜单;2)推理模型形成独立评测体系;3)编程能力分化为基础(HumanEval)和工程级(SWE-Bench Pro)双轨制。选型需结合自动评测、人工盲评(LMArena)和API实测,单一指标已无法反映真实能力差距。原创 2026-05-27 19:18:07 · 1201 阅读 · 0 评论 -
【系统学AI】04 LLM幻觉根因和缓解:为什么AI会一本正经地胡说八道
大语言模型幻觉问题:2026年研究进展与应对策略 摘要: OpenAI 2025年研究证实,大语言模型的幻觉问题(生成看似合理但错误的内容)在数学上不可避免,根源在于训练目标的统计学特性。研究发现: 推理模型幻觉率更高(达48%),因更不愿承认无知; 现有评测体系变相鼓励猜测,导致模型宁可错误也要作答; 幻觉可分为事实性、忠实性、推理性和抽象性四类,其中推理幻觉最具欺骗性。2026年主流解决方案包括: 训练阶段采用RLVR、校准训练等方法 推理时结合RAG检索、自一致性检测等技术 强制引用验证等可审计机制原创 2026-05-26 12:23:09 · 542 阅读 · 0 评论 -
【系统学AI】03 LLM训练全流程:预训练→SFT→对齐五条路线
预训练(让它会说话,TB级数据,千卡月级训练)→SFT(让它会回答,万级指令数据,单机几小时)→对齐(让它说得好,五条路线按需选)。2026年的对齐训练已经从"RLHF vs DPO"的二选一,演化为RLHF/DPO/GRPO/RLVR/RLAIF五条路线的组合工程。维度RLHFDPOGRPORLVRRLAIF核心思想RM+PPO直接偏好组内竞争可验证奖励AI替代人类奖励来源人类排序偏好对组内相对分规则/测试AI裁判模型数量4222+验证器4+AI裁判。原创 2026-05-24 15:01:46 · 748 阅读 · 0 评论 -
【系统学AI】02 token机制全解:LLM如何‘读懂‘人类语言
Token = LLM处理文本的最小单位 核心要点: 分词算法:BPE(GPT)、WordPiece(BERT)、Unigram(T5)三大主流方法 词表大小:GPT-4用100K词表,LLaMA 3扩至128K提升多语言效率 上下文窗口:2026年1M成为标配(可处理整本《三体》) 中英差异:中文Token效率较低(相同内容比英文多用1.3-1.8倍Token) 典型流程: 文本→分词→Token ID→向量→模型处理 技术趋势: 稀疏注意力+KV Cache压缩实现百万级上下文原创 2026-05-24 14:20:49 · 812 阅读 · 0 评论 -
【系统学AI】0 一文搞定AI Agent与RAG:从入门到工程实战的完整学习路线
AI Agent & RAG系统化学习指南(摘要) 本指南提供12周递进式学习路径,涵盖AI Agent与RAG技术全栈知识。分为三阶段: 基础夯实(1-4周):掌握Transformer、RLHF/DPO对齐等LLM核心原理,深入ReAct/Plan-then-Execute等Agent架构范式; 工程实战(5-8周):实践GraphRAG/HiRAG等前沿方案,通过LangChain/LlamaIndex完成RAG和Agent开发; 产品商业(9-12周):学习AI产品思维、商业化策略及行业应用。包含3原创 2026-05-23 23:40:59 · 1107 阅读 · 0 评论 -
【系统学AI】01 Transformer原理全解:从Self-Attention到GPT的架构进化
Transformer是一种革命性的神经网络架构,通过自注意力机制取代传统RNN,实现了并行处理序列数据。其核心组件包括多头注意力机制、位置编码和前馈网络,通过残差连接和层归一化堆叠多层。自注意力机制允许模型直接建模任意位置间的关系,而位置编码则保留了序列顺序信息。这种架构不仅训练效率高,还能捕捉长距离依赖关系,成为GPT、BERT等大模型的基础。文章详细解析了注意力计算过程、多头机制原理及代码实现,帮助读者深入理解Transformer的工作机制。原创 2026-05-23 23:50:44 · 700 阅读 · 0 评论
分享