- 博客(465)
- 收藏
- 关注
原创 LangChain 实战:Agnets核心组件
模型负责"思考与决策",Harness 负责"围绕决策循环的一切"——提示词、工具、中间件、状态管理。这一行函数调用,背后自动编译出了一张 LangGraph 状态图。注入系统提示→ 把包成放到消息列表最前面;调用模型→ 模型基于当前messages决定:直接回答,还是发起tool_calls;执行工具→ 若有tool_callsToolNode执行对应工具,结果以追加进messages;回到模型→ 带着工具结果再次调用模型,进入下一轮推理;循环或终止→ 只要AIMessage里还有。
2026-09-03 15:10:44
176
原创 LangChain 实战:Tools详解
工具扩展了智能体的功能——让它们能够获取实时数据执行代码查询外部数据库以及在现实世界中采取行动。本质上,工具是可调用的函数,具有明确定义的输入和输出,这些输入和输出被传递给聊天模型。模型根据对话的上下文决定何时调用工具,以及提供哪些输入参数。创建工具最简单的方法是使用 @tool 装饰器。@tool"""获取指定城市的美女信息参数:city: 城市名称,如"北京"、"上海"返回:城市的美女怎么样"""return city + " 的美女 GOOD!!!
2026-09-02 09:42:12
203
原创 LangChain 实战:四大家族
家族核心抽象状态管理适用复杂度是否开源主要用途LangChain链 (Chain)无/轻量低-中开源快速搭建简单 LLM 流水线LangGraph图 (Graph)有状态高开源复杂 Agent 工作流、有状态多步交互LangSmith追踪/数据集外部存储不限商业(免费额度)调试、评估、监控、反馈DeepAgent高层 Agent 模式有状态高实验性开源规划-执行-反思型复杂 Agent。
2026-08-25 08:33:25
337
原创 为什么说 Agent = Model + Harness?
组件作用Model理解、推理、生成文本Harness工具调用、记忆、循环控制、环境交互Agent两者结合,能自主完成任务的系统智能体不是模型本身,而是模型被一套框架“赋能”后,才能从“会说话的程序”变成“会做事的智能体”。
2026-08-19 08:13:45
226
原创 为什么说 Agent = Model + Harness?
组件作用Model理解、推理、生成文本Harness工具调用、记忆、循环控制、环境交互Agent两者结合,能自主完成任务的系统智能体不是模型本身,而是模型被一套框架“赋能”后,才能从“会说话的程序”变成“会做事的智能体”。
2026-08-13 11:40:03
365
原创 玩转LlamaIndex:分支循环
阅读时长:约 12 分钟 难度:⭐⭐⭐上一篇我们写的 Workflow 是个"":A → B → C,一条道走到黑,这一篇就把 Workflow 从""变成"",
2026-08-12 09:54:37
198
原创 玩转LlamaIndex:Agent 编排
每个事件就是一个数据结构,在步骤之间传数据用。— 必填字符串字段可以加 List、Dict、甚至嵌套其他 BaseModel为啥不直接用dict****?因为 Workflow 是类型驱动的,后面会看到,框架根据事件的"类型"来决定哪个 step 被触发。dict没法做类型分发。
2026-08-11 08:30:46
156
原创 玩转LlamaIndex:结构化输出
如果你想用正则匹配、关键词提取、第三方库等方式自己解析,可以用这个。99% 的场景用方式一就够了如果你有特殊需求(比如 LLM 输出的是 JSON 之外的格式),可以用自定义函数。"""自定义解析函数。输入是 LLM 收到的所有消息,输出必须是 dict。"""# 提取最后一条 assistant 消息# 这里可以写你的自定义解析逻辑# 例如:正则提取数字、调用第三方 NER 服务等import rereturn {"steps": ["用自定义解析得到"],
2026-08-06 09:12:47
197
原创 玩转LlamaIndex:多 Agent 协作
是 Agent 的"自我介绍",LLM 靠它来决定"这个用户问题该转给谁"。有时候多个 Agent 需要共享数据(比如"用户 ID"在所有 Agent 里都要能拿到)。所有用户输入首先进入 root_agent,它根据情况决定是自己处理还是转交给其他 Agent。完全自己写 Planner 函数,决定"下一步调哪个 Agent、用什么 prompt"。:每个 Agent 专精一个领域,用一个"总控"来分配任务。:A 交给 B,B 又交回 A,直到 token 耗尽。(A 交给 B,B 又交回 A)。
2026-08-05 09:41:12
174
原创 玩转LlamaIndex:HITL让 Agent 在关键操作前“问一下人“
HITL =。在 Agent 自动化执行任务中,插入人类决策点,让 AI 在做关键操作前先询问。如果让 Agent 完全自动跑,一旦出错代价太大。
2026-07-30 09:04:33
347
原创 玩转LlamaIndex:Context 记忆机制
Context 累积的消息越多,每次调 LLM 的 token 消耗就越大。多轮对话后,token 可能爆掉。解决思路:当历史超过阈值时,自动用 LLM 把老消息压缩成摘要。# 自定义一个带摘要的 memorytoken_limit=4000, # 超过 4000 token 自动摘要# 手动管理历史# 把历史消息塞到 memory 里memory.put(ChatMessage(role=MessageRole.USER, content="今天天气真好"))
2026-07-29 08:22:52
222
原创 玩转LlamaIndex:FunctionAgent 快速上手
"""将两个数相乘,返回它们的乘积。"""这一段是整个 Agent 设计的核心。FunctionAgent 会把这个函数自动转成 OpenAI 兼容的tool"description": "将两个数相乘,返回它们的乘积。",},所以三件事必须做好类型注解要具体:用float不用int,用list[str]不用list。越精确,模型调用越准。docstring 要详细:它就是工具的"产品说明书",模型读它来决定什么时候用这个工具。一句话的 docstring 在 demo 里能跑,生产环境会翻车。
2026-07-27 09:16:38
164
原创 LlamaIndex 安装与配置指南
干掉那些死板的套路,咱直接用大白话把 LlamaIndex 的环境搭起来。我用 conda 虚拟环境,用 DeepSeek模型;老规矩,先看下结果。
2026-07-22 14:07:44
198
原创 初学者 LangChain vs. LlamaIndex:不是非黑即白
我的背景(大数据基础、LLM应用初学者),建议。:优势在于“”,而 LlamaIndex 的核心正是。它更专一,能快速产出成果,避免过早陷入复杂的agent中。
2026-07-20 09:20:49
170
原创 Flink 资源部署方式,你还在用Yarn吗?
新项目,无历史包袱:直接,用 Operator 或 Flink Native K8s 模式。已有 Hadoop 生态,且运维团队偏大数据方向:继续完全没问题,它是经过海量验证的稳定方案。极简单业务或测试:Flink Standalone 依然可用。简单说,现在云原生推动下,Flink on K8s 已经从小范围大厂专属,变成了中小公司的常规选择。目前面临选型的话,可以优先考虑 K8s 方案。
2026-07-16 09:02:12
391
原创 我们为什么放弃自建数据治理平台,全面上华为云 DataArts
架构师的价值是设计业务能力,不是堆砌开源组件。DataArts 帮你把“挑砖、和泥”的活干了,你只需要画好蓝图。
2026-07-14 08:36:05
207
原创 华为云DWS磁盘使用率超90%后集群只读
核心问题:临时表生命周期失控,凌晨ETL集中写入打爆磁盘。三板斧排错:显示事务+ 删临时表,腾出空间。踩坑:临时表要DROP不用TRUNCATE;命名带tmp不等于临时表;KILL 任务时清理语句不执行。调优:作业末尾强制清理 + 优先用TEMP TABLE+ 每日兜底作业 + 设置。参考DWS磁盘空间满处理方案。
2026-07-08 14:18:48
239
原创 frp 远程访问安全加固三问:Token 生成、密钥登录与权限解惑
云服务器安全组只开放了必要的端口,并限制了来源 IP。frp 通信受强 token 保护,防陌生人蹭隧道。Mac SSH 仅允许密钥登录,禁止密码,杜绝暴力破解。禁止 root 直接登录,普通用户仍可使用sudo管理。三招下来,你的远程开发环境既方便又抗揍,可以安心连自己的 Mac了。
2026-07-01 15:28:53
179
原创 Docker 一键部署 MySQL 8.0
一个 Dockerfile,一个初始化脚本,5分钟拿到一个随时可用的 MySQL,后面接 Hive 时直接连。
2026-06-25 15:46:13
396
原创 Dockerfile 一键构建 Hadoop 镜像
读完这篇,你会用 Dockerfile + 外部配置文件的方式,从零构建一个 Hadoop 3.3.6 镜像。所有 XML 和启动脚本都放在宿主机目录里,修改方便,排错清晰。
2026-06-17 09:47:12
458
原创 配置 Cloudflare Tunnel:把 Mac 上的 Web 服务变成安全域名
现在虽然域名能访问了,但其实只要知道域名的人都能打开你的 ollamawebui 界面,这非常危险。Cloudflare Access 可以在打开页面之前,强制要求输入邮箱,并发送一次性验证码,只有你指定的邮箱才能进入。左侧菜单点击Access→,然后点。选择。应用名称随便填,例如 “ollamawebui”,应用域名填ollamawebui.你的域名.xyz,点击 Next。在策略页面,Policy name 填 “Allow my email”,然后在Include选择器里选择。
2026-06-15 09:27:06
415
原创 Hermes|飞书 + 腾讯云搭建带记忆的 AI 智能助手
过去我们评价AI,看它现在能做什么;Hermes让我们开始问:它跟你多久了,学到了什么。Hermes Agent的意义,不在于它比别的框架多几个功能,而在于它重新定义了Agent的生命周期——Agent不只是工具,而是可以积累经验、记住偏好的数字伙伴。用一个月的成本,换一个越来越懂你的AI。这笔账,怎么算都划算。相关链接🌐 官网:https://hermesagent.org.cn📖 官方文档:https://hermesagent.nousresearch.com/docs。
2026-06-04 16:03:45
311
原创 NOT IN 的 NULL 陷阱:一次 UNION 数据“神秘消失“
NOT IN遇到 NULL,不是漏几条,是全部消失。而且不会报错,悄无声息。你以为是逻辑问题,其实是 NULL 在搞鬼。以后写 SQL,遇到NOT IN多长个心眼,或者直接换成NOT EXISTS,一劳永逸。你遇到过类似的 NULL 陷阱吗?评论区聊聊,一起排雷。
2026-06-02 16:17:28
308
原创 llama_index.vector_stores 模块没有怎么办?
这个错误表明您安装的版本较旧,或者缺少必要的集成包。是在较新版本中引入的模块结构。
2026-05-28 10:02:30
123
原创 卸载 conda(太大) 安装 miniconda
变量名路径(根据你的安装位置调整)Path 新增C:\miniconda3Path 新增C:\miniconda3\ScriptsPath 新增C:\miniconda3\Library\bin。官网:https://docs.conda.io/en/latest/miniconda.html。
2026-05-28 09:58:33
373
原创 Ollama 本地安装 C盘太小怎么办
Ollama程序本体必须装C盘(约100MB),但模型文件(几个GB到几十GB)可以通过环境变量轻松迁移到D盘/E盘,无需重装,立即生效。现在就去设置环境变量,把模型搬到空间充足的盘吧!
2026-05-27 11:30:39
404
原创 三个方法,看清Mac的GPU有没有在干活?
这是Mac自带的工具,就像公司里的监控摄像头,能直观看到所有“员工”的工作状态。只有当你直接在Mac上原生运行Ollama,或者使用Docker官方的Model Runner时,才能看到GPU被真正调用。因为Docker容器里的模型,压根摸不到你M1的真GPU,只是在用CPU硬算。如果你的Ollama是跑在Docker里,用上面任何方法看GPU利用率都。:打开“活动监视器”,顶部菜单点击“窗口” ->:如果只是大概看看,在“活动监视器”里切换到。标签页,也能看到GPU的整体利用率。
2026-05-26 15:03:18
436
原创 扣子(coze)高级实战-从“一张图”到“多镜头影视解说”
✅ 至此,循环体内一次执行就完成了一个分镜的“配音+出图+合成小视频”。循环执行完毕后,每个分镜都会输出一段小视频。如果循环内TTS或图像生成失败,检查插件是否正常工作;可先在循环外单独测试单个分镜的TTS+出图。:输出的是一个纯JSON。因为每个分镜的旁白就是独立文本,不再需要整段文案。是否保留了音频轨(默认会保留),必要时检查每个小视频是否包含音频。初版建议用简化音频方案先跑通,确认多画面切换效果后再做精确同步。把原来生成整篇文案的提示词,替换为以下内容。关注我,免费领取1月“plus”会员。
2026-05-26 14:53:50
1490
1
Claude+python打造的pdf工具
2026-05-30
【大数据学习路线】基于Hadoop与Flink的核心技术栈:大数据工程师学习路径规划与实战项目设计
2026-05-09
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅