- 博客(259)
- 资源 (5)
- 问答 (1)
- 收藏
- 关注
原创 AIGC入门,新手模型微调认知篇(四):训练过程与原理详解
模型训练与生成原理详解 本文深入解析了语言模型微调与生成的核心机制: 微调训练流程: 数据预处理:格式化对话样本并tokenize 前向传播:模型预测每个位置的token概率分布 损失计算:通过交叉熵评估预测与标准答案的差距 反向传播:计算参数梯度 参数更新:使用AdamW优化器调整权重 答案对比机制: 对比token概率分布而非文本内容 使用teacher forcing避免误差累积 计算每个位置正确token的负对数概率作为损失 自回归生成原理: 迭代式预测:每次生成一个token并加入后续输入 基于概
2026-06-22 17:34:29
368
原创 AIGC入门,#新手模型微调认知篇(六):模型评测原理与实践
量化微调效果,避免"感觉"判断精确匹配(数学)、BLEU(翻译)、ROUGE(摘要)、Perplexity(整体)MMLU(知识)、GSM8K(数学)、HumanEval(代码)、MT-Bench(对话)忘记关闭采样、测试集泄漏、只看平均分约束输出格式、多种兜底策略、LLM Judge看相对提升、能力分布、退化情况、统计显著性评测不是终点,而是迭代的起点——分析错误、针对性改进、持续评测,才能让模型越来越好。
2026-06-22 17:31:57
491
原创 【AICoding】AI时代,快速低成本搭建一个属于自己的站点
使用 Cloudflare Tunnel 实现内网穿透并绑定自有域名 本指南详细介绍如何通过 Cloudflare Tunnel 安全访问内网树莓派服务,无需公网 IP 或路由器端口转发。主要内容包括: 前置知识:解释内网穿透原理和 Cloudflare Tunnel 的工作方式 域名注册:在阿里云完成域名购买和实名认证流程(1-3个工作日) Cloudflare 配置:添加站点并获取 Nameserver 地址 DNS 修改:将阿里云域名解析指向 Cloudflare 隧道创建:在 Cloudflare
2026-06-18 09:56:20
452
原创 【AICoding】用 AI 全自主开发一款 macOS 截图工具的全流程实践
macOS 自带的截图功能(Cmd+Shift+4)虽然够用,但和 Windows 上的 Snipaste、macOS 上的 iShot 相比,缺少标注、贴图、OCR 等高频需求。作为一个开发者,截图标注几乎是每天都要重复几十次的操作。问题是:**开发一款 macOS 桌面应用,门槛有多高?**传统的回答是:你需要熟悉 Swift/SwiftUI、AppKit 框架、Core Graphics 绘图、Vision OCR、窗口管理、权限体系、签名分发……每一项都需要相当的学习成本。
2026-06-18 09:54:03
611
原创 需求澄清 Skill 详细方案设计
本文提出了一种结构化需求澄清方案,通过5个维度系统性地提问,将PRD中的隐含假设显式化。该方案包含整体流程架构(读取PRD→确认理解→5轮维度澄清→编译文档→用户确认)和数据流架构,重点设计了五大澄清维度:范围边界、交互流程、异常与边界、数据规则和非功能需求。每个维度提供具体问题模板和检查清单,确保生成AI可直接消费的精确规格文档,解决现有PRD隐含假设导致代码生成不准确的问题。
2026-06-11 21:23:22
400
原创 为什么用 Skill 做需求澄清
本文分析了为什么需求澄清适合用Skill而非Tool或SubAgent实现。关键点在于:需求澄清需要结构化流程引导用户补充PRD的隐含假设,具有多轮交互、强用户决策和模板化输出的特点。Tool适合确定性操作但缺乏流程编排能力;SubAgent过于自治可能导致脑补答案或提问混乱;而Skill的模板驱动、交互式执行和主流程无缝衔接特性完美匹配需求澄清的三个核心需求:维度覆盖、用户决策和可消费输出。这种机制选择确保了需求澄清过程的完整性和结果质量。
2026-06-11 21:20:11
828
原创 JDWP 注入攻击详解
JDWP 注入的本质是利用 Java 调试协议的设计特性——无认证 + 任意方法调用——来实现远程代码执行。攻击的核心难点在于获取一个「事件挂起」状态的线程,这需要理解 JDWP 的事件机制和线程挂起模型。JDWP 无认证,连接即可完全控制 JVMInvokeMethod 需要事件挂起的线程,不能用 VM.SuspendSINGLE_STEP 事件是获取事件挂起线程的首选方式,失败时自动降级到断点方案线程选择很关键。
2026-06-02 21:13:36
709
原创 Netcat (nc) 操作指南
传统远程登录是客户端连接服务端(正向),反弹 Shell 是服务端(目标机)主动连接客户端(攻击机),方向相反,因此称为「反弹」(Reverse Shell)。这样做的好处是可以绑定防火墙入站规则——大多数防火墙允许出站连接但限制入站连接。
2026-06-02 21:03:31
636
原创 macOS 上 Charles 代理 HTTPS 抓包失败问题完整解决方案
本文详细介绍了在 macOS 上使用 Charles 代理抓取 HTTPS 数据包失败的完整解决方案。主要内容包括:问题现象分析(SSL 证书信任问题)、基础环境配置(代理端口设置和终端变量)、临时解决方案(通过 --cacert 参数指定证书)以及永久解决方案(将 Charles 根证书导入系统钥匙串并设置为始终信任)。文章还提供了常见问题排查指南和方案对比,推荐开发者采用永久方案以获得长期稳定的抓包体验。通过系统级信任设置,可以确保所有命令行工具和应用程序都能正常通过 Charles 代理解密 HTTP
2026-05-22 13:50:35
895
原创 Agent 自主学习记忆:让 AI 从经验中成长的闭环系统
摘要: Agent 自主学习记忆系统通过模拟人类程序性记忆,实现 AI 从经验中持续成长。传统无状态 Agent 面临效率低下和能力无法沉淀的问题,而三层记忆架构(短期记忆、长期记忆、记忆提炼)构建了"执行→提炼→复用"的闭环。核心在于: 技能提炼:通过 LLM 分析成功执行轨迹,将多步骤操作抽象为可复用技能 异步处理:不影响主流程下完成经验沉淀 条件筛选:仅对复杂成功任务进行提炼 分层存储:短期会话记忆(内存)与长期技能库(磁盘)分离 系统显著提升 Agent 任务处理效率,使其从&q
2026-04-29 18:23:55
624
原创 给 AI Agent 装上“大脑“:Java语言中Code Interpreter 的设计与实现
本文探讨了如何为Java Agent设计类似ChatGPT Code Interpreter的动态代码执行能力,以解决传统硬编码工具方法的局限性。主要内容包括: 问题背景:传统Tool Calling模式需要为每个功能预定义工具,导致维护成本高且限制AI能力边界。 技术选型:选择Groovy作为动态执行引擎,因其语法兼容Java、可直接调用Java标准库且支持即时执行。 架构设计:采用两层结构,工具协议层处理LLM交互,安全执行层负责代码运行。 安全机制:通过编译期AST检查、运行时间控制和输出限制三道防线
2026-04-29 18:22:06
658
原创 打造 Arthas 热替换自动化脚本:从本地 class 到生产环境一键替换
将 Arthas 热替换的复杂流程封装成一条可复制的命令,显著提升了线上紧急修复的效率与安全性。它解决了类加载器隔离、文件传输、手动操作易错等痛点,让你能专注于代码逻辑本身,而不是工具的使用细节。立即体验:将脚本保存到本地,尝试对一个简单的 class 文件运行,感受一键热替换的便捷吧!脚本已完整提供在本文中,你可以直接复制并保存为,也可根据实际需求调整其中的默认路径和自动匹配关键词。如果你有任何改进建议或遇到问题,欢迎在评论区留言交流。附:完整的脚本内容/bin/bash。
2026-04-21 20:32:37
492
原创 投资笔记-市盈率、市净率、股息率
本文总结了股票投资的三个核心估值指标:市盈率(PE)、市净率(PB)和股息率。PE反映回本年限,低PE适合价值投资,高PE体现成长预期;PB衡量股价与净资产关系,适合重资产行业;股息率评估现金回报,需警惕异常高值。作者强调要综合运用三个指标,并指出数字背后的真实情况更重要,通过医药股的误判案例说明不能仅看表面数据。全文系统解析了估值指标的实际应用与注意事项。
2026-03-29 20:44:15
645
原创 Python 并发编程详解 - Java 开发者视角
本文从Java开发者视角对比讲解了Python并发编程模型。主要内容包括: 核心概念对比:Java使用内核线程,Python受GIL限制采用协程模型 Python并发演进: 多线程(适合IO密集型,受GIL限制) 多进程(突破GIL限制,适合CPU密集型) asyncio协程(Python 3.5+核心模型,最佳IO密集型方案) 实战代码示例展示三种方式的实现,并与Java对应方案对比 关键区别:Java线程可真正并行,Python线程受GIL限制,推荐IO密集型使用asyncio 文章通过具体代码对比,帮
2026-03-26 21:13:52
589
原创 大模型的“推理能力” vs. AgentScope 框架的“推理循环”:你分清楚了吗?
摘要:大模型的“推理能力”指其单次生成中完成逻辑推导的能力,源于预训练和微调;而AgentScope框架的“推理循环”是工程架构,通过多轮交互和工具调用逐步解决问题。前者是模型内在认知能力,后者是外部协调机制。两者协同工作:模型提供单步推理,框架组织多步流程。区别在于模型推理是基础能力,框架循环是应用扩展,共同实现复杂任务处理。(149字)
2026-03-26 21:12:18
660
原创 OpenClaw本地模型慢如牛?一招配置文件优化让Qwen2.5飞起来!
摘要: Mac用户在使用Ollama运行本地模型(如qwen2.5:7b)时普遍遇到响应速度下降问题,主要原因是上下文历史过长导致计算负担加重。本文提出纯配置文件优化方案,通过修改~/.openclaw/openclaw.json中的关键参数(如开启自动压缩、限制记忆长度、截断工具输出等),可显著减少请求上下文体积,提升响应速度80%以上。该方案无需安装额外组件,仅需调整配置即可让本地模型"轻装上阵",恢复应有性能。
2026-03-15 20:17:03
4630
原创 开发机上通过Ollama安装了qwen2.5:7b-instruct大模型后curl请求示例
本文介绍了在Mac开发机上通过Ollama运行qwen2.5:7b-instruct模型并调用其API的方法。主要提供两种调用方式:推荐使用兼容OpenAI格式的/v1/chat/completions端点,以及备选的Ollama原生/api/generate端点。文章包含完整的curl命令示例、参数说明、服务验证方法和实用技巧(如结合jq格式化输出),并附有执行抓包日志截图。调用前需确保Ollama服务运行且模型可用,成功调用后会返回包含模型回答的JSON响应。
2026-03-15 19:11:17
1579
原创 OpenClaw 从本地到云端:阿里云百炼免费模型配置实战指南
如果你已经在 Mac 开发机上成功配置了 OpenClaw 和本地 Ollama 模型(如 qwen2.5:7b),那么恭喜你已经完成了“养虾”的第一步。本地模型虽然免费、隐私、无限制,但受限于硬件性能(尤其是 Mac 上 7B 模型通常只能跑 4bit 量化版),在处理复杂任务、工具调用准确性上,与云端大模型确实存在差距。这时候,阿里云百炼平台的云端模型就成为了完美的补充——推理速度更快,新用户还享有 90 天免费额度,让你零成本体验更强大的 AI 能力。本文将基于你已有的本地模型配置经验,详细介绍如
2026-03-15 10:34:42
2144
原创 为什么令牌桶能应对突发流量?——原理 + Java代码 + 实际案例
摘要: 令牌桶算法通过积攒令牌机制,允许瞬时流量超过长期平均速率,有效应对突发流量。其核心原理是:令牌以固定速率生成并存入容量有限的桶中,突发请求可快速消耗积攒的令牌,实现瞬时高并发。与漏桶算法不同,令牌桶能利用空闲期“储蓄”处理突发,而漏桶强制恒定输出速率。 Java代码演示显示,当桶容量为20、生成速率为10令牌/秒时,20个突发请求可在0.12毫秒内全部通过(瞬时速率16.6万请求/秒),之后恢复限流。实际案例中,API网关、电商秒杀等场景通过合理设置桶容量,既保护后端又提升用户体验。令牌桶的突发能力
2026-03-13 14:28:03
449
原创 OpenClaw与ClawHub的关系:当“智能体”遇上“技能商店”
如果你是OpenClaw的用戶,一定在文档或社区中频繁看到两个名字:OpenClaw 和 ClawHub。它们听起来像是一对孪生兄弟,但实际扮演的角色截然不同——简单来说,OpenClaw是“虾”(智能体本身),而ClawHub是“水产市场”(技能交易中心)。本文将深入解析两者的定位与协作关系,帮你彻底理清这对核心概念。OpenClaw(曾用名Clawdbot、Moltbot)是一个开源AI Agent框架,由PSPDFKit创始人Peter Steinberger于2025年11月发布,采用MIT开源协议
2026-03-11 23:02:19
1098
原创 openclaw 配置本地安装的大模型qwen2.5:7b,0成本竟是如此简单
本文详细介绍了在OpenClaw中配置本地qwen2.5:7b模型的完整流程。主要内容包括:通过Ollama搭建兼容OpenAI API的本地服务器,下载4.7GB的Qwen2.5模型;安装配置OpenClaw并修改相关参数;以及最后的验证测试步骤。重点解决了模型窗口大小报错等常见问题,提供了可直接使用的配置示例。该方案支持Windows/macOS/Linux系统,推荐16GB以上内存,包含手动修改配置文件和错误处理等实用技巧,帮助用户成功实现本地模型调用。
2026-03-11 17:40:27
6465
2
原创 AgentScope 框架源码深度解读:ReAct = Reasoning + Acting 的实现原理
本文深入解析了AgentScope框架中ReAct(推理+行动)模式的实现原理。通过分析源码继承体系(AgentBase→ReActAgentBase→ReActAgent)和核心方法reply(),揭示了ReAct循环的自动化机制。reply()方法作为总控开关,通过循环执行推理(_reasoning)和行动(_acting)过程,最多迭代max_iters次。推理阶段生成工具调用指令,行动阶段执行工具并获取结果,循环持续直到LLM决定直接回答或达到结构化输出要求。元类_ReActAgentMeta自动为
2026-03-08 21:10:18
766
1
原创 Agent 隐式工具调用原理详解
本文深入解析了AI Agent隐式工具调用的工作原理,重点介绍了ReAct模式(推理+行动)的实现机制。通过一个读取PDF文件的实例,展示了Agent如何自动完成:1)理解用户意图;2)选择并调用read_pdf工具;3)总结核心内容的三步流程。文章详细剖析了关键技术组件,包括工具注册机制、系统提示词设计、模型调用格式器以及ReActAgent的执行循环逻辑。该架构使AI助手能够智能地识别任务需求并自动调用合适工具完成任务,适用于需要理解Agent底层原理的开发者阅读。
2026-03-07 23:19:36
561
原创 手撕 Agent 教程 - 打造一个轻量级个人智能助手
Alioo Agent是一款轻量级个人智能助手,专注于PDF阅读和新闻摘要两大核心功能。该工具支持多种AI模型(DashScope、Ollama、OpenAI等),提供命令行、Web界面和API三种交互方式。v0.2.0版本改进了代码结构、错误处理和用户体验,具有完整的类型注解和详细文档。安装简单,通过几个命令即可开始使用,还能轻松扩展新功能。相比复杂的企业级助手,Alioo Agent采用极简设计,代码量约1500行,特别适合学习、原型开发和轻量使用场景。
2026-03-07 23:12:13
1134
2
原创 一步步教你用 venv 管理python环境
在 macOS 上使用 venv 创建和管理 Python 虚拟环境的简明指南: 创建环境:在项目目录运行 python3 -m venv venv 激活环境:执行 source venv/bin/activate(终端提示符前会显示 (venv)) 管理依赖:在激活环境中使用 pip 安装包,通过 pip freeze > requirements.txt 保存依赖 退出环境:运行 deactivate 删除环境:直接删除 venv 文件夹 常见问题:若环境缺少 pip,可尝试 python -m
2026-03-02 10:54:20
887
原创 重新认识JVM的内存分布(JDK11 + G1垃圾收集器)
JVM内存主要分为堆内存、非堆内存、堆外内存和JVM自身开销四部分。堆内存由G1收集器管理,采用Region机制划分年轻代和老年代;非堆内存包含元空间和代码缓存;堆外内存涉及直接缓冲区和JNI调用;JVM Overhead则包括线程栈、GC元数据等运行开销。通过-Xms/-Xmx等参数可配置内存大小,需注意线程栈归属JVM Overhead而非非堆内存。典型500线程应用的内存估算显示总内存约7.75GB,建议通过调整线程栈大小、限制直接缓冲区等方式优化。监控工具如jstat、jcmd等可辅助调优。
2026-01-29 20:07:01
1102
原创 AIGC入门,在Mac上基于Ollama和phi3:mini的完整Agent/Subagent例子
摘要: 本文演示了如何在Mac上基于Ollama和phi3:mini构建一个多智能体协作系统。通过创建一个主Agent和两个专业Subagent(任务分解专家和执行专家),实现了复杂任务的自动分解与执行。文章提供了完整的代码实现,包括: 项目目录结构 核心Agent基类定义 两个具体Subagent实现(任务分解JSON格式输出、任务执行状态报告) 与Ollama API的交互方法 错误处理机制(JSON解析容错) 系统通过分工协作,将复杂任务分解为可执行步骤并逐一处理,展示了多智能体协作的基本工作流程。
2026-01-09 15:02:25
852
原创 AIGC入门,为什么你的大模型应用这么慢又贵?RAG架构的降本增效革命
本文分析了直接向大模型投喂完整文档的"反模式"及其性能瓶颈,提出了RAG(检索增强生成)架构的优化方案。通过对比实验显示,RAG架构可将大模型应用的API成本降低99.76%(从单次$3.75降至$0.009),响应时间缩短70-90%(30秒→3秒),并发能力提升10-100倍。RAG的核心优势在于预处理文档切片并建立向量索引,使每次查询仅需检索相关片段而非完整文档,大幅减少token消耗。文章还提供了两种方案的代码实现对比,证明RAG在成本、性能和扩展性上的显著优势,是企业级大模型应
2026-01-09 14:17:34
1089
原创 机器学习入门,微积分之导数概念
本文系统介绍了导数的核心概念、计算方法和应用意义。导数定义为函数在某点的瞬时变化率,通过极限表达式表示。实际计算中主要运用基本初等函数导数公式和运算法则(如四则运算、复合函数求导法则)。文章提供了多个计算示例,并阐述了导数在物理、经济等领域的重要应用价值,如速度、边际效应等。掌握导数的关键在于熟记基本公式、准确识别函数结构并正确应用相应法则。通过系统学习这些基础内容,可以解决大多数初等函数的求导问题。
2025-12-03 20:27:07
362
原创 机器学习入门,无监督学习之DBSCAN聚类算法完全指南:面向Java开发者的Python实现详解
本文介绍了DBSCAN聚类算法的核心概念、实现原理及Python实现。DBSCAN是一种基于密度的聚类算法,相比K-Means具有无需预设簇数、能识别任意形状簇和噪声点等优势。文章通过Java类比解释了核心概念(如核心点、边界点等),详细讲解了算法步骤,并提供了完整的Python实现代码,包括自定义DBSCAN类和可视化示例。该实现采用广度优先搜索策略扩展簇,适合Java开发者理解Python实现方式。
2025-10-15 20:52:12
758
原创 机器学习入门,无监督学习之K-Means聚类算法完全指南:面向Java开发者的Python实现详解
本文为Java开发者提供了K-Means聚类算法的Python实现指南。文章首先通过对照表将Java概念映射到Python语法,帮助开发者快速上手。然后详细讲解了K-Means算法的核心思想,将其类比为"将彩色球分到K个篮子"的过程。完整代码实现包括数据生成、算法核心和可视化模块,特别对Python的向量化操作与Java循环进行了对比说明。文章还介绍了如何使用sklearn库的KMeans实现以及如何评估聚类效果,最后提供了算法优缺点的分析。通过这种针对Java开发者的视角,帮助读者理解
2025-10-15 20:40:48
1055
原创 AIGC入门,手搓大模型客户端与MCP交互第2集
本文针对大语言模型(LLM)与MCP服务交互过程中出现的JSON格式不规范问题,提出了一套鲁棒的参数提取方案。原系统假设模型总是返回完美JSON,但实际响应常包含多余文本、注释或格式错误,导致解析失败。改进方案通过两个核心函数:extract_json_from_response()使用正则表达式清除注释并采用多层解析策略,validate_tool_call()验证JSON结构完整性。该方案显著提升了工具调用的成功率,代码演示了如何从杂乱响应中提取有效JSON并进行验证。
2025-10-09 17:57:36
516
原创 Git高级操作:提升开发效率的实用别名设置
本文分享了一系列优化Git工作流的实用配置和别名设置。通过禁用分页器、强制彩色输出、设置严格时间格式等基础配置,提升操作体验。同时提供了st(status)、co(checkout)等常用命令的简化别名,以及loggg、logg等高级日志格式化工具,使输出更清晰易读。这些设置能显著减少日常命令输入量,建议根据个人习惯调整后加入全局配置。文末附完整脚本可直接复制到~/.bashrc使用。
2025-10-09 17:13:45
512
原创 用AI帮忙,开发刷题小程序:软考真经微信小程序API接口文档(更新版)
本文档详细介绍了软考真经微信小程序的API接口规范,主要包含三个环境配置和三类核心接口:认证接口(微信登录、用户信息)、考试接口(开始/结束考试、题目/错题列表、提交答案)和统计接口。所有请求需携带认证token,遵循标准HTTP状态码规范。小程序为软考考生提供在线考试、错题练习和学习数据统计功能,通过REST API实现前后端交互。文档还提供了典型接口调用示例,如考试流程管理和答题提交等核心场景的实现方式。
2025-10-08 18:00:10
952
原创 用AI帮忙,开发刷题小程序:微信小程序中实现Markdown图片解析与渲染功能详解
本文介绍了在微信小程序中实现Markdown图片解析与渲染功能的技术方案。通过创建工具函数解析包含Markdown图片的文本内容,将其转换为混合数组,并在WXML模板中循环渲染,实现了图文混排效果。该方法保持了内容的原始顺序和语义连贯性,适用于在线考试系统等需要展示图文内容的场景。文章详细说明了核心实现步骤,包括工具函数编写、组件逻辑修改、模板调整和样式优化,并提供了项目源码地址供参考。
2025-10-08 17:39:53
1040
原创 用AI帮忙,开发刷题小程序:从零开始,构建微信小程序答题系统
《微信小程序答题系统开发实践》摘要:本文详细介绍了从零开发微信小程序答题系统的全过程。项目采用标准的微信小程序架构,通过组件化设计和TypeScript类型定义确保代码质量。核心功能包括题目数据模型设计、答题流程控制、记录管理机制等,并实现了流畅的滑动切换和实时反馈交互。系统采用API封装和异步加载优化网络请求,最后通过代码优化和全面测试完成部署。项目展现了小程序开发的全流程实践,源码已开源并提供体验二维码。
2025-10-06 19:01:16
2863
3
原创 用AI帮忙,开发刷题小程序:微信小程序在线答题系统架构解析
本项目开发了一个基于微信小程序的在线答题系统,采用原生小程序框架实现组件化开发。系统包含首页导航、答题、学习和记录四大功能模块,通过标准化的exam-question组件统一题目展示,并利用工具类封装核心逻辑。技术亮点包括流畅的交互体验、清晰的数据流设计和组件复用机制。目前系统已实现基本答题功能,支持题目展示、作答验证和结果统计,后续可扩展更多题型和数据分析功能。项目代码已开源,便于开发者参考和学习微信小程序开发实践。
2025-10-06 16:46:32
1838
原创 用AI帮忙,开发刷题小程序,在线答题系统数据库设计文档
本文档描述了在线答题系统的核心数据库设计,包含7个主要数据表: 题目表(question)存储题目基本信息 选项表(question_option)记录题目选项 试卷表(exam_paper)管理试卷信息 试卷题目关联表(exam_paper_question)建立试卷与题目关系 试卷分类表(exam_paper_category)组织试卷分类结构 用户考试记录表(user_exam_record)记录考试整体情况 用户答题详情表(user_answer_detail)记录每题答题详情 每个表包含详细的字段
2025-10-06 11:05:54
1069
原创 AIGC入门,手搓大模型客户端与MCP交互
本文介绍了一个基于MCP协议和Ollama本地大模型的智能时间查询系统。该系统由两部分组成:时间服务器(time_server.py)提供获取当前时间和列出时区的工具函数;客户端(time_client_test3.py)利用Ollama模型分析用户查询并智能调用时间服务。时间服务器实现了完整的时区处理和错误提示功能,通过MCP协议暴露工具接口。客户端采用异步连接管理和多重策略解析模型响应,能够智能判断是否需要调用时间服务工具。这种架构展示了如何将大语言模型与专用工具服务相结合,构建既能理解自然语言又能精准
2025-09-16 21:36:01
960
原创 AIGC入门,从理解通信协议sse与streamhttp开始
随着AIGC(生成式人工智能)的普及,大模型如GPT、通义千问等已广泛应用于对话、代码生成、数据分析等场景。这些模型在运行时需要与客户端进行高效通信,SSE(Server-Sent Events) 和 Stream HTTP(流式HTTP) 是两种核心通信协议。本文将结合理论和Java代码示例,帮助你理解这两种协议的原理、区别及在AIGC中的实际应用。
2025-09-16 21:21:30
1257
Servlet 中文乱码问题
2014-10-20
CMPP2.0 CMPP3.0 接口协议
2014-10-20
java中获取HashMap中的table?
2017-05-18
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅