- 博客(42)
- 收藏
- 关注
原创 不用显卡也能跑大模型?GGUF 量化与 llama.cpp 本地推理实战
大模型的核心是一堆权重(浮点数)。原始权重常用 FP16 存储,每个数占 16 bit(2 字节)。一个 7B 模型仅权重就有约 140 亿个 FP16 数,体积约 14GB——这还没算运行时开销,普通笔记本根本扛不住。量化(Quantization)的本质是:把高精度浮点权重"压缩"成更少的位数来存。比如 4-bit 量化,每个数只存 4 bit(0.5 字节),体积直接砍到约 1/4。那为什么 4-bit 听起来精度损失这么大,效果却还能用?关键在于。
2026-08-24 09:04:39
243
原创 AI Coding 烧钱如流水?一文讲透 Token 经济学:路由、缓存与上下文压缩如何把成本砍半
compress.py —— 对话上下文摘要式压缩(纯标准库,示意)@dataclassrole: strtext: str"""保留最近 keep_recent 轮原文,更早的轮次折叠为一句摘要。"""# 真实环境:此处调用小模型生成摘要;这里用确定性 heuristic 兜底summary_text = f"[历史摘要] 已折叠len。
2026-08-23 07:37:20
342
原创 从0到1手写 AI Agent Harness:为什么护城河不在模型,而在工程外壳
Agent Harness(工程外壳)是介于"裸 LLM"和"可用 Agent"之间的一层工程代码。循环驱动模型、调度工具、管理上下文、控制权限、记录过程。你可以把它理解为模型的"驾驶舱"——模型负责思考,Harness 负责让它安全地"踩油门、打方向、踩刹车"。维度裸 LLM 调用交互方式一问一答多轮循环 + 工具反馈上下文单次窗口可压缩、可持久、可回放能力边界只有文字能读文件、跑命令、调外部服务安全无权限门禁、沙箱、审计可调试重跑难复现事件日志可追溯、可回放。
2026-08-23 07:36:23
448
原创 一文搞懂 AI Agent 安全护栏:用 Python 手写工具网关,把越权挡在执行层
很多团队把"安全"理解为"再请一个 LLM 看着前一个 LLM"。失败模式现象根因提示注入变成策略注入攻击者让 Agent 给恶意动作加[ALLOWED]前缀,护栏 LLM 被带偏你用 LLM 检查 LLM,护栏有和 Agent 同样的漏洞,可被绕过智能监控的 ReDoS 税提交一条让护栏 LLM 算不过来的复杂 SQL,护栏超时,系统"fail-open"放行LLM 不是常量时间操作,把概率系统放在动作热路径上 = 给自己造 DoS语义漂移与审批漏洞。
2026-08-21 15:00:36
349
原创 一文搞懂 AI Agent 评测:手写三层 Eval 框架,把 Agent 质量接进 CI 门禁
评测 Agent,本质是给"会调工具、会多步推理、非确定性"的系统装一套客观护栏。按独立性分层:确定性(Tier1)→ 启发式(Tier2)→ LLM 判断(Tier3),能用底层就别上高层,省成本也降噪。Gate 与 Grade 分离:不可伪造的硬指标进门禁,主观质量分只进报表。评测即代码、评测随 Agent 演进:接进 CI,每次发布与夜间回归都有数据说话。至此,我们的 Agent 工程知识链已经串起。
2026-08-20 22:05:16
459
原创 给 AI Agent 装上「黑匣子」:用 OpenTelemetry + OpenInference 手写可观测性(附 Python 实战)
本文用约 60 行 Python,基于 OpenTelemetry + OpenInference 给 Agent 装上了一个可 replay 的「黑匣子」:从 Provider 初始化、LLM/工具 Span 埋点、OTLP 导出,到四支柱落地与生产避坑。Agent 上不了生产,多半是「看不见」,不是「模型弱」——先补可观测性再谈优化。OTel 一次埋点、多后端通用,OpenInference 让 AI 语义被标准识别,避免厂商锁定。tracing 必须接 eval 才闭环,否则只是昂贵的日志。
2026-08-20 22:03:45
299
原创 一文搞懂 AI Agent 的 Skills 机制:声明式技能加载原理与 Python 实战
本文从"工具塞满 Prompt 的三大代价"出发,讲清了声明式 Skills 的本质(Markdown + 轻量元数据)、声明式与命令式的核心差异,以及"检索—按需挂载"为什么能砍掉约 98% 的 Token 成本;最后用一份可运行的 Python 加载器串起发现、匹配、懒加载、路由四个环节,并给出元数据设计、Skill 注入防护、缓存三道生产级避坑。记忆层:让 Agent 跨会话记得住(对话/文档/代码转可复用资产);并行协作:用 Git Worktree 让多个 Agent 同时改同一仓库不打架;
2026-08-19 21:30:00
268
原创 一文搞懂 MCP 与 A2A:AI 多智能体通信的两种协议,附 Python 双协议实战
MCP 与 A2A 不是竞争关系,而是分层互补想给模型"长手脚"——接搜索、查库、执行命令,用MCP。想让多个智能体"组队干活"——发现能力、委派任务、跟踪状态,用A2A。真实系统里,A2A 的 Agent 内部往往再用 MCP 连自己的工具,形成"团队 + 手脚"的完整架构。本文的 Python 骨架可直接跑通双协议最小闭环,建议你在本地按 4.4 节串起来,再逐步补上鉴权、异步任务与链路追踪,就能平滑演进成一个像样的多智能体生产系统。
2026-08-19 17:05:35
369
原创 Git Worktree 实战:用并行多 Agent 把开发提速 N 倍
普通git clone只有一个工作目录;可以在不复制整个仓库的前提下,再挂出一个独立目录,指向某条分支。多个 worktree 共享同一份.git对象库,所以创建极快、几乎不占空间。# 在主仓库根目录执行:挂出一个新工作区,并新建分支 agent-a-task# 再挂一个,基于当前 HEAD 新建分支 agent-b-task# 查看当前所有挂载的工作区/projects/├── demo-api/ # 主工作区(你日常开发的地方)
2026-08-13 09:32:12
460
原创 AI Agent 为什么会“失忆“?一文搞懂记忆层架构与 Python 实战落地
先把契约定下来,后面怎么换后端都不影响 Agent。@dataclasskey: strvalue: str# 可选:给长期记忆用,做语义检索"""记忆存储抽象,短期与长期各自实现。"""💡 小贴士:接口里把拆开,是因为短期记忆通常只用到 save/load,长期记忆才需要 search。统一抽象但按需实现,避免短期存储被迫实现用不上的检索。Agent 的"失忆"不是模型缺陷,而是工程缺位。记忆要分层:短期求快、长期求全、工作记忆求结构化,别混在一个桶里。记忆要做成独立服务。
2026-08-12 07:59:37
399
原创 手把手用 Node + TS 实现一个 MCP Server:从协议到接入 AI 客户端全流程
MCP 的精髓之一是用 Zod schema 自动生成工具的 JSON Schema,你不必手写 JSON Schema。下面注册// 工具名(全局唯一)// 工具描述:告诉模型这个工具"能干什么",写清楚能显著提升命中率"根据订单ID查询订单当前状态、金额与最近更新时间",// 入参 schema:ZodRawShape,自动转为 JSON SchemaorderId: z.string().min(1).describe("订单唯一标识,示例:ORD-20260811-001"),
2026-08-11 20:25:36
274
原创 为什么 AI 时代反而让 Rust 更火了?——2026 年的系统级编程语言之争
这是最关键的问题。三者都能写高性能系统,差别在「工程代价」。维度C++GoRust峰值性能⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐⭐内存安全(编译期)❌❌✅并发模型手动Goroutineasync/所有权p99 延迟稳定性中等受 GC 影响优上手成本高低高大型团队协作安全低中高AI 没有让底层变简单,反而让底层更值钱。模型的能力越通用,谁能更低成本、更稳地把它跑起来,谁就掌握议价权。
2026-08-05 14:27:07
460
原创 为什么大模型推理的底座正在用 Rust 重写?
AI 没有重新发明编程语言,但它重新分配了每种语言的角色:Python 守住训练,TypeScript/Go/Rust 抢走生产代码,而 Rust 在"又要快、又要安全、又要长期在线"的推理底座上,拿到了一张越来越稳的票。对一个写系统、写后端的人来说,这或许是最好的时代——当 AI 把基础编码能力拉平之后,能把架构设计好、能把线上问题排查出来、能把性能边界踩清楚的工程能力,反而更值钱了。而 Rust,恰好是锻炼这套能力的绝佳练兵场。本文为技术观点分享,所涉性能数字为量级示意,非精确基准;
2026-08-05 14:17:56
311
原创 AI 写代码看着全对逻辑也自洽,为什么不是我们要的?Node/TS 团队的 Agent 护栏实践
rules: {"@typescript-eslint/no-explicit-any": "error", // 禁 any"@typescript-eslint/no-unused-vars": "error", // 禁无用变量"no-empty": ["error", { allowEmptyCatch: false }], // 禁空 catch和。Agent 最爱用这两招"蒙混过关",把它们设成 error,CI 直接红。
2026-07-26 21:45:00
319
原创 从0写一个 MCP 服务器:用 Node/TS 把 SQL Server 里的 ERP 数据变成 AI 助手能查的工具
/ 工具1:按关键词/分类查商品"按关键词或分类查询 ERP 商品表(tb_products)",{ keyword: z.string().optional().describe("商品名模糊匹配"),category: z.string().optional().describe("商品分类") },${import {import {import {
2026-07-26 19:22:22
262
原创 手把手写一个可复用的 Agent Skill:以“自动更新 AI 工具导航站“为例
📝 文章摘要:本文以AI工具导航站更新为例,介绍如何从零开发一个可复用的Agent Skill。核心是创建包含YAML frontmatter的SKILL.md文件,通过两阶段加载机制(先读取description判断触发条件,再加载正文执行任务),配合Node.js脚本实现自动化工具词条生成。文章详细演示了目录结构设计、技能描述编写、配套脚本开发,并总结了关键经验:description需用"用户原话"描述触发场景、脚本需避免交互式设计。
2026-07-26 17:31:08
301
原创 财经播报综合报告
7月9日至10日,全球金融市场在多重因素交织下呈现出"地缘扰动与科技共振"的鲜明特征。一方面,美伊冲突骤然升级,中东战火重燃推动油价剧烈波动、避险资产承压;另一方面,A股半导体产业链在产业催化与业绩预增的双重驱动下迎来历史性爆发,科创50指数单日暴涨8.41%创历史纪录。国内政策端密集发力——国务院印发"十五五"碳达峰行动方案、9部门联合发布零售业创新发展意见,央行货币政策维持流动性充裕基调。整体而言,当前市场正处于"旧主线退潮、新主线确立"的关键过渡期,科技成长赛道再度成为资金共识方向。
2026-07-10 12:05:32
1021
原创 2026年AI Agent与开源生态全景指南:从概念落地到生产力革命
2026年的AI正在经历一场深刻的范式转变——从"感知"到"认知",从"生成"到"执行"。世界模型重构了底层逻辑,Agent成为了生产力工具,MCP协议统一了工具调用标准,端云协同让AI普惠落地。这些变化不是孤立的,而是相互支撑、加速演进的。最让人兴奋的不是技术本身,而是门槛的降低。哪怕是个人开发者,用一个周末搭建一个生产级的Agent已经成为现实。开源社区的力量正在让AI从少数巨头的专利变成人人可用的基础设施。
2026-07-10 11:40:40
909
原创 MCP协议实战指南:AI Agent时代的工具集成新范式
名称(name):简短、动词开头、语义明确。好过。描述(description):这是模型决定是否调用该工具的唯一依据。要写清楚工具做什么、什么时候该用、什么时候不该用。比如「获取指定坐标位置的天气预报」比「天气功能」好得多。参数Schema(inputSchema):用JSON Schema描述参数类型、是否必填、可选值范围。模型会根据Schema来生成调用参数,Schema越精确,参数错误率越低。docstring:FastMCP会自动解析函数docstring中的部分,将其作为参数描述传给模型。
2026-07-08 10:57:59
404
原创 2026.7.7最新财经播报综合分析
2026年7月7日财经市场呈现多重信号:全球股市分化,美股科技股领涨,A股窄幅震荡;半导体存储芯片、AI算力硬件等硬科技板块成为市场主线,中报业绩预告显示相关企业盈利大幅预增;政策面维持稳健,流动性合理充裕,市场逐步转向业绩驱动。投资建议聚焦存储芯片、半导体设备、人形机器人等高景气赛道,同时警惕纯题材炒作风险。整体来看,市场处于过渡阶段,结构性机会突出但需注重基本面筛选。
2026-07-07 09:05:26
2301
1
原创 Windows本地局域网文件快速互传方法
方法适用场景难度共享文件夹向导新手首次设置⭐ 简单文件夹属性共享快速共享单个文件夹⭐ 简单关闭密码保护免去每次输入密码⭐⭐ 中等修改组策略解决权限访问问题⭐⭐⭐ 进阶按照以上步骤操作,即可在 Windows 局域网内轻松实现文件夹共享,无需借助任何第三方软件。安全提示:共享文件夹仅在受信任的局域网内使用,公共网络环境下建议开启密码保护,避免数据泄露风险。
2026-07-03 07:34:45
712
原创 MCP 协议完全指南:从原理到实战,让 AI Agent 真正拥有「行动力」
MCP协议:AI Agent行动力引擎 摘要(146字):MCP(Model Context Protocol)是Anthropic推出的标准化AI工具调用协议,通过定义Tools、Resources、Prompts三大核心原语,解决LLM工具调用的碎片化、安全性和上下文污染问题。其四层架构(LLM层-Client层-Server层-资源层)实现了模型与工具的松耦合,支持Python/TypeScript等多语言开发。协议采用JSON-RPC 2.0标准,提供stdio/SSE双传输模式
2026-07-02 23:13:26
455
原创 系统设计入门:如何打造高内聚低耦合的架构
本文摘要(149字): 软件设计核心原则"高内聚低耦合"解析:高内聚指模块功能单一专注(如拆分用户认证、邮件、报表服务),低耦合要求模块间依赖最小化(通过接口编程和依赖注入实现)。文章通过代码对比展示低内聚类的混乱与重构后的清晰,提出7级内聚/耦合标准,推荐达到"功能内聚"和"数据耦合"。关键技巧包括面向接口编程、依赖注入和事件驱动,最终目标是构建像乐高积木般可独立替换的模块化系统。新手掌握该原则可显著提升代码可维护性和扩展性。
2026-06-30 14:37:28
570
原创 JS逆向入门:加密参数定位与算法还原实战
这篇文章是一份JS逆向入门实战指南,主要面向遇到加密参数不知如何处理的初学者。文章首先解释了JS逆向的核心目标:分析前端加密参数的生成逻辑并在本地复现。然后详细介绍了必备工具(浏览器开发者工具、抓包工具、本地运行环境)和标准五步流程:抓包定位参数→定位加密代码→断点调试→扣取代码→验证结果。重点讲解了5种加密参数定位方法(关键字搜索、XHR断点、调用栈追踪等)和常见加密算法识别技巧(Base64、MD5、AES等),最后通过实战案例演示完整逆向过程,并指出新手常见误区。文章特点是实操性强,提供可直接套用的方
2026-06-30 10:49:25
915
原创 小白程序员命令行指南:30分钟掌握终端操作核心技能
本文是一份面向程序员新手的命令行操作入门指南,核心目标是帮助读者从零开始掌握终端操作的基本技能。文章分为十个主要部分: 为什么必须学习命令行:解释图形界面的局限性,以及命令行在开发工具、效率和服务器管理中的必要性 关键概念解析:澄清终端、Shell和命令行的区别,并为不同操作系统推荐合适的工具 打开终端的方法:分别介绍Windows、macOS和Linux系统下启动终端的操作步骤 命令语法结构:讲解命令+选项+参数的基本组成方式 20个必会命令:分类介绍路径操作、文件管理和内容查看等核心命令 5个效率技巧:
2026-06-29 15:57:35
412
原创 开发者对接 Shopee 平台 API 接口的血与泪教训
文章摘要: 本文系统梳理了跨境电商SaaS系统对接Shopee Open API V2的完整踩坑历程,涵盖12大类核心问题:应用注册回调地址限制(仅支持根域名)、OAuth授权流程设计(全量参数透传模式)、三种API签名算法差异(Shop/Merchant/Public API)、地区化API域名规则、参数命名不统一(如订单ID存在3种字段名)、本土店与跨境店API可用性差异、Token生命周期管理(自动刷新机制)、15天数据查询限制、结算单48列字段映射难题等。每个问题均附具体现象、根因分析及解决方案
2026-06-29 15:37:38
560
原创 从零搭建你的第一个 AI Agent:2026 年最该学会的技能,小白也能 30 分钟上手
摘要 本文为零基础读者提供AI Agent(智能体)的入门指南,解释其核心概念并指导动手实践。文章将AI Agent比作"有手有脚的ChatGPT",不仅能对话还能主动执行任务。核心架构包括:大语言模型(大脑)、记忆系统、工具调用能力和ReAct规划范式。教程部分带领读者30分钟内完成三版Agent开发:基础对话版、工具增强版和记忆增强版。还提供了框架选型建议、常见开发陷阱及四阶段学习路线图。文章强调,AI Agent开发已成为2026年重要技能,企业需求激增,是值得投入学习的实用技术。
2026-06-28 19:42:06
463
原创 2026年最值得学的技术——AI Agent完全指南:从小白到实战
AI Agent完全指南(150字摘要) AI Agent是2026年最具潜力的技术方向,能够自主完成任务而非仅回答问题。本文提供从入门到实战的完整路径:首先解释AI Agent的四大核心能力(感知、规划、行动、记忆)及其与传统AI的区别;推荐3款零门槛工具(Cursor、Coze、Dify)帮助小白快速上手;展示5个实用场景如自动日报、智能客服等;并给出Python开发AI Agent的实现思路。最后提醒新手需避免的5大常见误区,如Prompt设计模糊、权限管理不当等。适合希望把握技术红利的初学者和寻求效
2026-06-28 17:11:36
389
原创 MySQL索引失效8大场景实测-100万行数据验证走索引还是全表扫描
MySQL索引失效8大场景实测 摘要:本文通过100万行数据实测,验证了MySQL索引失效的8大常见场景。作者首先建立了包含100万行的测试表,明确数据分布特征,然后逐一测试函数运算、LIKE模糊、类型转换、最左前缀、OR连接、回表、低选择性等场景下的索引使用情况。每个测试均包含EXPLAIN执行计划和真实耗时对比,并标注预期命中行数。测试发现,对索引字段进行运算(如age+1=31)、LIKE左模糊查询、隐式类型转换、违反最左前缀原则、OR连接非索引字段等操作都会导致索引失效,转为全表扫描。文章提供了直观
2026-06-27 15:37:17
369
原创 Git新手高频踩坑实战-reset-merge-rebase-stash真实命令演示
Git 命令多,但新手高频踩的坑就那么几个。三个区域是理解一切的基础,看懂的两列状态码,reset就不会再瞎敲;是核武器,没把握就用默认的--mixed,想保留改动重新提交用--soft;merge保留分叉、rebase拉直历史,公共分支只用 merge,个人本地分支才 rebase;stash切分支前必用摘单提交,reflog是误操作的救命稻草;.gitignore对已跟踪文件无效,要取消跟踪;冲突看懂<<<<<<<标记,三步走:编辑 →add→commit。
2026-06-27 12:04:09
494
原创 Python 并发怎么选?多线程 / 多进程 / asyncio 真实性能对比(附实测数据 + 选型决策图)
Python并发性能对比实测:多线程、多进程、asyncio选型指南 摘要: 本文通过实测数据对比Python三种并发方案在IO密集、CPU密集和混合场景下的性能表现。
2026-06-26 10:52:02
477
原创 2026年最新MCP协议从原理到实战:手写一个MCP Server接入Claude Code全流程踩坑指南
本文摘要:MCP(Model Context Protocol)协议已成为2026年AI开发的事实标准,它通过统一接口让大模型安全访问外部工具和数据源。文章从MCP核心原理(三层架构、三类能力、两种传输方式)出发,提供Python环境搭建指南,并分步骤演示如何手写stdio版MCP Server、定义工具函数、本地调试,最终接入Claude Code实现工具调用。特别总结了7个实战踩坑经验,对比MCP与传统Function Calling的优势,帮助开发者快速掌握这一关键技术。(字数:149)
2026-06-25 15:18:15
1394
原创 Codex CLI 接入 DeepSeek 全方案避坑指南:2026 最新四方案横向对比实战(Responses API 协议冲突终极破解)
本文提供了2026年最新Codex CLI接入DeepSeek的四大解决方案横向对比。针对新版Codex CLI强制使用Responses API与DeepSeek仅支持Chat Completions的协议鸿沟问题,详细分析了四种桥接方案: codex-relay:Windows最佳,安装简单但需手动配置 Moon Bridge:跨平台均衡,自动生成配置最省心 codex-chat-bridge:macOS友好,适合处理Tool过滤 aliyun-codex-bridge:需3处补丁,但支持完整思维链路
2026-06-24 14:41:23
1400
原创 2026年新人小白的第一台云服务器:从零到上线的完整实战指南
本文面向完全零基础的新手,用通俗易懂的语言和保姆级步骤,带你从注册阿里云账号开始,到选购 ECS、连接服务器、配置安全、部署网站、绑定域名,最终完成一个可对外访问的完整项目。全文覆盖 Windows 与 Mac 双平台操作,附常用命令速查与故障排查流程,助你真正迈出云计算实战第一步。
2026-06-23 11:50:59
1600
原创 TikTok Shop 开放平台对接与 App 开发上架全流程实战指南
本团队在对接 TikTok Shop 开放平台的过程中,从开发者账号注册、App 创建、到最终的应用审核上架,每一步都踩了不少坑。TikTok Shop 的官方文档虽然齐全,但内容分散在不同的分类中,很多细节要等踩了坑才发现。特别是公开应用(Public App)的审核环节,涉及的材料多、审核维度多、返工概率高,网上能查到的经验分享很少。把自定义应用和公开应用这两条路线分别讲清楚,让读者知道自己的情况该走哪条路重点剖析公开应用审核的全流程和避坑指南所有经验来自真实项目,不是纸上谈兵。
2026-06-22 14:00:00
721
1
原创 从零搭建生产级 Multi-Agent 系统:MCP 协议 + LangGraph 实战全解析
这篇文章系统介绍了2026年Multi-Agent系统的技术发展和工程实践,主要内容包括: Multi-Agent趋势:分析了从单Agent到多Agent的范式迁移,指出2026年是Multi-Agent爆发的元年,主要驱动力来自模型能力提升、协议标准化和框架成熟。 MCP协议:详细解析了作为Agent间通信标准的MCP协议,包括其架构设计、与传统Tool Calling的对比优势,并提供了Python实现的MCP Server示例代码。 LangGraph框架:介绍了用于构建Multi-Agent工作流的
2026-06-22 09:24:14
446
原创 Claude Code + MCP 深度实战:6个“外挂“让AI从只会聊天变成真正干活,附完整配置与避坑指南
本文深入探讨了如何通过MCP协议让AI从被动聊天转变为主动执行任务。作者实测了filesystem、github、playwright、postgres、puppeteer和memory六种MCP Server在真实开发场景中的应用效果,并提供了详细的安装配置指南。文章指出MCP不是"装上就能用"的插件,而是需要正确配置和调用的"插座",并针对每个场景提供了问题现象、解决方案和避坑指南。特别强调了安全风险(如Token管理和数据库权限控制)和实际应用中的性能问题,最后对六种MCP Server进行了综合对比
2026-06-21 23:44:59
599
原创 转行计算机领域——实战应用与学习路径规划
很多刚决定转行做开发的朋友,最容易陷入的误区就是抱着厚厚的教材从第一页啃到最后一页,结果半年过去了,理论背了一堆,连个像样的网页都搭不出来。这种“只输入不输出”的学习方式,在技术迭代如此迅速的今天,效率极低且极易让人产生挫败感。真正的技能掌握,往往发生在解决具体问题的过程中,而不是被动地阅读文档。对于零基础起步的人来说,最需要的不是一份完美的书单,而是一张能直接映射到实际工作场景的技能地图,以及一个能让你立刻看到代码运行结果的反馈环境。
2026-06-17 18:25:35
312
原创 大模型幻觉难题解决办法
2025年大语言模型广泛应用,但“幻觉”问题在医疗、法律等高风险场景隐患突出。本文剖析其三大根因:训练数据噪声、概率预测缺陷、对齐训练副作用,指出幻觉是模型机理的必然产物,虽无法根除但可大幅缓解。针对此,给出基于LangChain与Chroma的RAG企业级实战方案,涵盖混合检索、重排序、查询改写、置信度阈值、幻觉检测五大优化技巧。实测显示,接入RAG后事实准确率从62%提升至91%,幻觉发生率下降近30%。最后结合RAGAS评估框架与场景选型建议,助力开发者科学应对幻觉难题。
2026-06-17 09:46:21
554
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅