- 博客(1098)
- 收藏
- 关注
原创 Windows WSL2 Ubuntu 搭建 Xvfb 虚拟桌面环境,完美支持多 Agent 隔离
做 AI Agent 开发的朋友应该都遇到过这个痛点:Agent 需要操作浏览器、点击 GUI 界面,但你又不想让它动你的真实桌面——鼠标乱飘、窗口被抢、浏览器登录态被污染……太折磨了。有一个很成熟的方案:在 Linux 上通过Xvfb(虚拟帧缓冲)创建无头虚拟桌面,每个 Agent 分配一个独立的桌面环境,完全隔离互不干扰。我主力机是 Windows,难道为了测试还要装双系统或虚拟机吗?不用。Windows 11 + WSL2 + Ubuntu 就能完美跑通这个方案。本文将用7 个步骤。
2026-08-29 23:08:44
347
原创 SQLite离线FTS 索引全文检索构建
分词:将商品名称和规格字段中的文本切分成词(Token)。对于中文,FTS5默认按字符切分(如“香蕉”分成“香”、“蕉”),虽然不符合语义,但可配合前缀查询弥补。查询:当用户输入“香蕉”时,FTS快速查找词项“香”和“蕉”的文档交集,然后计算BM25分数排序。索引:每个词项记录它出现在哪些文档ID中,以及出现次数、位置等信息。文档:这里的“文档”对应我们的一条商品记录。FTS全文索引的工作原理。
2026-08-26 08:43:38
322
原创 从零搭建一个能加载 MCP 和 Skill 的最简智能体
本文揭示了AI Agent的本质:读技能手册、调工具、循环决策。通过150行Python代码实现了一个精简Agent框架,核心设计包括: 概念分层:区分MCP Server(工具进程)、Skill(操作手册)和Agent(执行者)三层架构 两阶段Skill加载:启动时仅加载YAML frontmatter形成轻量索引,命中时才加载完整手册正文 动态决策循环:解析LLM输出的<load_skill>标记触发技能加载,处理工具调用并反馈结果 关键优势在于解耦设计(Skill与MCP独立)和按需加载机制,有效控制
2026-08-20 10:19:28
35
原创 FastAPI 实战:使用 Authorization + API Key + 权限装饰实现 API 接口鉴权
本文介绍了如何通过 FastAPI + Depends 实现对外开放 API/MCP Tool 的统一权限控制方案。核心设计包括: 采用标准 HTTP Authorization Bearer Token 传递 API Key 通过三级验证流程:API Key有效性→客户端状态检查→权限校验 使用 401/403 状态码区分认证失败和权限不足 实现权限依赖注入,业务代码只需声明所需权限 方案支持: 多租户隔离 API Key状态/有效期管理 细粒度接口权限控制 统一错误处理 典型应用场景: 对外开放的API
2026-08-16 10:29:03
178
原创 智能体蛋白小分子自动化对接 Cursor使用subseq mcp实现
本文介绍了如何在Cursor中配置mcp并使用subseq后台查看数据。内容包括:1)Cursor配置mcp的步骤图示;2)密钥申请说明(提供免费5次额度);3)subseq后台数据查看的界面截图;4)本地运行效果展示。通过图文结合的方式,完整呈现了从系统配置到数据查看的操作流程。
2026-08-12 09:36:11
40
原创 agent 自主长期运行探索
摘要: autoresearch和LoopX是两类AI自主运行框架,分别适用于不同场景。autoresearch(Karpathy开发)专注短周期实验循环(如5分钟/次的模型调参),通过单文件修改和固定预算实现高效迭代,但缺乏状态持久化和人工干预能力。LoopX(huangruiteng开发)作为长期运行控制平面,通过目标管理、任务配额、证据日志和人工Gate机制支持多Agent协作与跨会话持久化,适用于复杂长期任务(如200+小时实验)。 关键差异: 时间范围:autoresearch适合小时级任务,Lo
2026-08-04 09:06:58
239
原创 Codex自定义接入国产大模型
文章摘要:本文介绍了如何配置Codex在Windows系统下的下载和使用,主要针对火山和百炼平台的支持。内容包括修改config.toml文件设置model_provider为"doubao_proxy",配置相关参数如base_url和API密钥。同时指导用户在系统环境变量中添加ARK_API_KEY,并附有配置截图说明。当前新版本主要支持Responses API的大模型,其中火山和百炼平台兼容性较好。
2026-07-21 13:40:45
67
原创 dify 知识库迁移拷贝复制
这篇文章介绍了一个通过API脚本实现Dify知识库复制的Python方案。作者指出当前Dify平台缺乏一键复制知识库的UI功能,于是编写了自动化脚本,通过分段读取源知识库内容并写入新建库的方式完成复制。代码展示了完整的操作流程:1)删除旧库;2)分页获取源库文档;3)创建新库;4)将文档内容分段读取后合并文本,再批量写入新库。该方法不依赖download-zip功能,采用与版本无关的实现方式,适用于需要迁移或备份知识库的场景。
2026-06-22 14:36:01
147
原创 智能体生产优化实战:从 30 并发悬崖到双机无单点
本文记录了一个基于 FastMCP+FastAPI+SSE的旅游AI Agent在生产环境压测时遇到30-40并发容量悬崖的完整优化过程。系统采用多工具调用的架构,包含意图分类、LLM编排等功能模块。通过逐段排查,识别出四个关键瓶颈:client单worker启动方式错误、MCP Server单点瓶颈、ES同步写入等待消耗容量、nginx配置权重与容量上限不匹配。针对这些问题实施了五项优化措施:修正client多worker启动方式、双机本地化部署MCP Server消除单点、升级无状态多worker模式、
2026-06-11 10:50:29
245
原创 LLM 智能体构建用户记忆系统:从零散日志到结构化画像
本文介绍了一个出行领域智能客服系统的用户记忆系统设计,通过三层记忆结构解决LLM应用中用户历史数据未被利用的问题。L1会话记忆维持单次对话连贯性,L2用户记忆记录用户30-90天的行为数据,L3用户画像生成永久性结构化标签。系统采用Redis和Elasticsearch分别存储不同层级的数据,通过定时任务将日志数据聚合为L2记忆,再经LLM处理生成L3画像。这种分层设计有效减少了LLM的反问次数,提升了用户体验,同时实现了用户行为的长期跟踪和分析。
2026-04-29 09:30:52
113
原创 用 FastMCP 构建出行龙虾技能:从 MCP Server 到 Python/Node.js 双版本 Skill Client
本文介绍了一个基于MCP协议的生产级出行查询技能实现方案。系统采用三层架构:1) AI Agent平台通过SKILL.md发现技能;2) 客户端提供Python和Node.js两种实现;3) 服务端使用FastMCP框架处理MCP协议,聚合多个出行API。关键技术点包括:FastMCP框架自动处理JSON-RPC路由、HTTP连接池优化、地址词典预加载、日志时区统一等。该方案实现了机票、高铁等12种出行工具的标准化接入,使AI助手能实时查询出行数据并生成订票链接。
2026-04-28 09:16:01
143
原创 deepseek、mimo接入claude code 终端版和桌面版教程;claude code常用快捷键
本文介绍了如何将DeepSeek模型接入主流AI工具(如Claude Code、OpenCode等)的方法。主要内容包括配置DeepSeek Anthropic API环境变量的详细步骤,分别针对Linux/Mac和Windows用户提供相应的命令设置。配置参数包括API基础URL、认证令牌以及不同模型版本(如deepseek-v4-pro和deepseek-v4-flash)的指定。通过正确设置这些环境变量,用户可以将DeepSeek的强大AI能力整合到现有开发工具链中。
2026-04-27 11:14:28
696
原创 Linux SSH 连接 GitHub(22端口被封解决方案)
GitHub SSH连接被22端口封锁时,可通过443端口备用入口解决。方法:1)生成SSH密钥并添加到GitHub账户;2)测试443端口连通性;3)配置~/.ssh/config文件将github.com指向ssh.github.com:443;4)验证后即可正常推送代码。此方案利用GitHub提供的443端口备用SSH入口(通常不被防火墙封锁),实现透明化的SSH连接,解决22端口被屏蔽的问题。
2026-04-19 12:49:58
385
原创 2026智能体爆发现象级产品:OpenClaw、Hermes Agent、Claude Cowork
## 一句话选择建议- **你是非技术用户,想让 AI 帮你处理文件、报告、日常办公任务** → Cowork,开箱即用,安全,不需要折腾服务器- **你是开发者,想要一个越用越聪明、数据不出门、不绑定任何厂商的 agent** → Hermes Agent,当前最佳开源选项- **OpenClaw** → 平台覆盖最广、生态最成熟,但安全问题需要认真评估后再决定是否部署
2026-04-16 08:48:34
730
原创 hermes agent个人助手安装使用,连接weixin-类龙虾
Hermes Agent 是一款由NousResearch开发的开源代理工具,支持微信等平台的自动化操作。安装方法简单,只需运行官方提供的bash脚本即可快速部署。使用前需升级工具并安装必要的Python依赖包(aiohttp、cryptography等),通过终端命令配置微信网关后,用手机扫码即可完成绑定。该项目提供完善的文档支持,开发者可参考官网快速入门指南获取详细使用说明。
2026-04-16 08:45:27
373
原创 claude cowork 个人桌面agent助手-类龙虾
本文介绍了Claude桌面版的下载安装与界面功能。下载建议直接获取完整MSIX安装包而非EXE文件。安装完成后,界面提供三个核心功能模块:左上角可切换聊天(chat)、协作(cowork)和代码(code)三大模式,满足不同场景需求。每个功能模块都有对应的操作界面,整体设计简洁直观,便于用户快速上手使用Claude的各项AI服务。
2026-04-16 08:34:19
125
原创 VoxCPM2 TTS流式播放代码案例
VoxCPM2流式TTS服务部署指南 摘要: 本文介绍如何部署VoxCPM2流式文本转语音(TTS)服务。该服务基于FastAPI实现,支持实时流式音频输出。部署步骤包括:1)安装voxcpm包;2)下载模型文件;3)通过Docker启动服务容器(需GPU支持);4)运行FastAPI服务。服务提供SSE流式接口,前端可实时接收文本和音频数据,实现边生成边播放的效果。接口包含文本分句、音频流式传输和错误处理功能,采样率可通过配置获取。部署完成后可通过8000端口访问服务。
2026-04-10 10:06:47
144
原创 Agentic RAG 智能体式知识库检索代码案例
本文提出了一种智能化的Agentic RAG(检索增强生成)方法,通过动态决策优化检索流程。Agent能自主判断是否需要检索、选择检索方式(语义检索或关键词检索),并评估结果是否充分。系统采用多轮交互策略,最多执行3次检索,避免无效查询。实验代码模拟了知识库检索过程,展示了如何根据问题类型动态调用不同检索工具,最终生成精准回答。该方法有效解决了传统RAG盲目检索的问题,提升了问答系统的效率和准确性。
2026-03-16 15:30:27
125
原创 agent多智能体实现案例
本文介绍了三种基于OpenAI API的智能代理实现方式: 顺序链式Agent:通过需求分析、技术方案、技术评审三个环节的链式调用,完成从用户需求到技术实现的完整流程。 多Agent辩论:设置正反方和裁判三个角色,通过多轮辩论和总结,对争议话题进行全面分析。 工具调用Agent:支持动态调用外部工具(如网络搜索和数学计算)的智能代理,通过循环机制实现复杂任务处理。 三种方式均采用历史消息维护机制,展示了不同场景下大语言模型的应用方法。代码示例清晰展示了各代理的实现逻辑和交互方式。
2026-03-16 10:41:13
301
原创 llmfit:自动找到适配你GPU硬件的大模型方案
LLMfit是一个命令行工具,可通过简单命令快速安装和使用。用户只需运行一条curl命令即可完成安装(curl -fsSL https://llmfit.axjns.dev/install.sh | sh),安装后直接输入llmfit命令即可启动程序。该项目托管在GitHub(github.com/AlexsJones/llmfit),提供便捷的AI模型调用功能,适合开发者快速集成使用。安装过程简单高效,无需复杂配置即可运行。
2026-03-16 08:38:26
237
原创 sglang 部署glm4.7 flash;opencode添加本地离线模型
本文介绍了GLM-4.7-Flash模型的部署与使用方案。首先通过Docker命令部署sglang服务,需要注意该模型需要特殊传参,包括指定工具调用和推理解析器。提供了Python API调用示例,支持普通对话和流式输出两种模式。同时展示了如何将本地模型添加到OpenCode配置文件中,支持通过Ollama或直接连接两种方式调用。文中包含详细的配置代码和截图说明,为开发者提供了完整的本地模型部署与集成方案。
2026-03-12 10:33:47
268
原创 openclaw 龙虾接入qq机器人;常用技能推荐
国内安装OpenClaw QQ机器人最简教程:1)在QQ开放平台创建机器人;2)通过命令安装QQBot插件并配置机器人token;3)重启OpenClaw服务即可使用。该方案操作简单,适合国内用户快速部署QQ聊天机器人。(99字)
2026-03-09 17:38:31
242
原创 大模型多轮上下文压缩使用
本文提出了一种动态压缩对话历史的方法,通过摘要生成控制上下文长度。当对话历史达到预设阈值(如上下文长度的70%-80%)时,系统会自动提取较早部分生成"记忆摘要",并替换冗长历史记录。具体实现包括:1)根据模型输入限制设定长度阈值;2)自动触发摘要生成API;3)将系统提示、摘要和最新对话拼接为新的上下文。这种方法有效解决了长对话场景下的上下文管理问题,示例代码展示了摘要生成和上下文拼接的具体实现。
2026-02-26 14:09:09
231
原创 qwen3.5 文字、图像、视频多模态openai接口案例
本文介绍了如何使用Qwen3.5大模型进行多模态交互。示例代码展示了文本对话、图像理解和视频分析三种应用场景。文本对话示例演示了如何获取模型的推理过程和最终回答;图像理解示例展示了模型对数学题中几何图形的解析能力;视频分析示例则说明模型可以处理视频内容并回答问题。这些功能通过OpenAI兼容的API实现,展现了Qwen3.5在视觉理解和多模态推理方面的强大能力。开发者可以根据需求调整参数,如视频采样率等,以获得最佳交互效果。
2026-02-24 09:13:51
439
原创 fastmcp client实现同时调用mcp工具和skill技能代码实现
FastMCP 3.0版本优化摘要 FastMCP 3.0版本主要优化了工具调用和提示词规范: 服务端改进:将skills转换为工具(参考CSDN文章),通过list_tools()获取工具列表并标准化参数格式,支持函数式调用。 客户端优化:在系统提示词中明确功能规范(如行程规划自动调用travel-guide工具),减少query时的二次提示需求,提升响应效率。 代码实现: 使用OpenAI兼容API,集成MCP工具调用流程,支持流式响应。 通过limit_messages限制对话轮数,默认保留最近5轮交
2026-02-10 08:55:15
222
原创 opencode skill生成自定义技能案例
本文介绍了如何安装和使用skill-creator技能包来创建自定义旅游规划技能。首先从指定网站下载技能包并放置到本地目录,然后按照步骤生成技能配置文件SKILL.md。该配置文件详细定义了旅游行程规划专家的角色定位、核心规则(如严格的图片来源限制)、任务执行步骤(包括工具使用顺序和图片筛选规则),以及标准化的输出格式模板。重点强调了仅使用城市旅游特色图片,严禁使用酒店相关图片,并提供了完整的Markdown输出示例。整个流程规范了旅游行程规划技能的行为准则和数据输出标准。
2026-02-09 16:00:37
869
原创 fastmcp client访问使用skills技能代码案例
文章摘要: 本文介绍了FastMCP 3.0及以上版本的安装方法(pip install "fastmcp>=3.0.0b2"),并详细展示了如何使用ResourcesAsTools功能将本地skill资源转换为MCP服务器工具。主要内容包括:1)服务器端配置,通过FastAPI部署MCP服务并添加ResourcesAsTools转换器;2)客户端访问方式,通过FastMCP Client远程连接服务器,并演示了基于OpenAI API的聊天流式响应实现。文章提供了完整的代码示例和
2026-02-09 15:42:17
519
原创 fastmcp client list_resources加载使用skills技能;server ResourcesAsTools 技能转成mcp工具
FastMCP 3.0+版本安装与使用摘要:通过pip install "fastmcp>=3.0.0b2"安装后,可创建异步MCP服务器管理技能资源。示例代码展示了如何启动服务器、添加技能目录提供者,并通过客户端列出和读取资源(如SKILL.md文件)。使用asyncio运行异步主函数实现资源管理功能。该工具支持Windows路径和URI协议访问资源。
2026-02-09 11:28:01
244
原创 searxng docker离线搜索部署
本文介绍了如何使用Docker快速部署SearXNG搜索引擎。通过简单的docker pull命令获取镜像,创建数据目录后,使用docker run命令启动容器,映射8080端口并设置自动重启。部署完成后,访问http://127.0.0.1:8080/search即可使用该隐私保护搜索引擎。整个过程简洁高效,适合快速搭建个人搜索服务。
2026-02-02 14:38:16
243
原创 openclaw 调用浏览器配置
本文介绍了OpenClaw浏览器插件的安装和使用方法。首先通过命令行安装插件并查看安装路径,然后在Chrome浏览器中加载该插件。安装完成后,插件会在后台自动运行,调用浏览器查询真实数据。文中提供了详细的安装步骤截图和使用效果对比图,帮助用户直观了解插件的功能实现方式。
2026-02-02 10:52:54
4765
7
原创 Moltbot(原Clawdbot)接入飞书机器人案例
本文介绍了飞书机器人(Clawdbot)的安装与使用流程。首先需要在飞书开放平台创建应用并获取AppID和App Secret,然后从GitHub下载飞书插件并重命名为clawdbot-bridge.exe。Windows用户可通过命令行启动插件(需填入应用凭证),支持后台启动、停止、重启等操作。最后在飞书工作台即可与创建的机器人进行对话交互。文中提供了详细的图文指引和命令参数说明,帮助用户快速完成部署和使用。
2026-01-29 09:29:01
660
原创 Moltbot(原Clawdbot) AI超级助手本都windows安装体验
MoltBot是一款基于命令行的AI助手工具,支持Windows系统安装使用。安装时通过PowerShell执行脚本命令即可完成。用户需要设置模型参数和前端通信渠道,启动服务需运行指定端口命令,若失败可先执行安装和启动命令。使用时需在配置文件中查看token,遇到连接错误可修改pending.json文件设置。最后通过本地地址加token即可访问Web界面进行操作。该工具提供了简洁的AI交互方式,适合开发者快速部署使用。
2026-01-28 16:30:57
513
原创 docker gpu容器镜像环境构建
本文介绍了在Docker容器中配置NVIDIA CUDA和Python环境的步骤。首先从NVIDIA官方Docker Hub拉取CUDA 12.1.1镜像,然后进入容器并挂载数据卷。接着在Ubuntu系统中安装Python 3.10环境,包括添加universe仓库、安装Python 3.10及其开发包等必要组件。整个过程通过命令行操作完成,为后续的GPU加速开发工作搭建了基础环境。
2026-01-26 09:26:33
244
原创 Qwen3 TTS文字转语音 fastapi提供api实时服务,docker部署
本文介绍了一个基于FastAPI实现的Qwen3 TTS语音合成服务。服务提供了两个核心功能:1) 使用预设音色(Custom Voice)进行文本转语音;2) 通过参考音频实现音色克隆(Voice Clone)。服务使用GPU加速,支持中英文,并提供了完整的API调用示例。文章还提到尝试安装FlashAttention 2来优化GPU内存使用,但实际测试中生成速度未见提升。该服务可通过Docker容器部署,适用于需要定制化语音合成的应用场景。
2026-01-23 10:56:32
142
原创 Qwen3-TTS 语音播放和语音克隆案例
Qwen3-TTS是一款支持多音色、多语言的文本转语音工具,提供CustomVoice和Base两种模型。CustomVoice可直接语音播放并支持音色控制,Base模型支持语音克隆功能。安装方式为pip安装,模型需通过modelscope下载。使用示例展示了如何生成指定音色的语音及基于参考音频的语音克隆,输出为wav格式音频文件。该工具支持中文等多种语言,可灵活调整语音风格和语气。
2026-01-23 10:33:27
179
原创 opencode skills安装使用案例
Skills仓库(skillsmp.com)提供了技能包的下载和安装指南。安装时需下载zip包并拖拽到skill命令行执行,默认安装路径为C:\Users\用户.config\opencode\skills。使用前需要关闭opencode并重启skill才能生效。文档包含详细的安装和使用截图指引,展示了从下载安装包到最终使用的完整流程。
2026-01-20 09:17:53
2154
原创 Qwen3-VL-Embedding 多模态文本图像视频文档统一向量召回模型
本文展示了如何使用Qwen3-VL-Embedding模型实现多模态检索。通过加载预训练模型,可以处理图像和文本输入,计算嵌入向量相似度进行跨模态检索。实验包括:1)文本查询"奔跑的人"检索相关电影海报;2)英文查询"a man is running"检索;3)图像查询检索相似电影海报。结果显示模型能有效实现图文跨模态检索,支持中英文查询。代码示例展示了完整的嵌入计算、相似度匹配和可视化流程,适用于多模态信息检索应用。
2026-01-13 10:20:03
169
原创 funasr stt语音转录;输出符号与停顿
FunASR语音识别工具使用指南 摘要:本文介绍了FunASR语音识别工具的基本使用方法。通过pip安装funasr库(1.3.0版本)后,可以使用AutoModel加载SenseVoiceSmall模型进行语音识别。示例代码展示了两种功能:1)带标点符号的文本输出(use_itn参数),2)停顿识别功能(通过vad_model参数实现)。识别结果包含情感标签(如HAPPY/NEUTRAL)和语言标识(zh),并能处理数字、标点等文本规范化(ITN)。该工具支持多语言识别,可应用于虚拟数字人等领域的语音交互
2026-01-04 17:39:33
460
原创 funasr_onnx asr语音转录使用案例;vad和标点恢复
FunASR的SenseVoiceSmall模型提供了便捷的语音识别功能。通过安装funasr_onnx库,用户可以快速部署预训练模型。使用方法简单:导入模型后指定音频文件路径,即可获取自动语言检测和智能文本规范化处理的转录结果。该模型支持批处理(默认batch_size=10)和量化选项,并能通过rich_transcription_postprocess进行后处理优化输出。示例展示了从加载模型到获取最终转录文本的完整流程,适用于工业级语音识别应用场景。
2026-01-04 16:27:41
236
原创 opencode:vide coding工具安装介绍;使用案例
OpenCode AI开发工具安装与配置指南 OpenCode是一个AI辅助开发工具,支持多种安装方式: 跨平台安装:通过npm、scoop、choco、brew等包管理器安装 配置智谱GLM模型:修改opencode.json配置文件 登录认证:使用opencode auth login命令 常见问题解决:清理缓存或设置环境变量绕过SSL验证 使用:直接运行opencode命令即可启动AI辅助功能 工具提供智能代码补全、问题解答等功能,支持Windows/macOS/Linux系统。
2026-01-04 13:40:20
1207
unidic-mecab 字符文件unidic-3.1.0下载
2024-03-01
中文语音唤醒模型sherpa-onnx-kws-zipformer-wenetspeech-3.3M-2024-01-01 (C
2024-03-01
yolov9 自有数据训练代码参考
2024-03-01
diffusers-flask-streamlit AIGC文生图代码案例,前端后端代码
2024-03-01
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅