自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

许泽宇的技术分享

微软最有价值专家(Al Platform MVP),华为云开发者专家(HCDE),飞浆技术专家,NebulaGraph认证专家,Neo4j认证专家,上市公司首席架构师,专注.Net 和AI相关技术,内容涵盖教程、技巧、行业动态及解决方案

  • 博客(589)
  • 资源 (4)
  • 收藏
  • 关注

原创 腾讯把 AI 放进终端后,运维终于不用死记命令了

腾讯这次把 OrcaTerm 往 AI 方向推,我觉得重点不在“又多了一个 AI 产品”。重点是,终端这个几十年没怎么变过的入口,开始重新被设计了。以前,终端是专家的工具。它效率高,但记忆负担也高。现在,终端开始拥有文件视图、命令面板、协作、自动化和模型能力。它仍然保留专业性。但没那么拒人千里之外了。这不是让运维变简单。运维本身不会简单。它只是让复杂的事情,少一点重复,少一点迷路,少一点“我到底刚才做了什么”。对第一次接触服务器的人来说,OrcaTerm 像一个带路的人。

2026-08-24 10:49:28 496

原创 FDE-前沿部署工程师,最缺一个“能拆开再拼”的 Agent 底座

deepseek-harness 里有一个概念,叫"能力接缝"。这个名字听起来抽象,拆开其实很简单。一个能力接缝,由三个角色组成:定义、提供、消费。定义,是说清楚这个能力是什么、长什么样。提供,是真正实现它的那一层。消费,是使用它的那一方。三者各归其位,边界清晰。拿文件系统举例。文件系统是一个能力接缝,策略层负责定规则,本地实现负责真正读写,Agent 的工具负责调用。要做边界控制,就在策略层写清楚,而不是在循环里埋一坨 if。这个拆法,对个人工具来说,有点过度设计。

2026-08-24 10:39:13 333

原创 AI编程Agent的“引擎“对决:Codex、Grok、Hermes、Pi的Harness深度拆解

本文深入探讨了AI编程Agent的核心组件——Harness(执行引擎),通过分析四个代表性开源项目(OpenAI CodexCLI、xAI GrokBuild、NousResearch HermesAgent、EarendilWorks Pi)的设计哲学,揭示了不同Agent在安全模型、执行引擎、工具系统和状态管理等方面的差异化设计。文章指出,Harness是Agent的"隐藏护城河",决定了模型能力的实际发挥效果。CodexCLI以安全至上,GrokBuild专注结构化工作空间,He

2026-08-13 00:44:53 3250

原创 我拆了一个 Agent 仓库,发现真正难的从来不是让 AI 会写代码

本文通过对Wordless项目的技术解析,揭示了智能体(Agent)开发的核心挑战:真正困难的不在于让AI生成代码,而在于构建完整的任务执行体系。作者指出,智能体的关键区分在于"run.completed"和"session.idle"两种状态,前者仅表示AI输出结束,后者则要求完成持久化、重试、上下文压缩等完整工作流。文章深入剖析了Wordless架构中的权限系统、事件协议、本地数据库和恢复机制等关键技术设计,强调优秀的工作流智能体需要具备精确的上下文引用、模块化结

2026-08-12 00:09:48 3059

原创 Grok Build 不是一个聊天框,它更像一套 AI 编程工作系统

《GrokBuild:重新定义终端AI编程助手的工作范式》 SpaceXAI推出的GrokBuild颠覆了传统AI编程助手的交互模式,将终端转变为智能化工作台。区别于简单的代码补全工具,该系统通过全屏TUI界面实现:实时展示代码差异、命令输出和思考过程;支持多代理协作(主代理+探索/计划子代理);内置跨会话记忆系统和项目知识库;提供MCP服务接口实现GitHub等第三方平台集成。其创新性体现在将AI任务从单次问答升级为可持续工作流,包含沙箱安全机制、权限分层控制和结构化输出能力,支持headless模式接入

2026-08-09 14:53:58 3127

原创 这个AI编程 Agent,为什么故意不做计划模式?

最近我在本地翻一个叫 Pi 的仓库,看到 README 里一段话时,停了一下。它明确写着,Pi 不内置子代理,不内置计划模式,不内置待办列表,也不提供后台 Bash,甚至连 MCP 都没有放进核心。这就有点反常了。现在大家都在给 AI 编程工具加功能,恨不得打开之后直接替你拆需求、做计划、派任务、跑测试、发 PR,Pi 为什么反而主动少做?我把这个仓库的 README、包结构和最近几条提交过了一遍,越来越觉得,它不是一个功能不够多的 AI 编程工具,而是故意把一部分空白留给了你。

2026-08-09 14:37:07 3074

原创 别急着选最会写代码的 AI:拆开 Pi、Codex 与 Grok Build 后,我看见了三条完全不同的工程路线

同样在终端里输入一句「帮我修这个 bug」,Pi、Codex 和 Grok Build 表面上都会开始读文件、跑命令、改代码。可一旦把仓库打开,事情就没那么像了。Pi 更像一套可以拆开重组的乐高底板:它把多模型适配、Agent 循环、终端 UI、会话存储和编码助手拆成独立包,默认功能很克制,计划模式、子代理、权限门都留给扩展作者决定。Codex 更像一辆已经装好安全带、仪表盘和行车记录仪的量产车:Rust 核心、线程会话、审批策略、执行策略、沙箱和 App Server 被组织成一条受治理的执行链。

2026-07-29 15:09:45 3201

原创 别再只招“会干活的人”了:未来公司会把员工蒸馏成 Skill,把工作变成 Agent SOP

《企业数字化转型的痛点:从"人脑依赖"到"知识蒸馏"》 摘要: 本文揭示了当前企业数字化转型中的核心矛盾——组织知识过度依赖个体经验。当关键员工离职或休假,企业常陷入"组织失忆"状态。作者提出"知识蒸馏"解决方案,通过将员工经验拆解为可执行的Skill(能力胶囊)和AgentSOP(协作剧本),实现组织知识的资产化沉淀。文章详细阐述了从人肉操作到自动化系统的五步蒸馏法,强调真正的转型不是简单文档数字化,而是构建可验证、可迭代的工

2026-07-23 23:08:51 3204

原创 我以为 Agent 会自己变强,结果它只会“假装成功”:拆开 Evolver 才懂自进化有多难

我回头看自己两年前的 Agent 项目,简直不忍直视。那时候我们把成功定义成“模型说 OK”,把记忆定义成“多写几段 Markdown”,把进化定义成“下次 prompt 更长一点”。然后系统一天天变得更像一个会说话的垃圾桶。Evolver 给我最大的震撼不是某个算法多酷,而是它反复逼问三件事:你看到的信号是真信号吗?你做的改变有爆炸半径证据吗?你沉淀的经验经得起验证命令和法律般的协议约束吗?这三问一出,很多“自进化”demo 当场原形毕露。

2026-07-23 22:59:20 3000

原创 你的 AI 还在陪你聊天?WorkBuddy 已经学会“组队打工”了:一次扒光它的技术骨架

本文通过对开源项目《WorkBuddy实战蓝皮书》的深度剖析,揭示了一款突破性AI办公工具的核心架构与设计哲学。不同于传统聊天机器人,WorkBuddy构建了一个"自然语言→工作产物"的完整执行系统,其创新性主要体现在: 系统架构上采用五层分工:模型(大脑)、Agent(调度员)、Skill(专家手册)、工具接口(手脚)和人类(裁判),通过MCP协议实现工具即插即用。 独创渐进式Skill机制,将行业知识和工作流封装为可复用单元,避免提示词污染,支持知识精馏将书籍转化为可触发执行的专业技

2026-07-12 21:05:20 3739

原创 你给AI Agent装的“技能包“,可能正在偷你的密钥——SkillSpector源码深度解析

摘要: AI技能安全扫描器SkillSpector由NVIDIA开源,用于检测AIAgent技能中的安全风险。研究发现26.1%的技能存在漏洞,5.2%疑似恶意。工具采用两阶段分析:静态模式匹配(高召回率)和LLM语义评估(高精度),覆盖68种漏洞类型,包括代码注入、数据外泄等。支持多格式输入输出,集成CVE查询,并基于LangGraph构建并行分析流水线。设计遵循“宁可误报不漏报”原则,提供风险评分与安装建议,适用于CI/CD集成和运行时防护,为AI生态安全提供新思路。

2026-06-27 12:18:05 3242

原创 当 AI 学会自己整理笔记:拆解 LLM Wiki,一个会“自我生长“的知识库

层级技术选择为什么桌面框架Tauri v2(Rust 后端)轻量、安全、跨平台,Rust 处理文件 I/O 和解析速度快前端生态成熟,类型安全,Vite 开发体验极佳UI 组件不锁定组件库,样式可定制性强编辑器Milkdown(ProseMirror 内核)WYSIWYG 编辑,支持数学公式插件图谱可视化性能好,支持力导向布局,交互流畅向量数据库LanceDB(Rust 嵌入式)可选模块,Rust 原生,与 Tauri 后端天然契合状态管理Zustand。

2026-06-27 12:01:55 3787

原创 生图还在“盲盒抽卡”?起底 BigBanana Canvas:如何用 Next.js + SSE + MCP 协议,让 AI 在无限画布上“指点江山”!

在过去,AI 助手(如 Claude、ChatGPT)只能在它们自己的黑乎乎的终端或聊天框里生存。它们想了解你的项目状态,你得复制粘贴代码给它;它们想帮你改代码,只能吐出一段 Diff 让你手动应用。Anthropic 推出的MCP(模型上下文协议)彻底打破了这堵墙。MCP 就像是 AI 时代的“USB 接口规范”。

2026-06-21 19:51:38 6956

原创 我把 AI 画布项目“拆到螺丝级”:Infinite Canvas 如何把 Next.js、localForage、多模型生成与本地 Agent 组装成一条可用生产线

《无限画布:重构AI创作的工作流与上下文治理》探讨了一个突破性的创作工具设计理念。文章指出传统AI创作流程存在严重的上下文断裂问题,而infinite-canvas项目通过节点化编排、状态管理和自动化整合,构建了一个完整的创作操作系统。其核心创新在于: 采用五层架构(前端交互、本地数据、AI调用、可选同步、Agent系统)实现灵活扩展 将创作过程建模为可序列化的节点图结构 开发丝滑的交互内核(视口变换、历史合并、子图复制等) 设计统一的生成引擎和媒体存储策略 独创在线Agent与本地Agent双系统协作模式

2026-06-20 23:54:48 7014

原创 深入 OpenAI Codex:揭秘本地代码 Agent 的三大核心设计

本文深入分析了OpenAI Codex本地运行Agent的设计亮点,重点剖析了其三大核心机制:1)跨平台沙箱系统,通过精细的权限控制实现安全防护;2)Skill技能注入系统,支持模块化扩展;3)Thread对话模型,实现状态管理与回滚功能。文章特别强调Codex将安全性作为基础设计原则,而非后期补丁,展示了最小权限控制、动态执行策略等创新实现。作者还总结了三个开发建议:安全优先架构、Prompt版本化管理、确保系统可观察性,为AI Agent开发者提供了宝贵参考。

2026-06-16 19:09:31 8999

原创 踩坑两周:我如何把图片PPT变成真正可编辑的PPTX引入:一个让人崩溃的需求

《从图片PPT到可编辑文档:一个工程师的自救之路》 摘要:本文记录了一位工程师如何从零开发SlideAlchemy工具,解决图片PPT转换难题的过程。面对市面上工具存在的伪可编辑、过度切割和视觉失真等问题,作者创新性地提出"组件化重建策略":将PPT元素分为简单几何、语义图标和复杂合成三类分别处理,通过11步工作流实现高质量转换。文章详细剖析了干净背景生成、元素分类、PNG重新生成等核心技术难点,并分享了"重建而非裁剪"的核心设计理念。该项目不仅解决了实际工作中的痛点

2026-06-16 19:05:00 8798

原创 同样叫 OpenClaw,为什么 .NET 版和原生版根本不是一回事

OpenClaw.NET与原生OpenClaw的核心差异在于工程哲学而非语言层面。原生版本侧重动态生态的TS/JS插件扩展,强调生态原味;而OpenClaw.NET作为.NET原生平台,重构了Agent系统的实现方式,突出NativeAOT友好、显式诊断、运维治理等特性。二者在兼容策略(实用兼容vs全量兼容)、运行模式(AOT/JIT分车道)、平台形态(生态中心vs一体化平台)等方面存在显著差异。选择时需评估团队技术栈:深度TS/JS生态选原生版,注重.NET工程化落地的选OpenClaw.NET。本质上,

2026-05-31 12:38:18 11501

原创 别再把 Agent 当聊天玩具了:我把 OpenClaw.NET 啃了一遍,看到一套能跑进生产环境的 .NET AI 基建

如果你问我,OpenClaw.NET 最打动我的地方是什么。不是它工具多。不是它渠道多。甚至也不是它会不会接某个最新模型。而是它在很多关键地方体现出一种很稀缺的工程判断,知道什么能力应该进核心,什么能力应该做成可选,什么地方必须 fail fast,什么地方该把合同写清楚。今天很多 Agent 项目都在讨论“让 AI 更聪明”,OpenClaw.NET 讨论的是另一件同样重要的事,怎么让系统更可靠、更可控、更能承担现实责任。这两者当然都重要。

2026-05-31 11:48:09 11336

原创 我养了一只会“自学“的AI Agent:拆解Hermes Agent的“闭环进化术“,看完才知道Agent还能这么写

它不是一个一次性消耗品,而是一个会跟你一起变老的伙伴。它会记得你说过的话,会从你们的相处里总结小窍门,会在凌晨默默整理自己的笔记,会在你换app时悄悄跟过来,会在你不需要它时安静地睡觉。这种"持续陪伴感",是当前大多数Agent产品稀缺的。如果你正在做Agent项目,强烈建议把Hermes的源码当一本"反模式参考书"来读——它在你将要踩的每一个坑前,都留了一个写着"前方有坑,已填埋,附图"的小路标。hermes剩下的,让它自己长大就好。"Hermes,希腊神话里那位脚踩飞鞋的信使之神。

2026-05-18 14:17:05 14382

原创 当AI学会了自己写代码:深入拆解OpenAI Codex CLI的Rust架构设计与工程哲学

OpenAI CodexCLI:一个基于Rust的安全AI编程代理 摘要: OpenAI推出的CodexCLI是一个开源的本地AI编程代理,能够理解自然语言指令并自主执行代码修改、命令运行等开发任务。该项目采用Rust构建,包含100+个精心设计的crate,实现了多层安全架构: 核心特性: 支持交互式TUI、无头执行等多种使用模式 内置完整的沙箱系统(Linux/macOS/Windows平台原生隔离) 集成Model Context Protocol(MCP)实现工具生态扩展 技术亮点: 使用Rust实

2026-05-18 14:02:57 14770

原创 当 AI 长出了手脚:深度解析 Hermes Agent 的「工具调用宇宙」

有个不起眼但很贴心的细节:当预算用完时,系统会给模型一次额外的最终调用机会),但这次不允许再使用工具,只能输出文字。这样即使任务没完全完成,模型也能礼貌地告知用户当前进度,而不是突然断电般消失。一是"防御性"贯穿始终。从防管道崩溃,到护栏系统防模型无限循环,再到 prompt 注入扫描,处处体现出"假设一切都会出错"的工程心态。这不是悲观主义,这是经验。二是"抽象边界"的坚守。

2026-05-11 10:20:45 14759

原创 你的AI是怎么学会新技能的?深挖ClawHub这台“技能自动贩卖机“的底层密码

回到文章开头的那个场景——你的 AI 助手突然学会了点咖啡。这背后发生的一切,本质上是 ClawHub 这台"技能自动贩卖机"在默默运转:有人在某个角落写好了技能文件,上传到注册表;向量搜索引擎把它编入了语义索引;安全扫描确认它没有问题;你的 AI 通过 CLI 发现了这个新技能,下载、安装、生效。整个过程快到你几乎感知不到,但每一步都有扎实的工程底座在支撑。AI 的能力边界,不只取决于模型有多大,还取决于生态有多开放、分发有多高效、信任有多牢固。

2026-05-11 09:42:55 14458

原创 别再把 AI Agent 当“会聊天的脚本”:Hermes Agent 源码级拆解(架构、框架、实战、趋势,一文吃透)

不是在谈“模型参数有多大”,也不是在谈“能连多少 API”。我们真正该谈的是:它能否稳定运行?能否长期进化?能否被团队协作?能否在成本与风险之间找到平衡?Hermes Agent 的源码给出了一个很务实的答案:把 Agent 当系统工程做,而不是当提示词魔法做。这也是它最值得技术人深入研究的地方。这不是一篇“AI Agent 入门科普”,而是一篇“源码级工程拆解”。从。

2026-05-06 22:40:31 14584

原创 我认真拆了一个开源 Agent 项目后,发现下一代效率工具已经不是“聊天机器人”了

这两年,大家都在讲 AI Agent。但说实话,市面上很多所谓的 Agent,本质上还是“套了工具的大模型聊天框”。它能回答问题,能写代码,能生成内容,可一旦你关掉页面、换个设备、切个工作场景,它往往又回到“重新认识你”的起点。最近我认真看了一个开源项目,叫 Hermes Agent。越往里看,我越确定一件事:未来真正有竞争力的 Agent,不会只是一个会聊天的入口,而会成为一个长期在线、跨场景协作、不断积累经验、还能持续进化的数字执行体。而 Hermes Agent,已经把这条路走得很清楚了。

2026-05-01 17:15:35 14256

原创 我用唐朝的三省六部制,重新设计了 AI 多 Agent 协作架构——然后 CrewAI 和 AutoGen 在我眼里都不香了

摘要:本文介绍了一种受唐朝三省六部制启发的多Agent系统架构设计,解决了传统多Agent系统缺乏审核机制导致的混乱问题。系统包含12个具有明确职责的Agent,其中"门下省"作为质量守门员强制审核所有方案,不合格则直接驳回。作者详细阐述了状态机设计、双通道事件总线、崩溃恢复机制等关键技术实现,以及标题清洗、SOUL.md规范等细节优化。该架构通过制度化的审核流程和清晰的责任划分,显著提升了多Agent协作的可靠性和可观测性,为复杂任务处理提供了新的解决方案思路。

2026-03-15 15:59:56 12934

原创 地铁上也能写代码?这个开源项目让AI编程助手装进浏览器

WebCode是一个开源的在线AI编程平台,让开发者通过浏览器就能使用ClaudeCode、Codex等AI助手。它解决了三大痛点:1)移动端紧急修bug;2)轻设备远程开发;3)多AI工具切换。核心功能包括实时流式输出、会话恢复、隔离工作区、移动端适配和代码高亮预览。采用Docker一键部署,支持BlazorServer等技术栈。项目开源活跃,未来计划增加更多AI工具支持。旨在打破设备限制,实现随时随地AI编程。

2026-02-04 23:26:07 11526

原创 开源神器!一句话生成完整短剧,从剧本到成片全自动化

摘要:BigBananaAIDirector是一款开源AI视频生成工具,采用工业化工作流解决传统AI视频的痛点。其核心创新包括关键帧驱动技术确保画面连贯性、角色一致性系统避免"变脸"问题,以及四阶段标准化流程(剧本分镜-资产生成-导演工作台-成片导出)。工具支持本地部署,深度集成多款主流AI模型,提供从创意到成片的一站式解决方案,特别适合短剧/漫剧创作者。项目开源地址:https://github.com/shuyu-labs/BigBanana-AI-Director

2026-02-04 22:51:58 10841

原创 第 1 章:认识 Claude Code

《ClaudeCode编程助手入门指南》摘要 ClaudeCode是一款AI编程助手,能帮助用户完成写代码、解释代码、调试错误、优化代码和解答编程问题等任务。它特别适合编程初学者、在校学生、自学者和有经验的开发者使用。与传统代码编辑器不同,ClaudeCode能主动提供编程建议和学习指导,就像一个随时可咨询的编程老师。使用ClaudeCode可以显著提升学习效率、代码质量和开发信心,但用户仍需保持独立思考,将其作为学习辅助工具而非替代品。本章详细介绍了ClaudeCode的功能特点、适用场景和正确使用方法,

2026-01-31 21:12:22 11493

原创 Claude Code 完整学习计划

《ClaudeCode零基础学习指南》摘要:本教程为编程新手提供9章循序渐进的学习路径,从基础安装到高级功能应用。课程特色包括:1)30分钟快速入门;2)核心聊天功能与Spec开发方法;3)Hooks自动化与Steering规则定制;4)三个难度递增的实战项目。建议每天学习1-2小时,配套练习和进度清单帮助巩固知识。完成学习后,用户将能独立使用ClaudeCode进行项目开发,并通过AI交互解决学习难题。(149字)

2026-01-31 21:10:00 11583

原创 WebCode 与 Clawdbot 项目深度对比分析

项目WebCodeClawdbot定位在线 AI 全能工作平台(Web)个人 AI 助手框架(CLI/Gateway)核心技术架构风格分层架构 + DDDGateway-Channel-Agent 三层架构主要功能远程驱动 AI CLI 助手多渠道消息统一接入 + AI Agent 交互目标用户需要 Web 远程控制的开发者需要全平台 AI 助手的个人用户许可证AGPLv3MIT差异维度WebCodeClawdbot架构理念Web 驱动 CLI技术栈扩展性适配器模式插件系统生态。

2026-01-26 21:15:46 11899

原创 当 AI 助手遇上全平台消息:Clawdbot 的架构奇遇记

如何让 AI 助手真正融入我们的日常工作流。无缝集成:在你已经使用的消息平台上直接与 AI 交互,无需切换应用隐私保护:所有数据都存储在本地,你完全掌控自己的信息高度可定制:从模型选择到工具配置,从人格设定到技能扩展,一切都可以按需调整跨设备协同:手机、电脑、平板,所有设备都可以成为 AI 助手的"手脚"开放生态:插件系统、技能系统、Hooks 系统,为社区创新提供了无限可能本地优先 vs 云服务:在隐私日益重要的今天,本地运行的 AI 助手可能是更好的选择。

2026-01-26 18:02:45 11913

原创 当AI编程工具遇上“配置地狱“:一个开发者的自救指南

回到文章开头的场景,ACP带来了什么改变?Before ACP❌ 每次切换工具都要重新配置❌ 配置散落在各处,难以管理❌ 团队成员配置不一致❌ 优秀配置无法复用After ACP✅ 一次配置,到处运行✅ 统一管理,版本控制✅ 团队标准化,一键同步✅ 社区共享,持续改进AI编程工具正在改变软件开发的方式,但工具的碎片化也带来了新的问题。ACP的出现,让我们看到了解决这个问题的可能性。当遇到重复性问题时,不要忍受,而是创造工具去解决它。这正是开源精神的体现:发现问题、解决问题、分享方案。

2026-01-25 22:27:48 12120

原创 踩坑三天,我终于搞懂了如何让多个AI助手在浏览器里“和平共处“

本文分享了将多个AI编程助手CLI工具整合到Web平台时遇到的架构挑战与解决方案。主要难点包括:1)不同CLI工具输出格式差异,采用适配器模式统一处理;2)会话恢复功能实现,通过三层存储架构管理会话状态;3)移动端适配问题,解决Safari视口高度计算;4)性能优化,使用防抖、虚拟滚动等技术提升流式输出体验;5)工作区隔离,为每个会话创建独立目录。文章总结了分层解耦的架构设计思想,强调从"能用"到"好用"的渐进式优化过程,并给出适配器模式、依赖注入等实用建议。

2026-01-23 22:38:13 15763

原创 当 AI 学会“造沙箱“:OpenSandbox 如何让大模型安全地执行代码

阿里巴巴开源OpenSandbox:AI代码执行的"安全游乐场" 随着AI编程助手的普及,如何安全执行AI生成的代码成为关键问题。OpenSandbox提供了一套开源解决方案,其核心特点包括: 四层架构设计: SDK层:多语言支持 Specs层:定义API规范 Runtime层:支持Docker/K8s Sandbox实例:独立容器环境 创新技术亮点: 无侵入式execd注入机制 集成Jupyter多语言内核 智能过期清理系统 精细网络隔离策略 核心优势: 开源可控 数据自主 国内友好部

2026-01-23 22:13:34 16171

原创 当 AI Agent 遇上 .NET:一场关于智能体架构的技术探险

说实话,市面上的 Agent 框架已经多到让人眼花缭乱了。LangChain、AutoGPT、AgentGPT……每个都号称能"改变世界"。但当你真正想把它们用到生产环境时,往往会发现:要么太简单,只能跑个 Demo;要么太复杂,学习曲线陡峭得像珠穆朗玛峰。Kode Agent SDK 的出现,像是在这片混乱中投下了一颗"定心丸"。它不是那种"炫技式"的框架,而是实实在在为 .NET 生态打造的生产级 AI Agent 运行时。

2026-01-20 17:04:25 11928 1

原创 BotSharp 入门教程-第03章-快速启动

本文介绍了BotSharp项目的克隆、启动、测试和调试流程。主要内容包括: 项目克隆 选择合适的存放路径(避免中文/空格) 使用git clone命令克隆项目 解决常见克隆问题(网络、路径、速度等) 项目启动 配置LLM提供商(OpenAI等) 通过Visual Studio或命令行启动 验证启动成功(端口监听、Swagger UI) 常见启动错误排查(端口占用、SDK版本等) API测试 使用Postman/curl/Swagger测试API 完整测试流程:创建对话→发送消息→完成订单 错误响应分析与处理

2026-01-20 11:34:20 15690

原创 从“手机上写代码“的疯狂想法,到一套完整的AI编程平台架构——WebCode深度技术剖析

本文分享了作者开发移动端AI编程助手的实战经验。从最初"套壳"的简单需求出发,逐步深入解决适配不同CLI工具、流式输出处理、工作区隔离等核心难题。文章重点介绍了适配器模式的设计、智能上下文管理系统、移动端特殊问题处理等关键实现方案,展现了从零设计分布式AI编程平台的完整思考过程。作者通过性能优化、安全防护等多维度实践,将产品从"能用"提升到"好用"状态,并展望了多模型对比、实时协作等未来发展方向。全文生动呈现了一个看似简单需求背后复杂的技术挑战和解

2026-01-20 11:09:24 11355

原创 当AI学会拍短剧:Huobao Drama全栈AI短剧生成平台深度解析

《AI短剧制作革命:HuobaoDrama项目技术解析》摘要 本文介绍了一个创新的开源项目HuobaoDrama,它利用AI技术实现了从创意到完整短剧的全流程自动化制作。该项目采用Go+Vue3全栈架构,集成OpenAI、Gemini等AI服务,具备剧本生成、角色设计、分镜拆解、视频合成等核心功能。技术亮点包括:DDD领域驱动设计的多层架构、统一抽象的AI服务接口、智能分镜生成算法、基于FFmpeg的专业视频处理,以及支持多语言的现代化前端。项目通过SQLite+WAL模式解决并发问题,采用多阶段Docke

2026-01-19 11:52:19 12310 1

原创 当AI学会炒股:揭秘VibeAlpha Terminal如何用大模型重新定义金融分析

回到开头的问题:为什么要做VibeAlpha?因为我懒。但这种"懒",其实是一种对效率的极致追求。程序员的天职,就是用代码消灭重复劳动。如果一件事要做两遍,就应该写个脚本;如果一件事要做一百遍,就应该做成系统。VibeAlpha就是这种思想的产物。它不完美,但它真的能用。每天早上,我打开电脑,一份热乎的盘前报告已经躺在那里等我了。这种感觉,比赚钱还爽。项目地址技术栈欢迎Star、Fork、提Issue!更多AIGC文章RAG技术全解:从原理到实战的简明指南更多VibeCoding文章。

2026-01-19 10:33:58 11332

原创 地铁上也能写代码?这个开源项目让AI编程助手装进了你的手机

技术选型理由服务端渲染+SignalR实时通信,完美支持流式输出成熟的企业级UI组件库,开箱即用VS Code同款编辑器内核,专业级代码展示轻量级ORM,支持多数据库切换Docker一键部署,环境隔离你可能会问:为什么选Blazor而不是React/Vue?我觉得这是一个非常务实的选择。Blazor Server模式的最大优势是——所有代码都在服务端运行。前后端天然统一:不需要写两套代码、处理CORS、维护API接口实时通信开箱即用:SignalR自动管理WebSocket连接流式输出天然支持。

2026-01-17 22:08:38 15965

BigBanana AI Director (AI 漫剧工场)

AI 一站式短剧/漫剧生成平台 Industrial AI Motion Comic & Video Workbench 中文 English 日本語 License: CC BY-NC-SA 4.0 BigBanana AI Director 是一个 AI 一站式短剧/漫剧平台,面向创作者,实现从灵感到成片的高效生产。 它摇弃了传统的"抽卡式"生成,采用 "Script-to-Asset-to-Keyframe" 的工业化工作流。通过深度集成 AntSK API 的先进 AI 模型,实现 "一句话生成完整短剧,从剧本到成片全自动化",同时精准控制角色一致性、场景连续性与镜头运动。 界面展示 项目管理 项目管理 Phase 01: 剧本与分镜 剧本创作 剧本与故事 Phase 02: 角色与场景资产 角色场景 场景 Phase 03: 导演工作台 导演工作台 镜头九宫格 镜头与帧 镜头与帧1 Phase 04: 成片导出 成片导出 提示词管理 提示词管理 核心理念:关键帧驱动 (Keyframe-Driven) 传统的 Text-to-Video 往往难以控制具体的运镜和起止画面。BigBanana 引入了动画制作中的 关键帧 (Keyframe) 概念: 先画后动:先生成精准的起始帧 (Start) 和结束帧 (End)。 插值生成:利用 Veo 模型在两帧之间生成平滑的视频过渡。 资产约束:所有画面生成均受到“角色定妆照”和“场景概念图”的强约束,杜绝人物变形。 核心功能模块 Phase 01: 剧本与分镜 (Script & Storyboard) 智能剧本拆解:输入小说或故事大纲,AI 自动拆解为包含场次、时间、气氛的标准剧本结构。 视觉化翻译:自动将文字描述转化为专业的 Midjourney/Stable Diffusion 提示词。 节奏控

2026-02-11

AntSK0.6.6 一件部署包,可以快速实现本地RAG知识库

AntSK功能介绍 基于.Net9+AntBlazor+SemanticKernel 打造的AI知识库/智能体 核心功能 语义内核 (Semantic Kernel):采用领先的自然语言处理技术,准确理解、处理和响应复杂的语义查询,为用户提供精确的信息检索和推荐服务。 内存内核 (Kernel Memory):具备持续学习和存储知识点的能力,AntSK 拥有长期记忆功能,累积经验,提供更个性化的交互体验。 知识库:通过文档(Word、PDF、Excel、Txt、Markdown、Json、PPT)等形式导入知识库,可以进行知识库问答。 GPTs 生成:此平台支持创建个性化的GPT模型,尝试构建您自己的GPT模型。 API接口发布:将内部功能以API的形式对外提供,便于开发者将AntSK 集成进其他应用,增强应用智慧。 API插件系统:开放式API插件系统,允许第三方开发者或服务商轻松将其服务集成到AntSK,不断增强应用功能。 .Net插件系统:开放式dll插件系统,允许第三方开发者或服务商轻松将其业务功能通过标准格式的代码生成dll后集成到AntSK,不断增强应用功能。

2025-10-06

AntSK0.6.5 一件部署包,可以快速实现本地RAG知识库

AntSK功能介绍 基于.Net9+AntBlazor+SemanticKernel 打造的AI知识库/智能体 核心功能 语义内核 (Semantic Kernel):采用领先的自然语言处理技术,准确理解、处理和响应复杂的语义查询,为用户提供精确的信息检索和推荐服务。 内存内核 (Kernel Memory):具备持续学习和存储知识点的能力,AntSK 拥有长期记忆功能,累积经验,提供更个性化的交互体验。 知识库:通过文档(Word、PDF、Excel、Txt、Markdown、Json、PPT)等形式导入知识库,可以进行知识库问答。 GPTs 生成:此平台支持创建个性化的GPT模型,尝试构建您自己的GPT模型。 API接口发布:将内部功能以API的形式对外提供,便于开发者将AntSK 集成进其他应用,增强应用智慧。 API插件系统:开放式API插件系统,允许第三方开发者或服务商轻松将其服务集成到AntSK,不断增强应用功能。 .Net插件系统:开放式dll插件系统,允许第三方开发者或服务商轻松将其业务功能通过标准格式的代码生成dll后集成到AntSK,不断增强应用功能。

2025-06-22

AntSK0.6.2 一件部署包,可以快速实现本地RAG知识库

AntSK功能介绍 基于.Net8+AntBlazor+SemanticKernel 打造的AI知识库/智能体 核心功能 语义内核 (Semantic Kernel):采用领先的自然语言处理技术,准确理解、处理和响应复杂的语义查询,为用户提供精确的信息检索和推荐服务。 内存内核 (Kernel Memory):具备持续学习和存储知识点的能力,AntSK 拥有长期记忆功能,累积经验,提供更个性化的交互体验。 知识库:通过文档(Word、PDF、Excel、Txt、Markdown、Json、PPT)等形式导入知识库,可以进行知识库问答。 GPTs 生成:此平台支持创建个性化的GPT模型,尝试构建您自己的GPT模型。 API接口发布:将内部功能以API的形式对外提供,便于开发者将AntSK 集成进其他应用,增强应用智慧。 API插件系统:开放式API插件系统,允许第三方开发者或服务商轻松将其服务集成到AntSK,不断增强应用功能。 .Net插件系统:开放式dll插件系统,允许第三方开发者或服务商轻松将其业务功能通过标准格式的代码生成dll后集成到AntSK,不断增强应用功能。

2025-03-04

AntSK免安装部署版(需要.net 8 SDK环境)

AntSK是一个可以运行本地/在线大模型的 AI知识库项目

2025-01-13

AntSK0.5.1 一件部署包,可以快速实现本地RAG知识库

AntSK功能介绍 基于.Net8+AntBlazor+SemanticKernel 打造的AI知识库/智能体 核心功能 语义内核 (Semantic Kernel):采用领先的自然语言处理技术,准确理解、处理和响应复杂的语义查询,为用户提供精确的信息检索和推荐服务。 内存内核 (Kernel Memory):具备持续学习和存储知识点的能力,AntSK 拥有长期记忆功能,累积经验,提供更个性化的交互体验。 知识库:通过文档(Word、PDF、Excel、Txt、Markdown、Json、PPT)等形式导入知识库,可以进行知识库问答。 GPTs 生成:此平台支持创建个性化的GPT模型,尝试构建您自己的GPT模型。 API接口发布:将内部功能以API的形式对外提供,便于开发者将AntSK 集成进其他应用,增强应用智慧。 API插件系统:开放式API插件系统,允许第三方开发者或服务商轻松将其服务集成到AntSK,不断增强应用功能。 .Net插件系统:开放式dll插件系统,允许第三方开发者或服务商轻松将其业务功能通过标准格式的代码生成dll后集成到AntSK,不断增强应用功能。

2024-09-30

AntSK0.5.0 一件部署包,可以快速实现本地RAG知识库

AntSK功能介绍 基于.Net8+AntBlazor+SemanticKernel 打造的AI知识库/智能体 核心功能 语义内核 (Semantic Kernel):采用领先的自然语言处理技术,准确理解、处理和响应复杂的语义查询,为用户提供精确的信息检索和推荐服务。 内存内核 (Kernel Memory):具备持续学习和存储知识点的能力,AntSK 拥有长期记忆功能,累积经验,提供更个性化的交互体验。 知识库:通过文档(Word、PDF、Excel、Txt、Markdown、Json、PPT)等形式导入知识库,可以进行知识库问答。 GPTs 生成:此平台支持创建个性化的GPT模型,尝试构建您自己的GPT模型。 API接口发布:将内部功能以API的形式对外提供,便于开发者将AntSK 集成进其他应用,增强应用智慧。 API插件系统:开放式API插件系统,允许第三方开发者或服务商轻松将其服务集成到AntSK,不断增强应用功能。 .Net插件系统:开放式dll插件系统,允许第三方开发者或服务商轻松将其业务功能通过标准格式的代码生成dll后集成到AntSK,不断增强应用功能。

2024-08-22

Deep Learning Tutorial

人工智能学习文档 Deep Learning Tutorial 适合新手学习

2017-12-13

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除