自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(645)
  • 收藏
  • 关注

原创 10 分钟读懂 8 种主流 Agent 架构

ReAct解决“下一步根据刚才的结果怎么走”。解决“复杂目标怎样先拆清楚再执行”。Multi-Agent 与 Reflection分别解决“由谁协作”和“如何修正质量”。分别提供“行动、证据、状态”三类能力。把这些能力持续调度起来,但必须由预算、权限、停止条件和人工接管约束。简单任务优先走更短、更可控的链路;只有问题确实存在时,才增加循环、记忆或多 Agent。

2026-08-14 10:24:21 331

原创 第 2 章 — 项目工程结构:Monorepo、模块划分与构建体系

第 2 章 — 项目工程结构:Monorepo、模块划分与构建体系读完这章,你会清楚 OpenClaw 140 万行代码是如何组织的——Monorepo 的分包策略、src/ 下每个核心模块的职责边界、extensions/ 与核心代码的隔离机制、以及构建工具链的选型逻辑。2.1 顶层目录结构先看 OpenClaw 仓库的顶层目录布局:openclaw/src/ # 核心代码,约 4,500 个非测试 TS 文件。

2026-07-24 14:12:12 354

原创 第 1 章 — OpenClaw 全景:从 Clawdbot 到 350K Stars

Bootstrap Files:Agent 每次启动时注入 System Prompt 的配置文件集合,包括 SOUL.md(人格)、AGENTS.md(路由规则)、TOOLS.md(工具说明)、USER.md(用户偏好)、IDENTITY.md(身份元数据)。增长速度背后是一个清晰的需求:工程师想要一个跑在自己机器上的 AI 助手,能通过已有的消息渠道(WhatsApp、Telegram、Slack)交互,而不是每次都打开一个新的网页。你可以在不同的任务中使用不同的模型,也可以配置故障转移策略。

2026-07-20 14:38:16 329

原创 CrewAI 制作智能体

CrewAI 制作智能体CrewAI 是一个多智能体协作的开源框架,专门用于编排和协调多个 AI Agent 进行协作。CrewAI 可以把一个复杂任务,拆成多个角色,各自负责一部分,通过流程协作完成。对比理解:单 Agent:一个大模型,从头干到尾CrewAI:产品经理 + 工程师 + 分析师 + 编辑,各司其职CrewAI 是一个协调、管理和框架化 AI Agent 的工具,它基于 LangChain 和 Pydantic 构建,用于促进角色扮演、自治和协作的 Agent 团队。

2026-06-22 10:59:18 216

原创 Agent 工程的成本控制:把 API 费用降下来的系统性方法

只返回前后各 1000 字,中间省略summary = content[:1000] + "\n...[内容已截断]...\n" + content[-1000:]优化四:历史压缩这是 02 篇讲过的 context 管理,这里给出具体实现:“”"保留最近 N 轮对话,其余压缩为摘要“”"return messages # 消息不多,不需要压缩# 需要压缩的历史# 用 LLM 压缩历史请将以下对话历史压缩为简洁的要点摘要(不超过 200 字):“”"

2026-06-01 15:46:50 347

原创 1.1 机器人发展历史与背景

传统的人工智能——比如你手机里的语音助手、ChatGPT——它们主要处理的是。

2026-05-27 17:33:32 526

原创 计算机网络

只有位于网络边缘部分的主机的协议栈才有运输层,和网络层不同,网络层是为主机之间提供逻辑通信,而运输层为应用进程之间提供通用的数据传输服务(端到端的服务)。运输层拥有流量控制(防止过载,即过多的数据注入到网络中),拥塞控制(抑制数据传输的速率)等功能,为上层协议提供端到端的可靠和透明的数据传输服务,上层服务用户不必关系通信子网的实现细节。传输层的任务是根据通信子网的特性,最佳的利用网络资源,为两个端系统的会话层之间,提供建立、维护和取消传输连接的功能,负责端到端的可靠数据传输。

2026-04-20 10:40:01 400

原创 基础 Web 知识

关于备案#不备案的影响#当你通过域名去访问境内服务器的 80 (http 默认端口) 和 443 (https 默认端口)时,如果该域名没有备案或者境内这台云服务器的云服务器商不知道你在别的服务商那里有备案的情况下,则会对请求进行拦截。对于访问 80 的请求,将会直接劫持 http 请求以重定向到他们的备案提示页面;对于访问 443 的请求,由于 https 没法被劫持,则会通过连接重置的方式阻止你访问。

2026-04-16 14:19:15 379

原创 100 个网络基础知识

您可以为计算机分配限制,例如允许访问的资源,或者可以浏览互联网的某一天的特定时间。这是因为互联网上的主机只能看到提供地址转换的计算机上的外部接口的公共 IP 地址,而不是内部网络上的私有 IP 地址。然而,随着越来越多的设备连接到它,它将无法有效地管理通过它的流量。相反,将 LAN连接到中转网络的网关创建了一个使用 IPSec 协议来保护通过它的所有通信的虚拟隧道。在这种设置中,一条电缆的数据传输引脚连接到另一条电缆的数据接收引脚,反之亦然。不知道正确的 IP 地址,甚至无法识别网络的物理位置。

2026-04-15 14:47:28 232

原创 计算机网络基础知识总结

传输层的任务是根据通信子网的特性,最佳的利用网络资源,为两个端系统的会话层之间,提供建立、维护和取消传输连接的功能,负责端到端的可靠数据传输。网络层中涉及众多的协议,其中包括最重要的协议,也是TCP/IP的核心协议——IP协议。随着互连网应用的不断扩大,原先的IPv4的弊端也逐渐暴露出来,即网络号占位太多,而主机号位太少,所以其能提供的主机地址也越来越稀缺,目前除了使用NAT在企业内部利用保留地址自行分配以外,通常都对一个高类别的IP地址进行再划分,以形成多个子网,提供给不同规模的用户群使用。

2026-04-15 14:37:41 340

原创 计算机网络基础知识

第四次:客户向服务器发送确认段,确认字号段有效(ACK=1),表示客户传输的数据序号是x+1(seq=x+1),表示客户期望接收服务器数据序号为y+1+1(ack_seq=y+1+1);第二次:服务器发回确认报文段,同意建立新连接的确认段(SYN=1),确认序号字段有效(ACK=1),服务器告诉客户端报文段序号是y(seq=y),表示服务器已经收到客户端序号为x的报文段,准备接受客户端序列号为x+1的报文段(ack_seq=x+1);客户端收到ACK段后,由FIN_WAIT_1进入FIN_WAIT_2;

2026-04-15 11:12:40 335

原创 域名系统DNS_基础知识

DNS采用层次树状结构,由多个分量组成,如顶级域名(如.com或.cn)位于最右侧。域名长度限制为255个字符,各级域名由相应管理机构监管,顶级域名由ICANN管理。DNS分为国家顶级域名、通用顶级域名和反向域等。域名解析涉及根域名、顶级域名及权限域名服务器,通过递归和迭代查询完成。递归查询是主机找本地域名服务器,本地域名服务器找根域名服务器,类似于A找B,B找C,C找D,以此类推。迭代查询是,类似于A找B,B给A,C的电话号码,A找C,C告诉A,D的电话号码,A找D,以此类推。(一) 顶级域名的分类。

2026-04-15 10:42:44 68

原创 大语言模型应用实战:FastAPI与RAG智能文档问答系统构建|附教程文档

本文将引导您一步步构建一个基于FastAPI的RAG(检索增强生成 )系统。我们会先梳理RAG的核心概念与FastAPI的优势,随后深入代码实现,打造一个能够接收PDF或TXT文档、对其内容进行索引、并回答用户问题的API服务。最后,我们还会探讨HTTP状态码的工程意义,并展望系统的优化方向。图片理解REST APIREST API 是一种接口,用于在客户端和服务器之间建立通信。REST API 是 Representational State Transfer API 的缩写。

2026-03-12 15:23:05 224

原创 FastAPI 教程

”“创建新用户,包含数据验证”“”# Pydantic 自动验证输入数据错误响应格式实例field: strcode: strerror: str))message="请求数据验证失败",).dict()).dict()FastAPI 特有概念自动文档生成实例title=“我的 API”,description=“这是一个示例 API,展示 FastAPI 的功能”,contact={

2026-03-12 11:49:44 429

原创 前后端基础知识总结

网页相关知识网页前端“三剑客”典型的网页一般是由HTML、CSS、JavaScript三种语言共同完成的,这三种语言常被称为网页前端“三剑客”​。HTML 相当于一个文档,它通过标签把信息进行编排和呈现;CSS 可以对这些文档进行修饰、美化,提升视觉效果;JavaScript 实现了网页和用户的互动。如果把页面比作一扇门,那么HTML是门板,CSS是色泽或花纹,JavaScript就是门的把手。HTML——网页的主体(HTML超文本标记语言)HTML 是超文本标记语言。之所以被称为“超文本”​,是因为它不仅

2026-03-11 17:38:02 264

原创 AI native Workspace 也许是智能体的下一阶段

它本质是编程智能体的图形界面版,让不懂编程的用户,用自然语言说出需求,再通过 AI 生成底层代码并执行,自动操作本地计算机完成任务。后来,向专业领域发展,演变出编程智能体(coding agent)、图像智能体、视频智能体等等,或者接入 MCP,获得外部应用操作能力,比如生成 Office 文件、操作浏览器。注意,由于它可以操作计算机,并跟互联网通信,执行之前,一定要指定目录,防止读写不该操作的目录,而且要有备份,防止原始文件被删改。大模型只是底层的处理引擎,你总是需要一个应用层产品,对接用户的需求。

2026-02-09 17:47:24 797

原创 tmux常用命令

下面按整理一份 tmux 常见命令速查(默认前缀键是Ctrl-b,下面用Prefix表示)。

2026-02-06 10:56:09 271

原创 前端知识:网页的某些功能突然点不开了

报错原因是 CDN 被断开,xlsx.full.min.js 没加载导致 XLSX is not defined。我已经改成本地加载,你只需要把文件放到服务器上即可。新增路由 xlsx.full.min.js 从本地路径读取。HTML 中的脚本改为 xlsx.full.min.js。

2026-02-05 15:38:36 145

原创 FastAPI 学习指南

FastAPI 是一个现代、快速(高性能)的 Python Web 框架,用于构建 API。它基于 Python 类型提示,支持异步编程,并自动生成交互式 API 文档。以下是学习 FastAPI 的关键内容和方法。通过以上内容,可以快速掌握 FastAPI 的核心功能并构建高效的 API 应用。

2026-01-28 17:23:59 392

原创 DeepSeek-OCR及其他主流OCR调研

DeepSeek-OCR原理DeepSeek-OCR模型,整个模型大小在3B。DeepSeek-OCR的提出,是为了探索,是否可以通过视觉模态进行文本信息的高效压缩,也就是把文档内容,用图像Token表示,其Token数量会远小于原始文本Tokens数,1w字,可能需要5000个Token,但用图像来表示,可能只需要512 个 Token。DeepSeek,是在想用图像视觉压缩文本。论文核心思想上下文光学压缩 (Contexts Optical Compression)当前LLM处理长文本

2026-01-23 16:11:36 933

原创 创建CUDA11.8环境部署DeepSeek-OCR

完整部署步骤:Linux下保留系统CUDA12.6,通过Conda创建CUDA11.8环境部署DeepSeek-OCR核心逻辑:利用Conda环境隔离性,在新环境中安装CUDA11.8 toolkit,系统CUDA12.6完全不受影响,所有依赖均在隔离环境内安装。步骤1:安装/验证Conda(Anaconda/Miniconda)如果已安装Conda,跳过此步;未安装则执行:wget https://repo.anaconda.com/miniconda/Miniconda3-latest-Linux-

2026-01-20 16:03:07 779

原创 本周热门论文Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition

该公式详细阐述了Qwen-Image-Layered模型中RGBA-VAE初始化阶段的关键步骤,即通过将编码器和解码器中处理新增Alpha通道的权重设置为零,同时将解码器中Alpha通道的偏置设置为1,从而在不影响原有RGB重建能力的前提下,将预训练的RGB VAE有效地扩展为能够统一处理RGB和RGBA图像的RGBA-VAE。这一策略确保了模型在多通道任务上的稳定性和性能。对于训练目标,我们结合使用了重建损失、感知损失和正则化损失。

2026-01-15 16:45:07 703

原创 Agent Skills 入门:把“公司 SOP + 工具脚本”封装成可复用技能,让 Agent 真正在你团队里干活

Anthropic 在 2025-10-16 的工程文章里把这个问题抽象成一个清晰的答案:把“可复用的流程知识”打包成 Skill 文件夹,由 Agent 动态发现 + 按需加载,把通用模型变成贴合你工作方式的专用 Agent。当然,Skill 也可以用来扩展 Agent 的工具、MCP 使用边界,通过文档与脚本,也可以教会 Agent 连接并使用特定的外部工具、MCP 服务。Agent 可通过加载不同的 Skills 包,来具备不同的专业知识、工具使用能力,稳定完成特定任务。

2026-01-07 14:15:01 492

原创 智能体技能 (Agent Skills)实践

🧩 可扩展设计:技能数据结构模块化,提供如 SkillSchema 和 SkillContext 等实现,便于扩展与定制。🤖 自主执行能力:智能体可根据技能定义,自主分析、规划并决策需调用的脚本与资源。🔍 技能管理支持:支持批量加载技能,并能根据用户输入自动检索与发现相关技能。沙箱环境将根据技能声明的依赖项自动安装所需依赖,无需手动配置。这种方法在提供全面技能能力的同时,最大限度地减少资源消耗。该方式提供安全的执行环境,可有效防止对宿主系统造成潜在危害。提供的安全沙箱执行(自动安装依赖、实现环境隔离)

2026-01-06 15:17:00 602

原创 大模型skill理解与实践

每条结论一句话行动项结构化“”“读取并总结PDF文档”“”# … 后续总结逻辑何时使用用户上传了一份文档(PDF、Word等)并要求分析其内容。用户的问题需要结合特定文档内容和外部最新信息来回答。用户要求对复杂主题进行多步骤调研和分析。如何调用确保用户已提供待分析的文档文件。将用户的分析请求和文档路径(或文件)作为参数。端点请求体示例 (JSON):{"query": "请总结这份文档的核心观点,并查找2024年关于文中‘存算一体’技术的最新商业新闻。",

2026-01-05 17:50:07 6611

原创 Linux下python matplotlib画图修改中文字体 (小方块)

在 Linux 环境下解决 matplotlib 绘图中文显示异常(乱码/方框)的问题,可通过以下步骤配置中文字体支持:完整解决方案。

2025-12-29 15:40:55 669

原创 paper阅读:Improving Language Understanding by Generative Pre-Training

公式L1U∑ilog⁡Pui∣ui−kui−1;Θ定义了无监督预训练阶段的语言模型目标函数,通过最大化每个词元在其前kkk个词元上下文条件下的对数概率之和,来训练神经网络模型Θ\ThetaΘ。这本质上是在最小化整个语料库的负对数似然,促使模型学习如何根据历史信息准确预测下一个词,从而捕获语言的内在结构和模式。

2025-12-18 11:30:26 1138

原创 LLM底层秘密—Transformer原理解析

语言模型的发展经历了从 BERT、GPT 到今天的多模态大模型的快速演进。传统 Transformer 在处理长文本、关键信息检索以及对抗幻觉等任务时,常常因过度关注无关上下文而陷入困境,导致模型表现受限。为解决这些问题,研究人员提出了多种改进方案,如 DIFF Transformer、Energy-Based Transformer 等新型架构。Transformer、MoE 灵活搭配成为主流,也逐渐有加入等新兴架构做混合架构的尝试,据不完全统计,超过一半新发布模型采用混合架构。这种架构创新也许可以打破

2025-12-09 15:11:52 1057

原创 CPU 基础

介绍完上述 CPU 的基本组件,我们由浅入深用一张现代 CPU 架构图作为本节内容的结尾。如下图所示的是一张英特尔酷睿 CPU 的架构图,从复杂的控制流程中,我们还是可以清晰的看到 ALU,MU 以及 CU 这些我们刚刚学习过的内容,当然读者朋友要是想设计这么一张架构图还是需要很多的知识储备的。

2025-12-08 17:00:27 995

原创 计算之比特位宽

在计算机科学中,整数和浮点数是两种基本的数据类型,它们在计算机中可以用不同长度的比特表示,也就是比特位宽,比特位宽决定了它们的表示范围和数据精度。下面我们一起回顾一下计算机中整数和浮点数的表示定义。

2025-12-04 14:30:29 903

原创 AI 芯片核心计算之矩阵乘

AI 模型中往往包含大量的矩阵乘运算,该算子的计算过程表现为较高的内存搬移和计算密度需求,所以矩阵乘的效率是 AI 芯片设计时性能评估的主要参考依据。本节我们一起来看一下矩阵乘运算在 AI 芯片的具体过程,了解它的执行性能是如何被优化实现的。

2025-12-04 10:03:09 1142

原创 AI 芯片关键设计指标

前面我们已经对 AI 的计算模式有了初步的认识,那么这些计算模式具体是如何和 AI 芯片设计结合起来的呢?接下来我们将从 AI 芯片关键设计指标的角度来进一步拓展对 AI 计算体系的思考。

2025-12-03 10:06:08 1050

原创 paper:attention is all you need附录Attention Visualizations 注意力可视化

图 3:一个例子展示了在编码器自注意力机制第 5 层(共 6 层)中,注意力机制如何关注长距离依赖关系。许多注意力头关注动词“making”的远距离依赖关系,从而完成短语“making. . .more difficult”。图 4:两个注意力头,位于 6 层中的第 5 层,显然参与了指代消解。顶部:注意力头 5 的完整注意力。底部:注意力头 5 和 6 中仅来自单词“its”的隔离注意力。我们在上面给出了两个这样的例子,来自第 5 层(共 6 层)编码器自注意力机制中的两个不同的头。

2025-12-02 11:54:07 347

原创 AI 计算模式(下)

了解 AI 计算模式对 AI 芯片设计和优化方向至关重要。本节将会接着从轻量化网络模型和大模型分布式并行两个主题来深入了解 AI 算法的发展现状,引发关于 AI 计算模式的思考。

2025-12-02 10:32:42 924

原创 AI 计算模式(上)

现在我们已经了解到了神经网络模型的一些特点,比如模型深度高,每层的通道多,这些都会导致训练好的模型权重数据内存较大,另外,训练时候为了加速模型的收敛和确保模型精度,一般都会采用高比特的数据类型,比如 FP32,这也会比硬件的计算资源带来很大的压力。**针对不同领域,如计算机视觉、语音、自然语言处理,AI 模型具有不同形式的设计,但是作为 AI 芯片,需要尽可能全的支持所有应用领域的模型,并且支持未来可能出现的新模型结构,这样在一个漫长的芯片设计到流片的周期中,才能降低研发成本,获得市场的认可。

2025-12-01 17:03:33 904

原创 什么是 AI 芯片

首先我们了解一下芯片是什么?芯片的本质就是在半导体衬底上制作能实现一系列特定功能的集成电路。在发现半导体之前,人类只能用机械控制电,而半导体却能直接“用电来控制电”。计算机是我们日常生活中常见的工具,可以通过数字形式存储古往今外的人类文明信息,计算机里任何复杂功能,还原到最底层都能用 0 和 1 解决,进而可以通过半导体开关的通断,绕过机械维度,直接去操控微观的电子来处理信息。通过芯片这个物理接口,创造了我们今天的数字世界,让人类进入到一半物质世界一半数字世界的新时代。

2025-12-01 14:44:46 1112

原创 paper阅读:Attention Is All You Need 注意力是你所需要的一切

缩放点积注意力公式AttentionQKVsoftmaxQKTdkVAttentionQKVsoftmaxdk​​QKT​V是Transformer模型的核心组成部分,它通过计算查询与键的点积相似度,并进行适当缩放和 softmax 归一化,得到注意力权重,再将这些权重应用于值向量进行加权求和,从而高效地捕捉序列中的长距离依赖关系,并生成富有信息量的上下文表示。其缩放机制对于在大维度下稳定训练至关重要。

2025-11-28 16:01:13 883

原创 6.文本理解和生成大模型

首先来看下如何定义信息检索(IR)任务。给定一个queryqqq给定一个文档库D⋯di⋯D⋯di⋯IR系统计算相关系数得分fqdif(q,d_i)fqdi​,然后根据该得分进行排序一个典型的IR系统分为两个阶段:检索和重排阶段。在检索阶段,针对整个文档库,从中找到相关文档的子集,它重视的检索速度和相关文档的召回率;在重排序阶段针对上一步得到的少量文档进行精排,看重的是性能和效果。神经网络IR。

2025-11-21 17:46:41 1142

原创 5.高效训练&模型压缩

比较一下这三个阶段的显存占比:在第1阶段中,每张显卡只需要处理一部分的模型梯度,优化器降低到了原来的显卡数分之一,同时把中间结果的量也降低到原来的卡数分之一;第2阶段中,进一步地把模型的梯度划分提前,把Reduce Scatter提前到了反向传播的过程中,实际上不需要保留完整的梯度。第3阶段中,进一步地划分参数。通过这三部分的优化,显卡上的四大组成部分:参数、梯度、优化器和中间结果都得到了划分,每张显卡只需要保持自己的那部分参数。本小节介绍BMTrain性能上的提升。

2025-11-21 17:34:14 616

原创 4.Prompt Tuning & Delta Tuning

使用encoder作为PLMs的基本编码器Fine-tuning为特定任务添加额外的神经网络微调所有参数pre-training和fine-tuning之间存在差距。pre-training以mask的方式进行训练,而fine-tuning以QA的方式进行微调,存在差距。delta tuning在超大规模的模型上非常高效它的结构随着模型的增加变得越发不重要干净:不需要编辑backonePTM的代码。简单:从全模型tuning迁移到delta-tuning只需要3行代码。

2025-11-21 16:40:45 934

时间序列异常检测相关代码

时间序列异常检测代码

2024-10-22

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除