自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(29)
  • 收藏
  • 关注

原创 扩散模型diffusion

扩散模型(Diffusion Models)是最近生成式 AI领域的绝对核心,近年来,只要涉及AI生成视频、图像,它的底层原理几乎都绕不开diffusion。

2026-05-24 00:53:45 286

原创 Redis 命令

如果不及时删除会导致内存占用过多,常用在验证码(5分钟过期)、登录状态(30分钟过期)、限流计数器(1分钟重置)的场景。redis的通用命令很多,我们其实不需要把它们所有都记住,只要记住几个常见命令,学会使用help查看命令就行了。所有的键(Key)都是字符串类型,而值(Value)可以是字符串、整数或浮点数。sorted set是一个可排序的集合类型,里面每一个元素都有一个。队列的特点是先进先出,只需要push和pop的在。栈的特点是先进后出,只需要push和pop的在。hash类型的key是键值对。

2026-05-21 14:20:55 509

原创 Redis NoSQL&Redis架构&数据结构

SQL以数据表的形式存储数据,而NoSQL的数据模型不固定,能够以键值对(Redis)、JSON文档(MongoDB)、图(Neo4j)、列族(HBase)等形式存储数据,所以NoSQL是。Redis是一个键值对(key-value)数据库,key一般是string类型,不过value的数据结构有很多。进行查询操作,而不同NoSQL(redis、MongoDB)的查询语句不一样。负责存储数据、处理命令、管理内存、执行持久化、处理复制和集群等核心逻辑。,它会监听一个端口(默认 6379),等待连接。

2026-05-18 23:31:14 950 1

原创 Docker dockerfile镜像制作&compose服务编排&私有仓库

如果没有 Compose ,要运行一个由多个容器组成的应用(比如一个 Web 应用 + Redis + MySQL),每个微服务都需要手动启停、配置他们的端口映射、网络连接。在容器启动时,Docker 会在镜像的最顶层自动添加一个可写容器container作为可写层,所有对容器的修改,都只发生在这个可写层中。,我们可以从上面拉取镜像到本地,也可以把我们的镜像推送上去,如果你不希望把自己的镜像放到公网那你就需要搭建一个。Docker Compose 是一个编排多容器分布式部署的工具,按照一定的业务规则。

2026-05-17 20:26:59 572

原创 Docker 数据卷&应用部署

简单来说,数据卷就像是容器的一个。

2026-05-17 15:26:46 1150

原创 Docker 架构&命令

it:-i表示实时交互(你在终端写的命令会传递给容器进程),-t表示创建终端;创建完容器后不会立即进入容器而是让容器在后台独立默默地运行,输入exit也不会退出容器。它是一个常驻在后台的进程,专门负责监听来自 Client 的请求,容器是镜像运行出来的实例,那么容器命令主要是如何创建容器和操作容器。/bin/bash:覆盖镜像默认的启动命令,改为运行容器内部的。在docker中,软件和软件的运行环境被打包成一个镜像文件,这是Docker的核心部分,负责docker的开启与关闭。Docker 服务通过。

2026-05-17 12:53:57 1523

原创 Docker 容器化技术&docker安装

容器化技术是一种轻量级的操作系统虚拟化方法,它允许你在一个隔离的环境中打包和运行应用程序及其所有依赖项(Web应用、数据库、消息队列)。这个隔离环境被称为虚拟机:在你的物理机上,通过一个叫的虚拟化管理软件,模拟出 CPU、内存、硬盘等硬件,然后在这些虚拟硬件上安装一个容器化技术,也不需要安装独立的操作系统。它直接共享宿主机的操作系统内核,仅仅在进程级别通过 Linux 的Namespace(命名空间)和Cgroups(控制组)技术实现了隔离。

2026-05-16 22:32:31 617

原创 MySQL 视图

数据库还有一种虚拟表,它的结构跟真实表一样,都是二维表,但是不存放数据,数据从真实表中获取,这种表被称为简而言之,,本身,只存一条查询语句查视图 = 自动执行提前写好的 SELECT 查询,数据都来自原数据表如果真实表里的数据变了,视图里的数据会每次你查询视图时,MySQL 都会在后台定义它的那条SELECT语句,从而获取主表中的最新数据视图的数据不会持久化到磁盘上,而是基于查询结果动态生成隐藏敏感字段(密码、手机号、薪资),只开放允许查看的字段,做到。

2026-05-16 16:07:20 401

原创 MySQL 用户与权限

用户管理:MySQL 通过 user 表管理用户信息。创建用户:使用 create user 语句创建用户。删除用户:使用 drop user 语句删除用户。修改密码:使用 set password 语句修改用户密码。权限管理:使用 grant 和 revoke 语句为用户授予权限和回收权限。

2026-05-15 22:59:35 578

原创 MySQL多表操作 查询&子查询&外键约束

除了针对一张表的操作,还有对两张以上的表进行的操作。多表操作的是把两张或多张表的数据,通过,按指定的规则合并成一个完整的结果集。比如你要查「订单的订单号、下单用户的姓名、订单里的商品名称」,这些数据分别在订单表、用户表、商品表、订单商品表,必须用联合查询才能一次性拿到结果,不用多次单表查询拼接数据。

2026-05-15 21:17:48 707

原创 MySQL单表操作

我们已经学会了数据表的创建、数据类型、约束、字符集的设置以及数据的增删改查操作;但是这些还远远不够,现在我们需要学习为数据表插入大量数据,对查询的数据进行筛选、分组、排序或限量在开发时,如果我们需要创建一个与已有数据表相同表结构的数据表时,可以通过以下语句上述代码仅从已有数据表中复制一份相同的表结构,并不会复制表中保存的数据。如果我们想复制已有的表数据,我们可以用关键字insert和select,注意这种操作要求获取数据和插入数据的表结构相同。解决主键冲突在对数据表插入数据时,若表中的主键含

2026-05-14 21:43:27 625

原创 浅谈大模型微调

大模型微调 (Fine-tuning)是指在已经训练好的预训练模型基础上,利用特定领域的数据集进行二次训练,以使模型能够更好地适应特定任务或行业需求的过程预训练:让大模型知道整个世界的所有背景知识,各学科、各行业的。微调:预训练模型是一个非常大的、泛化的模型。通常这时候我们需要用微调方式来让它补充获得更多的行业专业知识通俗一点来讲,微调就是当你有了一些“独特”的数据。如果这些数据:满足你的独特需求(如电子女友)不能公开的私域数据(如金融模型)在某方面超越通用模型的准确度(如医疗模型)

2026-05-13 08:35:15 798

原创 MySQL数据类型与约束

构成:开头是对应的字符集,中间是国家名或general,结尾是cs、ci或bin,其中ci表示不区分大小写,cs表示要区分大小写,bin表示以二进制方式比较,比如latin1_swedish_ci。Null列的值为NO表示该字段添加了非空约束,在创建数据表时,非空约束和默认值为NULL不能同时存在,否则会创建失败。实现,它相当于唯一约束和非空约束的组合,要求被约束字段不允许重复也不允许出现NULL值,每个表最多含有一个主键列。如果插入的值大于自动增长的值,则下次插入的自动增长值会自动使用最大值加1。

2026-05-12 21:20:33 606

原创 MySQL数据类型与约束 数值&字符串&日期

在数据库中,数据表用来组织和保存各种数据,它是由构成的,在设计表结构时,经常需要根据实际需求选择合适的数据类型与约束。

2026-05-12 16:40:37 777

原创 MySQL 数据库操作CRUD

由于MySQL服务器中的数据需要存储在数据表中,而数据表需要存储在对应的数据库下,并且MySQL服务器又可以同时存在多个数据库,因此在对数据和数据表进行操作前需要选择数据库。在MySQL数据库中,所有数据都存储在数据表中,如果要对数据进行添加、查看、修改、删除,首先需要在指定数据库中准备一张数据表。向数据表中添加数据,数据添加操作分为两种:一种是为所有字段添加数据,一种是为部分字段添加数据。值得一提的是,在执行删除数据库操作之前,一定要备份需要保留的数据,确保数据的安全,使用。

2026-05-08 16:20:05 806

原创 MySQL

Window系统想安装MySQL可以看看这篇教程,步骤十分详细。这里特别需要注意的一点就是注意,在实际项目和生产中一般都用的是,这里建议大家去学一下Linux环境下MySQL的安装过程。

2026-05-05 18:15:58 527

原创 Agent工具调用中的错误处理 重试机制&降级处理

retry_chain:重试链,让这个chain重新尝试生成(补全)内容(retry_chain可以包含数据处理+Prompt + LLM + OutputParser 的完整组合)=(stop_after_delay(10) | stop_after_attempt(5)):组合条件,最多尝试5次和最多重试10秒。:api调用(失败)、搜索引擎(超时)、数据库(限流),每一个外部服务都存在相应的潜在问题,路径上某一个部分出了问题,如果写了。

2026-05-04 19:55:34 1059

原创 MCP模型上下文协议

MCP模型上下文协议(MCP)是一个标准化的人工智能应用架构框架,它通过客户端-服务器模式实现AI系统与外部数据源、工具和服务的高效交互。MCP解决了LLM与外部世界隔绝的问题,避免了为每个数据源单独开发工具的工作量。其核心架构包括:MCP主机、客户端和服务器,其中服务器将工具、资源和提示词封装为标准能力供客户端调用。MCP协议底层包含基于JSON-RPC的消息规范和多种传输方式(如stdio和HTTP)。该框架通过标准化接口实现了AI能力的复用,类比于USB在设备连接中的作用,显著提升了AI系统的可扩展性

2026-05-02 17:56:55 697

原创 LangGraph框架 Multi-agent多智能体协作

每个agent仅与一部分agent进行通信。流程的某些部分是确定性的,只有部分agent可以决定接下来要调用哪些其他agent。

2026-04-30 19:57:20 514

原创 Langgraph框架 持久性&Memory&Tool

修剪或删除消息的问题在于,可能会因剔除消息队列而丢失信息。因此,一些应用程序受益于一种更复杂的方法,即使用聊天模型来汇总消息历史记录。是 LangGraph 提供的一个预置节点,专门用于在对话过长时自动将历史消息压缩为摘要,从而解决 LLM 上下文窗口超限的问题虽然不是一个函数,但是它是一个可调用对象;这个类中实现了__call__方法让它可以向函数一样被调用。下载模块使用方法# 1. 模型。

2026-04-28 23:14:20 929

原创 浅谈Harness Engineering

2026年2月11日,OpenAI 发布百万行代码实验报告,标题使用””,这是一种新的工程范式,标志着最新的agent工程研究方向。本质上讲,Harness Engineering就是一套为 Agent 构建一套的系统,它的目的是让 Agent 在边界内稳定、可靠、长期地完成复杂任务在之前,已经有和,它们标志着以前agent开发中最头疼的问题:提示词(prompt)和上下文(context)。

2026-04-26 22:06:56 406

原创 LangGraph框架 状态图&节点&边&Send

Langgraph是一个用于构建循环、有状态的多智能体(Multi-agent)持久执行:构建能够在失败后持续运行、长时间运行并从中断处恢复的代理。人机交互:通过在任何时候检查和修改代理状态,融入人工监督。综合记忆: 创建具有短期工作记忆以进行持续推理和跨会话长时记忆的有状态代理。使用LangSmith调试:通过可视化工具深入了解复杂代理行为,追踪执行路径、捕获状态转移,并提供详细的运行时指标。简易部署。

2026-04-26 18:11:18 695

原创 Hyde信息检索

计算生成文档的向量的平均值,该向量保存来自用户的查询和所需答案模式的信息,使用向量从文档库中检索答案,以提高检索的准确性和召回率。在普通的 RAG 中,用户的问题通常很短,而知识库里的文档很长,短句子和长段落的向量在空间中相隔较远,导致检索不到相关部分。这一步是把刚刚生成的“假答案”文本变成一个向量。就在相较于普通的RAG,它的代码改动非常少,只需要把我们的base_embedding编码方式变成现在的。使用嵌入模型将上一步生成的“假答案”文本转换成一个向量,得到一个代表“答案风格”的向量。

2026-04-19 10:44:24 959

原创 非结构化数据处理MinerU&Unstructured

很多时候我们需要把pdf传给agent去处理,但是pdf中有很多的公式、表格、图片怎么把这些不同格式的数据全部都解析出来,仅靠loader()方法肯定不行,我们需要借助一些。

2026-04-18 19:44:58 263

原创 RAG性能评估

我们需要使用llm对输入的context生成answer# 定义 Prompt 模板Answer:"""

2026-04-18 16:42:30 732

原创 为端到端API添加Naive RAG 流程

在前文中,我们结合langchain和fastapi搭建了一个端到端的问答API,这个agent可以调用已经封装好的工具函数,可以获取本地数据库,有记忆功能;但是这样的模型训练好了过后只是就固定了,如果没有获取或更新相应的知识,agent很可能会产生幻觉,即返回一个看似合理实则漏洞百出的答案,因此我们要为agent提供一个随时可查阅的“外部数据库”。

2026-04-17 16:48:41 711

原创 Langchain和FastaAPI,一个端到端的问答API

这里我们定义两个数据模型,用于规范 FastAPI 接口的请求体和响应体的格式;告诉前端发来的数据应该长什么样,后端返回的数据又该长什么样所以ChatRequest在客户端发送 POST 请求时使用,ChatResponse在服务器返回数据时使用try:# 调用 LangChain 逻辑# 返回结果# 捕获异常并返回 500 错误这里首先定义了一个post接口,路径为/chat这个。

2026-04-14 21:52:38 524

原创 FastAPI

FastAPI是一个用于构建 API 的现代、高性能的 Python Web 框架。它专为快速开发而设计,并以其卓越的性能和开发者友好性而闻名。简单来说,它就是一个工具包,让你能用 Python 非常快速、简单地创建出供其他程序(如前端网页、手机App、其他服务)调用的接口(API)。通俗来讲,就是让你用 Python 编写的程序能够通过网络(互联网或局域网)被其他人或其他的系统访问。FastAPI的作用。

2026-04-14 00:15:19 662

原创 JSON Schema

就是给 JSON 数据写的一份“

2026-04-12 17:05:53 864

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除