- 博客(63)
- 收藏
- 关注
原创 DeepSeek-V4 全面解析:百万上下文时代的架构革命
百模大战进入下半场,单纯堆参数、拼算力的时代已然落幕,DeepSeek-V4 以颠覆性架构革新强势登场,彻底告别粗放式发展。模型推出 Pro 旗舰与 Flash 轻量两大版本,原生标配百万 Token 超长上下文,采用 MoE 混合专家架构,按需激活大幅降低计算开销。它首创 CSA+HCA 混合注意力,破解长文本算力与内存瓶颈;流形约束超连接 mHC 稳住深层网络训练;Muon 优化器赋能万亿参数快速收敛。从高质量预训练语料、稳定训练技巧,到专家分训 + 统一蒸馏的后训练体系、生成式奖励模型加持,技术链路
2026-05-05 22:26:54
798
原创 一文读懂大模型理论基础:从Transformer到实际应用
这篇文章系统性地剖析了大语言模型的技术原理,主要包含六大核心模块: Transformer架构:作为大模型的基础骨架,采用注意力机制实现并行处理,包含自注意力、多头注意力等核心组件。 语言表示:通过分词、嵌入向量等技术将文字转化为可计算的数学表达,上下文窗口决定模型的信息接收量。 思考生成机制:包括注意力计算、自回归生成、采样策略等技术,解释了模型如何逐步生成内容。 能力来源:详细说明预训练、微调和对齐等阶段如何塑造模型能力,并分析幻觉现象的本质。 性能参数:深入解读模型参数量、量化技术、上下文长度等关键指
2026-05-05 11:32:07
934
原创 【LangChain】使用 LangChain 快速实现 RAG
本文介绍了如何使用LangChain v1.0构建RAG(检索增强生成)应用,实现基于文档的智能问答系统。主要内容包括:1)环境准备与依赖安装,强调版本兼容性;2)文档处理流程,包括加载、分割和向量化存储;3)创建RAG Agent的核心步骤,使用create_agent API将检索工具与LLM结合;4)完整实现示例,展示从文档加载到问答的完整流程。文章重点讲解了LangChain v1.0的新特性,如工具定义装饰器、流式输出和多步推理能力,为构建高效RAG系统提供了实用指南。
2026-05-04 13:02:26
463
原创 【LangGraph】六.多 Agent 协作:Subgraph 机制
本文介绍了多Agent协作中的Subgraph机制,用于解决复杂系统中的状态管理问题。主要内容包括:1. Subgraph的核心价值在于隔离不同Agent的状态,通过明确接口实现协作,避免状态爆炸;2. 详细讲解了Subgraph的语法实现,包括子图创建、父图集成及状态传递机制;3. 介绍了嵌套子图、条件调用、循环调用等高级用法;4. 列举了常见错误及解决方案。Subgraph通过状态隔离和模块化设计,有效提升了复杂Agent系统的可维护性和复用性。
2026-05-01 20:08:01
468
原创 【LangGraph】五.人机协作:审批和中断
摘要: 本文深入解析LangGraph的人机协作机制,重点解决Agent在关键操作(如数据删除、转账审批)中需人工介入的问题。核心机制为interrupt(中断)与Checkpoint(状态快照): 中断原理:通过interrupt_before(执行前暂停,用于审批)或interrupt_after(执行后暂停,用于审核)在指定节点暂停,保存完整的State(含执行进度和元数据)。 Checkpoint作用:记录State快照,按会话(thread_id)隔离存储,确保恢复时从断点继续。 使用流程:配置C
2026-05-01 10:00:00
419
原创 【LangGraph】四.持久化:保存和恢复执行状态
本文介绍了LangGraph中持久化功能的实现方法,通过Checkpointer机制实现状态保存和恢复。主要内容包括:1)启用持久化的基本步骤,创建Checkpointer并在编译和执行时传入;2)Thread会话隔离机制,通过thread_id区分不同用户或会话;3)对话记忆功能,自动保存和恢复历史状态;4)断点续传实现,可从失败点继续执行;5)多种Checkpointer类型(内存/SQLite/Redis/PostgreSQL)的选择建议。文章还列举了常见错误场景,如忘记传config、thread_
2026-04-30 16:00:12
539
原创 【LangGraph】三.流程控制:分支、循环、并行
本文介绍了LangGraph的三种流程控制机制:分支(条件路由)、循环(迭代执行)和并行(并发处理)。通过条件边实现分支选择,利用自循环边实现重复执行,采用多起点边实现并行任务。文章以代码示例展示了问题分类器、计数器和多维度分析等应用场景,并强调了关键注意事项:条件函数必须覆盖所有返回值、循环必须设置退出条件、并行更新需使用追加模式。最后通过智能问答系统案例,演示了如何组合使用这些机制构建复杂流程,同时指出了状态冲突、死循环等常见错误及解决方法。
2026-04-30 10:00:00
380
原创 【LangGraph】二.State 和 Node 的设计细节
本文详细介绍了LangGraph中State和Node的设计要点。State作为共享数据容器,需要明确定义字段及其更新策略(覆盖或追加)。Node应遵循单一职责原则,只返回必要的更新字段,保持幂等性。文章还提供了调试技巧和常见错误分析,强调清晰的命名和合理的拆分对于构建可维护应用的重要性。通过合理设计State和Node,可以创建更清晰、更可靠的LangGraph工作流。
2026-04-29 22:22:26
378
原创 【LangGraph】一.LangGraph 到底是什么
摘要: LangGraph是一个基于图结构的Agent编排框架,解决了传统黑盒流程控制不灵活的问题。它将Agent执行拆分为节点(Node)和边(Edge),通过显式定义流程(如分支、循环)实现精准控制。核心设计包括: State:共享数据容器,跨节点传递信息; Node:执行单元,处理具体任务并返回状态更新; Edge:控制流程,支持条件跳转和固定路径; Graph:整合节点与边,编译为可执行应用。 相比LangChain,LangGraph更适合复杂场景(如多Agent协作、人工审批节点、状态持久化)。
2026-04-29 19:26:39
962
原创 【LangChain】二.LangChain v1.0-高级特性(记忆、RAG 、Multi-Agent )
本文深入解析LangChain框架的三大进阶能力:记忆系统、RAG知识接入和多代理协作。记忆系统分为短期记忆(线程状态持久化)和长期记忆(跨会话存储),强调信息筛选比存储更重要。RAG不是简单的向量库技术,而是按需获取外部知识的模式,建议从基础的2-step模式入手。多代理系统主要用于解决上下文过载和职责分工问题,需结合工具、状态管理等基础能力使用。文章建议开发者先掌握单代理系统,遇到瓶颈再考虑多代理方案,并提供了清晰的学习路线图,强调LangChain的核心价值在于工程化地组织Agent系统。
2026-04-26 13:22:42
483
原创 【LangChain】一.LangChain v1.0-快速上手(核心组件、工具、中间件)
本文系统介绍了LangChain框架的核心开发能力,重点解析了如何构建可控、可运行的Agent系统。文章首先纠正了将LangChain视为"调大模型API库"的常见误区,指出其本质是面向Agent开发的上层框架。然后详细讲解了五个核心组件:model(推理引擎)、messages(上下文容器)、agent(系统装配点)、streaming(运行观察机制)和structured output(业务接口)。在工具系统部分,强调工具是Agent的行动接口,介绍了工具契约、运行时访问、状态修改等
2026-04-26 12:23:23
742
原创 一篇文章带你快速上手React(包含核心概念、JSX 语法、组件与 Props、Hooks、React Router等等)
本文系统介绍了React框架的核心知识体系,包括React三大特性(组件化、声明式、单向数据流)、JSX语法规则、组件通信方式、Hooks核心API(useState、useEffect等)、ReactRouter路由配置,以及项目组织最佳实践。重点讲解了函数组件开发模式下的状态管理、副作用处理和性能优化技巧,并提供了推荐的项目结构和模块化封装方案。通过示例代码演示了React开发的关键技术点,帮助开发者快速掌握现代React应用开发的核心技能。
2026-04-20 10:30:00
412
原创 一篇文章带你快速上手Vue3(包含vue核心语法、router路由、axios请求库、pinia状态管理、ts类型约束等等)
本文是一份Vue 3开发快速入门指南,主要包含以下核心内容: Vue核心特性:介绍Vue的声明式渲染和响应式系统,对比选项式API和组合式API两种风格。 基础语法:涵盖模板语法(插值、绑定、条件渲染、列表渲染)、组件通信(Props/Emits)和双向绑定(v-model)。 进阶功能: 计算属性与侦听器(computed/watch) 组件生命周期钩子 Vue Router路由管理 Axios HTTP请求封装 Pinia状态管理 最佳实践: 组合式函数实现逻辑复用 TypeScript类型支持 推荐的
2026-04-16 11:40:02
393
原创 【java工程师快速上手go】三.Go Web开发(Gin框架)
本文对比了Go Web开发(以Gin框架为例)与SpringBoot的核心差异: 架构理念:SpringBoot采用全家桶式架构,提供一站式解决方案;Go生态采用组合式开发,按需选择轻量库。 性能:Go应用启动快(<100ms)、内存低(20-50MB),部署为单一二进制文件;SpringBoot依赖JVM,资源消耗较高。 开发模式:SpringBoot通过注解和IoC容器自动管理依赖;Go需显式配置,手动注入依赖,代码更透明。 路由与中间件
2026-04-13 13:40:15
493
原创 【java工程师快速上手go】二.Go进阶特性
本文深入解析Go语言的高级特性,包括面向对象、并发编程和错误处理三大核心内容。在面向对象方面,Go通过结构体和接口实现组合优于继承的设计,采用隐式接口实现和大小写控制可见性。并发编程方面,Go的goroutine和channel机制简化了并发模型,支持轻量级线程和高效通信。错误处理则采用返回值方式而非异常机制,配合panic/recover处理严重错误。文章对比了Go与Java在这些特性上的差异,展现了Go"少即是多"的设计哲学,其简洁性、高效性和显式特性使代码更易于理解和维护。
2026-04-12 19:20:59
488
原创 【java工程师快速上手go】一.Go语言基础
《Java工程师快速上手Go语言指南》摘要 本文为Java开发者提供Go语言快速入门指南,重点对比两种语言的语法差异。文章从开发环境配置开始,详细介绍了Go的基础语法、函数方法、数据结构等核心概念。与Java相比,Go具有更简洁的语法设计:类型声明后置、多返回值、内置切片和映射等特性。特别指出Go的指针机制与Java引用的区别,以及并发安全的注意事项。通过大量语法对比示例,帮助Java开发者快速理解Go的设计哲学和编程范式转换,为后续学习高级特性打下基础。全文突出Go的极简主义特点,强调其更适合云原生开发的
2026-04-12 18:14:12
520
原创 OpenClaw太复杂?我用不到1/10代码量撸了个精简版,默认免费模型开箱即用
MyClaw 是OpenClaw的个人精简版。OpenClaw 功能丰富但对个人用户来说过于庞大——22 个消息渠道、原生移动端应用、语音唤醒、Docker 沙箱等大量功能对大多数个人场景是冗余的。MyClaw 只保留 OpenClaw 的**最核心能力**(Agent 循环、工具系统、记忆、通道接入、自动化),并用 Python + React 前后端分离架构重新实现,通过浏览器即可完成全部配置与管理。
2026-04-07 12:43:28
1256
原创 【云原生】七.Kubernetes核心内容总结
Kubernetes(K8s)是Google开源的容器编排平台,用于自动化部署、扩展和管理容器化应用。其核心架构采用Master-Worker模式,包含控制平面和工作节点。主要概念包括Pod(最小调度单元)、Deployment(管理Pod副本)、Service(提供稳定访问入口)等。Kubernetes支持资源管理、滚动更新、自我修复等功能,通过kubectl命令行工具进行操作,包括集群管理、应用部署、扩缩容等。典型部署流程包括创建命名空间、配置资源、部署应用和暴露服务。Kubernetes已成为云原生应
2026-02-20 10:30:00
1775
原创 【云原生】六.Kubernetes存储与配置管理:ConfigMap、Secret与持久化存储
本文详细介绍了Kubernetes中配置管理和持久化存储的核心机制。主要内容包括:1)ConfigMap用于管理非敏感配置数据,支持环境变量注入、配置文件挂载等多种使用方式;2)Secret用于存储敏感信息,提供多种类型和加密存储;3)持久化存储架构包含PV、PVC和StorageClass三层,支持动态供应和存储扩容;4)通过完整的MySQL部署案例展示了这些机制的综合应用。这些功能实现了应用配置与镜像的解耦,以及存储资源的标准化管理,是Kubernetes在生产环境中稳定运行的重要保障。
2026-02-19 15:00:00
1243
原创 【云原生】五.Kubernetes服务发现与负载均衡:Ingress、网络模型与Service Mesh
本文深入解析Kubernetes网络管理核心组件,重点介绍Ingress、网络模型和ServiceMesh三大模块。Ingress作为HTTP/HTTPS层路由控制器,支持基于域名/路径的路由规则配置,配合IngressController实现流量管理。Kubernetes网络模型通过CNI插件确保Pod间直接通信,NetworkPolicy提供精细化访问控制。ServiceMesh(以Istio为例)则通过Sidecar代理实现服务间流量治理、安全通信和可观测性。文章通过完整实战案例演示Ingress配置
2026-02-19 10:00:00
1149
原创 【云原生】四.Kubernetes核心对象(下):Deployment、Service与Namespace
本文详细介绍了Kubernetes三大核心对象:Deployment用于无状态应用管理,支持滚动更新和回滚;Service提供稳定的服务发现和负载均衡,支持多种类型;Namespace实现资源隔离,支持资源配额限制。通过实战案例演示了多环境部署的综合应用,包括开发和生产环境的独立配置。这三个对象是Kubernetes管理容器化应用的基础组件,掌握它们对于构建可靠的云原生应用至关重要。
2026-02-18 17:34:23
894
原创 【云原生】三.Kubernetes核心对象(上):Pod与Label详解
本文深入解析Kubernetes的核心概念Pod和Label。Pod作为最小调度单元,封装了容器及共享资源,支持多容器协同工作模式(Sidecar、Ambassador、Adapter)。文章详细介绍了Pod的生命周期、重启策略、探针机制,以及Init容器在初始化任务中的应用。Label作为资源组织的关键机制,通过Selector实现资源筛选和管理。文中提供了完整的YAML配置示例和实战案例,演示了如何部署包含Nginx主容器、Fluentd日志收集Sidecar和数据库等待Init容器的Web应用。这些基
2026-02-18 10:30:00
2074
5
原创 【云原生】二.Kubernetes基础入门:架构详解与环境搭建
本文介绍了Kubernetes容器编排平台的基础知识,包括其核心功能、架构组成和环境搭建方法。主要内容涵盖:1)Kubernetes与Docker Swarm的对比;2)Master-Worker架构详解及各组件功能;3)Minikube、Kind和k3s三种本地开发环境的搭建指南;4)kubectl常用命令操作;5)通过nginx应用部署示例演示完整工作流程。文章旨在帮助初学者快速掌握Kubernetes的基本概念和操作,为后续深入学习打下基础。
2026-02-17 21:55:01
985
1
原创 【云原生】一.Docker完全指南:从零开始掌握容器化技术
这篇文章将带你从零开始全面了解Docker,重点讲解Docker是什么、为什么需要它、核心概念以及如何详细使用它。我们将以实用为导向,提供详细的命令说明和配置文件示例,让你能够快速上手并熟练使用Docker。
2026-02-17 10:30:00
1180
原创 【Netty】五.ByteBuf内存管理深度剖析
Netty ByteBuf内存管理机制深度解析 摘要:本文深入剖析了Netty ByteBuf的设计原理与内存管理机制。相比JDK ByteBuffer,ByteBuf采用双指针设计实现读写分离,支持动态扩容并提供丰富API。核心特性包括:1) 内存池化设计,通过PoolArena和ThreadLocal缓存优化内存分配;2) 引用计数机制精确控制对象生命周期;3) 支持堆内存与直接内存两种存储方式;4) 多级内存泄漏检测机制。文章详细讲解了ByteBuf的正确使用方法,包括try-finally释放、派生
2026-02-16 17:00:00
826
原创 【Netty】四.Netty异步编程模型深度解析
摘要:本文深入解析Netty异步编程模型,对比同步/异步编程优劣,剖析JDK Future的局限性及Netty的改进方案。重点讲解ChannelFuture和Promise的实现原理,包括状态管理、监听器机制和链式调用。通过源码分析DefaultPromise的核心逻辑,演示异步编程实践案例,并指出sync与await的区别及死锁规避方法。最后给出可靠异步客户端的完整实现方案,涵盖连接重试、心跳检测等关键机制,为构建高性能网络应用提供参考。
2026-02-16 10:30:00
827
原创 【Netty】三.ChannelPipeline与ChannelHandler责任链深度解析
本文深入解析了Netty中ChannelPipeline和ChannelHandler的核心机制。Pipeline采用双向链表结构实现责任链模式,包含固定的Head和Tail节点,分别处理I/O操作和资源释放。Handler分为入站(Inbound)和出站(Outbound)两种类型,通过ChannelHandlerContext与Pipeline交互。文章详细阐述了事件传播流程、动态修改Pipeline的方法、编解码器的设计原理以及异常处理机制,并给出了IM系统的实战配置示例。理解Pipeline和Han
2026-02-15 11:04:23
1093
原创 【Netty】二.Channel与EventLoop深度解析
本文深入剖析了Netty中Channel与EventLoop的核心机制。Channel作为网络连接的抽象,具有完整的生命周期(创建、注册、激活、非激活、注销),每个状态变化都会触发相应事件。EventLoop是单线程事件循环执行器,负责处理I/O事件、执行任务和定时任务。关键点在于:1)Channel与EventLoop绑定后关系终身不变;2)所有Channel操作都在同一EventLoop线程执行,确保线程安全;3)通过inEventLoop()方法判断当前线程环境,正确处理任务调度。文章还对比了NIO与
2026-02-14 18:57:11
695
原创 【Netty】一.Netty架构设计与Reactor线程模型深度解析
本文深入剖析了Netty的Reactor线程模型架构。首先回顾了从BIO到NIO的网络编程演进历程,指出JDK NIO存在的三大缺陷。然后详细解析了三种Reactor模型及其适用场景,重点阐述了Netty采用的主从Reactor多线程模型。文章通过源码分析展示了Netty中EventLoopGroup与EventLoop的工作机制,包括Channel绑定策略、事件循环流程和ioRatio调优参数。最后对比了Netty如何解决JDK NIO问题,并给出线程数配置的实战建议。全文揭示了Netty高性能背后的设计
2026-02-14 18:26:54
961
原创 Netty 的 ChannelPipeline 顺序到底该怎么写?我在做 IM 系统时踩过的坑
Netty框架中ChannelPipeline处理器的顺序对IM系统开发至关重要。文章指出,常见的误区是认为pipeline是单向队列,实际上Netty维护了入站和出站两条独立链。关键发现是:解码器必须在业务处理器之前添加,而编码器必须在业务处理器之前添加才能被命中,因为出站方向是从右向左执行。作者通过实例演示了正确配置顺序:先添加编解码器,再添加业务处理器。同时强调,入站和出站流程完全独立,不会出现"解码后立即编码"的情况。
2026-02-13 20:58:00
649
原创 【Spring源码】BeanFactory和DefaultListableBeanFactory
摘要:DefaultListableBeanFactory是Spring容器中BeanFactory接口的完整实现,作为最核心的容器实现类,它继承了基础BeanFactory接口并扩展了ConfigurableListableBeanFactory和BeanDefinitionRegistry接口的功能。该实现类不仅提供基本的Bean获取功能,还实现了Bean注册、依赖注入、类型查找等全套容器功能。在Spring架构中,BeanFactory定义基础契约,而DefaultListableBeanFactor
2026-01-30 14:40:09
932
原创 【Spring源码】三级缓存机制详解
Spring三级缓存机制解析 摘要:Spring通过三级缓存机制解决单例Bean的循环依赖问题。一级缓存存储完全初始化的Bean,二级缓存存储早期暴露的Bean半成品,三级缓存存储ObjectFactory用于延迟创建代理对象。当Bean之间存在循环依赖时,Spring通过三级缓存的协作流程:1)实例化后存入三级缓存;2)依赖注入时从三级缓存获取早期引用;3)完成初始化后存入一级缓存。三级缓存相比二级缓存的优势在于支持AOP代理,确保代理对象唯一性和正确初始化时机。但该机制无法解决原型Bean的循环依赖问题
2026-01-29 16:52:33
706
原创 【Spring源码】IOC启动流程和Bean生命周期
本文介绍了Spring IoC容器的核心架构与初始化流程。IoC容器通过控制反转和依赖注入管理对象生命周期,核心组件包括BeanDefinition和BeanFactory体系。容器初始化入口是refresh()方法,包含12个关键步骤:准备刷新环境、获取BeanFactory、配置BeanFactory、处理后置处理器、注册监听器等,最终完成Bean实例化和依赖注入。类图展示了ApplicationContext和BeanFactory的继承体系,时序图详细描述了refresh()方法的执行流程。
2026-01-28 16:47:11
617
原创 RAG理论基础总结
检索增强生成(RAG)是一种为AI模型配备外部知识库的技术,通过文档处理流程实现精准问答。其核心流程包括:文档收集与切割(ETL处理)、向量转换存储、相似度搜索三阶段,结合查询增强生成回答。系统采用模块化设计,包含文档读写、元数据增强、内容格式化等组件,支持PGVector等向量数据库。
2025-06-02 17:39:19
894
原创 【分库分表】企业实战全流程总结
本文总结了企业真实的分库分表全流程。技术选型上推荐ShardingSphere生态产品,支持标准化的数据分片和分布式事务。针对分片键查询问题,提出基因法等改造方案;主键策略推荐数据库sequence+分片键组合方式。该方案能有效解决单表数据过大导致的查询慢、备份恢复困难等问题,同时保持了系统的高可用性和扩展性。
2025-05-27 10:00:00
918
原创 【分库分表】理论基础
分库分表是解决数据库性能瓶颈的有效方案。当单表数据量超过1千万或面临高并发压力时,分库分表能显著提升查询效率和系统稳定性。主要分为垂直拆分(按业务或字段划分)和水平拆分(按数据行划分)。垂直拆分能解耦业务但可能导致跨库查询复杂,水平拆分缓解单表压力但会带来事务一致性问题。实际应用中需权衡利弊,通常结合两种方式共同优化数据库性能。
2025-05-25 16:28:07
818
原创 Arthas 使用攻略
Arthas 是一款线上监控诊断产品,通过全局视角实时查看应用 load、内存、gc、线程的状态信息,并能在不修改应用代码的情况下,对业务问题进行诊断,包括查看方法调用的出入参、异常,监测方法执行耗时,类加载信息等,大大提升线上问题排查效率。这种方法效率低下,更糟糕的是,该问题可能无法解决,因为一旦 JVM 重新启动,它可能无法复现,如上文所述。更糟糕的是,在生产环境中调试是不可接受的,因为它会暂停所有线程,导致服务暂停。的核心工具,能够实时捕获方法的入参、返回值、异常信息,是诊断代码逻辑问题的利器。
2025-04-30 21:57:56
1340
原创 【Java并发】读写锁 ReadWriteLock
读写锁允许多个线程同时读取共享资源,但在写入时则需要独占访问。这种机制特别适用于读操作远多于写操作的场景。本文梳理了什么是读写锁、什么时候使用读写锁和怎么使用读写锁。
2024-12-31 09:00:00
1322
原创 【Java并发】CAS 机制详解和 ABA 问题的解决
CAS(Compare-And-Swap)是一种用于在多线程编程中实现原子操作的技术,它比较内存中的某个值是否为预期值,如果是,则更新为新值,否则不做修改。本文对CAS机制的概念、使用和优缺点进行了详细的总结,并对CAS机制常出现的ABA问题进行了分析和解决。
2024-12-30 09:00:00
1631
原创 【Java并发】内存模型 JMM 详解
Java内存模型(Java Memory Model,JMM)是Java虚拟机(JVM)定义的一种规范,用于描述多线程程序中变量(包括实例字段、静态字段和数组元素)如何在内存中存储和传递的规则。本文详细整理了JMM 的概念、原理和作用,以及JMM的核心happens-before和重要关键字volatile。
2024-12-29 09:00:00
1107
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅