自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(27)
  • 收藏
  • 关注

原创 Spring之依赖注入源码解析

bean,找到多个会报错,而constructor就是通过构造方法中的参数类型去找bean,如果找到多个会 根据参数名确定。2. default,表示默认值,我们一直演示的某个bean的autowire,而也可以直接在<beans>标签中。设置autowire,如果设置了,那么<bean>标签中设置的autowire如果为default,那么则会用。1. 找出BeanFactory中类型为type的所有的Bean的名字,注意是名字,而不是Bean对象,因为我。

2025-06-15 22:18:38 953

原创 Spring框架之Bean生命周期源码解析

BeanDefinition合并之后,就可以去创建Bean对象了,而创建Bean就必须实例化对象,而实例化就 必须先加载当前BeanDefinition所对应的class,在AbstractAutowireCapableBeanFactory类的。(doResolveBeanClass方法所做的事情) 会利用BeanFactory所设置的类加载器来加载类,如果没有设置,则默认使用 **ClassUtils.getDefaultClassLoader()**所返回的类加载器来加载。

2025-06-06 00:09:45 1133

原创 Spring 框架之IOC容器加载重要组件

所以我们可以认为ApplicationContext继承了BeanFactory,相当于苹果继承水果,宝马继承汽车一样,ApplicationContext也是BeanFactory的一种,拥有BeanFactory支持的所有功能,不过ApplicationContext比BeanFactory更加强大,ApplicationContext还基础了其他接口,也就表示。这些是不同定义bean的方式, 他们最终都会生成bean。

2025-06-05 23:48:40 1523 3

原创 Java框架-Spring底层核心原理解析 ​

(实际上,在Spring源码中,这个Map就是单例池)Spring事务是否会失效的判断标准:某个加了@Transactional注解的方法被调用时,要判断到底是不是直接被代理对象调用的,如果是则事务会生效,如果不是则失效。AOP就是进行动态代理,在创建一个Bean的过程中,Spring在最后一步会去判断当前正在创建的这个Bean是不是需要进行AOP,如果需要则会进行动态代理。需要重视的是,如果Spring选择了一个有参的构造方法,Spring在调用这个有参构造方法时,需要传入参数,那这个参数是怎么来的呢?

2025-06-03 23:32:40 892

原创 Tomcat类加载机制及其热加载和热部署原理剖析

WebappClassLoader:各个Webapp私有的类加载器,加载路径中的class只对当前Webapp可见,比如加载war包里相关的类,每个war包应用都有自己的WebappClassLoader,实现相互隔离,比如不同war包应用引入了不同的spring版本,这样实现就能加载各自的spring版本;这种类加载机制其实就是双亲委派机制,加载某个类时会先委托父加载器寻找目标类,找不到再委托上层父加载器加载,如果所有父加载器在自己的加载类路径下都找不到目标类,则在自己的类加载路径中查找并载入目标类。

2025-06-01 20:33:23 958

原创 Tomcat 线程模型详解&性能调优

Poller 的本质是一个 Selector,也跑在单独线程里。Acceptor 跑在一个单独的线程里,它在一个死循环里调用 accept 方法来接收新连接,一旦有新的连接请求到来,accept 方法返回一个 Channel 对象,接着把 Channel 对象交给 Poller 去处理。理论上我们可以通过公式 线程数 = CPU 核心数 *(1+平均等待时间/平均工作时间),计算出一个理想值,这个值只具有指导意义,因为它受到各种资源的限制,实际场景中,我们需要在理想值的基础上进行压测,来获得最佳线程数。

2025-06-01 19:55:48 1221

原创 Tomcat的整体架构及其设计精髓

SocketProcessor 用于处理接收到的Socket 请求,它实现 Runnable 接口,在 Run 方法里调用协议处理组件 Processor 进行处理。EndPoint 接收到 Socket 连接后,生成一个 SocketProcessor 任务提交到线程池去处理SocketProcessor 的 Run 方法会调用 Processor 组件去解析应用层协议,Processor 通过解析生成。Valve 是 Tomcat 的私有机制,与 Tomcat 的基础架构 /API 是紧耦合的。

2025-05-31 23:16:56 1820

原创 StableDiffusion之多模态大模型以及本地部署调用

模型架构: Llama 3.2-Vision 基于 Llama 3.1 文本模型构建,后者是一个使用优化的Transformer架构的自回归语言模型。为了支持图像识别任务,Llama 3.2-Vision 模型使用了单独训练的视觉适配器,该适配器与预训练的 Llama 3.1 语言模型集成。Llama 3.2-Vision 是一系列多模态大语言模型(LLM),包括预训练和指令调优的图像推理生成模型,大小分别为11B和90B(输入为文本+图像/输出为文本)。1Stable Diffusion 简介。

2025-05-26 01:55:29 1154

原创 deep seek-r1思维链模型

新的总大型猫科动物数量 = 剩余的狮子数量 + 剩余的老虎数量 = 12 + 20 = 32 只。剩余的狮子数量 = 初始狮子数量 - 转移的狮子数量 = 15 - 3 = 12 只。总的大型猫科动物数量 = 狮子数量 + 老虎数量 = 15 + 20 = 35 只。平均速度 = 120公里 ÷ 2小时 = 60公里/小时。因此,这辆车的平均速度是 60公里/小时。示例2 少样本(Few-shot)CoT。示例2 少样本(Few-shot)CoT。求车辆的平均速度(单位:公里/小时)。

2025-05-26 01:16:50 1473

原创 模型训练-下篇(完结篇)

模型训练(Training)预训练(Pre-Training)微调(Fine-Tuning)轻量化微调(Parameter Efficient Fine-Tuning, PEFT)Transformer 是组成 LLM 的基本单元。或者说,一个 LLM 就是一个NNN层 Transformer 网络,例如 GPT-3.5 是 96 层。

2025-05-26 00:34:21 1358

原创 模型训练-上篇

加载数据集数据预处理:将输入输出按特定格式拼接文本转 Token IDs通过 labels 标识出哪部分是输出(只有输出的 token 参与 loss 计算)加载模型、Tokenizer定义数据规整器定义训练超参:学习率、批次大小、…定义训练器开始训练注意:训练后推理时,输入数据的拼接方式要与训练时一致记住上面的流程,你就能跑通模型训练过程理解下面的知识,你就能训练好模型效果尝试:用简单的数学语言表达概念我们希望找到一组参数ω\omegaω。

2025-05-26 00:03:44 1109

原创 Agent模型微调

发布机构:面壁智能4.6k stars提供数据集、相应的训练和评估脚本,以及在ToolBench上经过微调的强大模型ToolLLaMA。数据:ToolBench,包含 469585 条数据(工具数量:3451;API数量:16464);模型1. 理解大模型应用需要 Agent 技术的原因:消除“幻觉”、连接真实世界、处理复杂任务;2. 理解 Agent Tuning 的主要动机:希望通过训练让大模型,尤其是小参数大模型(7B、14B)也能具备特定业务场景的 Agent 能力;

2025-05-25 19:00:50 1575

原创 工作流介绍

在复杂工作流中,如果所有的数据都使用全局环境数据通讯,尤其是在不同工作块中对同一个键指向的数据进行操作时,会因为对运行时序的判断困难而导致数据管理混乱,这时候,需要通过块间数据传递来确保数据变化与运行时序期望一致,用大白话说,就是确保“块2”能够正确使用它的前一个块“块1”生成的数据进行工作。工作流相当于提供了一个复杂的沙盒环境,沙盒环境中的全局环境数据会影响工作流运行状态,并存储工作流运行过程中的过程数据和最终成果。以下讨论点全部为开放性讨论,没有标准的正确答案,仅作为启发思考和开拓思路的作用。

2025-05-18 18:30:53 1198

原创 AutoGPT-Agent简述版

善用思维链技巧在重要的环节设置反思与纠偏机制约定思维链中需要包含的要素,尽量详细具体不可能一遍成功,要学会通过测试的失败例子优化提示词的细节要善于将问题总结成方法论型的提示词(把 AI 当人看)要善于综合使用各种提示词技巧,例如:举例子、PoTAoT等等。

2025-05-18 18:09:17 841

原创 LlamaIndex-第二个大模型开发框架

LlamaIndex 是一个为开发「上下文增强」的大语言模型应用的框架(也就是 SDK)。上下文增强,泛指任何在私有或特定领域数据基础上应用大语言模型的情况。例如:Question-Answering Chatbots (也就是 RAG)Document Understanding and Extraction (文档理解与信息抽取)Autonomous Agents that can perform research and take actions (智能体应用)

2025-05-14 15:32:43 903

原创 补充:LangGraph

LangGraph 核⼼组件: Graphs, State, Nodes, EdgesLangGraph ⚡ 以图的⽅式构建语⾔代理 ⚡官⽅⽂档地址:LangGraph是⼀个⽤于构建具有 LLMs 的有状态、多⻆⾊应⽤程序的库,⽤于创建代理和多代理 ⼯作流。与其他 LLM 框架相⽐,它提供了以下核⼼优势:循环、可控性和持久性。 LangGraph 允许您定义涉及循环的流程,这对于⼤多数代理架构⾄关重要。作为⼀种⾮常底层的 框架,它提供了对应⽤程序的流程和状态的精细控制,这对创建可靠的代理⾄关重要。此外, L

2025-05-12 17:22:50 1667

原创 Assistants API

GPT Store和这一波操作一度被认为是创业公司终结者界面不可定制,不能集成进自己的产品只有 ChatGPT Plus/Team/Enterprise 用户才能访问未来开发者可以根据使用量获得报酬,北美先开始承诺会推出 Team/Enterprise 版的组织内部专属 GPTs定制界面,或和自己的产品集成需要传大量文件服务国外用户,或国内 B 端客户数据保密性要求不高不差钱需要极致调优追求性价比服务国外用户,或国内 B 端客户数据保密性要求不高服务国内用户。

2025-05-12 12:44:56 1191

原创 LangChain学习

LangChain 随着版本迭代可用性有明显提升使用 LangChain 要注意维护自己的 Prompt,尽量 Prompt 与代码逻辑解依赖它的内置基础工具,建议充分测试效果后再决定是否使用。

2025-05-04 12:15:38 820

原创 RAG & Embeddings & Vector Store

LLM的知识不是实时的LLM 可能不知道你私有的领域/业务知识1.2检索增强生成RAG(Retrieval Augmented Generation)顾名思义,通过**检索**的方法来增强**生成模型**的能力。(超爽中英!) 2025公认最好的【构建RAG应用】教程!附课件代码可以参考学习一下大佬们的讲解。向量是一种有大小和方向的数学对象。它可以表示为从一个点到另一个点的有向线段。例如,二维空间中的向量可以表示为 (x,y),表示从原点 (0,0) 到点 (x,y) 的有向线段。

2025-05-03 18:41:41 1074

原创 深度学习之卷积神经网络、循环神经网络

接下来,我们将会学习如何将词转换为词向量,其步骤如下: 先将语料进行分词,构建词与索引的映射,我们可以把这个映射叫做词表,词表中每个词都对应了一个唯一的索引 然后使用 nn.Embedding 构建词嵌入矩阵,词索引对应的向量即为该词对应的数值化后的向量表示。词嵌入层首先会根据输入的词的数量构建一个词向量矩阵,例如: 我们有 100 个词,每个词希望转换成 128 维度的向量,那么构建的矩阵形状即为: 100*128,输入的每个词都对应了一个该矩阵中的一个向量。像素值越接近于255,颜色越亮,接近于白色。

2025-04-15 16:26:04 1577

原创 深度学习-简介和神经网络

sigmoid 函数可以将任意的输入映射到 (0, 1) 之间,当输入的值大致在 <-6 或者 >6 时,意味着输入任何值得到的激活值都是差不多的,这样会丢失部分的信息。在pytorch中定义深度神经网络其实就是层堆叠的过程,继承自nn.Module,实现两个方法: __init__方法中定义网络中的层结构,主要是全连接层,并进行初始化 forward方法,在实例化模型的时候,底层会自动调用该函数。所谓的训练函数,指的是输入数据读取、送入网络、计算损失、更新参数的流程,该流程较为固定。

2025-04-15 00:07:45 922

原创 机器学习之聚类算法、支持向量机SVM

4、根据每个类别中的样本点,重新计算出新的聚类中心点(平均值),如果计算得出的新中心点与原中心点一样则停止聚类,否则重新进行第 2 步过程,直到聚类中心不再变化。链接:https://www.kaggle.com/c/otto-group-product-classification-challenge/overview。- **3.2.2 确定最后最优参数**- **2.5 数据pca降维**- **3.1 基本模型训练**- **2.4 数据标准化**- **2.3 分割数据**

2025-04-14 01:00:21 1058

原创 机器学习之决策树、集成学习、朴素贝叶斯和特征降维

举个栗子:数据 α:ABCDEFGH,数据 β:AAAABBCD,数据α 包含了 8 种信息,数据 β 包含了 4 种信息, 特征 α 的信息熵大于特征 β 的信息熵。条件熵:H(D | A) = ∑_v=1^nD^V/D H(D^V) = ∑_v=1^nD^V/D∑_k=1^kC^kV/D^V logC^kV/D^V。: 特征a对训练数据集D的信息增益g(D,a),定义为集合D的熵H(D)与特征a给定条件下D的熵H(D|a)之差。:ID3决策树 、C4.5决策树、CART决策树、CART回归树等。

2025-04-07 17:21:55 739

原创 机器学习之线性回归、逻辑回归

3.平均绝对误差 (Mean Absolute Error , MAE) 1/m∑_1^m⌈ℎ(x^(i)) − y^(i)⌉。2.均方误差 (Mean-Square Error, MSE) 1/m∑_i=0^m(ℎ(x^(i)) − y^(i))^2。回归问题中的损失函数包括: 1.最小二乘法 : 误差平方和 ∑_i=0^m(ℎ(x^(i)) − y^(i))^2。一.线性回归问题的求解 线性回归API、损失函数、导数和矩阵、正规方程法、梯度下降算法。二分类问题很重要,在模型预测方面。

2025-04-06 17:26:51 1048

原创 人工智能-机器学习

基本原理:通过构建四个要素:agent,环境状态,行动,奖励, agent根据环境状态进行行动获得最多的累计奖励。:如果一个样本在特征空间中的 k 个最相似的样本中的大多数属于某一个别,则该样本也属于这个类别。:AI(人工智能),机器学习(ML),深度学习(DL),AI包含机器学习,机器学习包含深度学习。多个样本组成数据集;, 根据样本间的相似性,对样本集聚类,以发现事物内部结构及相互关系。:定义:输入数据是由输入特征值和目标值所组成,即输入的训练数据。:定义:输入数据没有被标记,即样本数据类别未知,

2025-03-31 17:19:37 553

原创 人工智能学习之python基础进阶

我们解决问题的时候,会把所需要的步骤都列出来,然后按照步骤写代码挨个实现, 这种过程化的叙事思维,就是面向过程思想。封装:在面向对象中,封装就是隐藏对象的属性和实现细节,仅对外公开接口,控制在程序中属性的读和修改的 访问级别,将抽象得到的数据和行为(或功能)相结合,形成一个有机的整体,也就是将数据与操作数据 的源代码进行有机的结合,形成“类”,其中数据和函数都是类的成员。1.面向对象三种:封装:大白话:把属性和方法封装在一起,仅提供对外的方法让别人去访问。2.排序算法1.冒泡排序。2.线程间共享全局变量。

2025-03-30 16:16:50 535

原创 人工智能学习之python基础篇

安装教程请看B站其他博主视频,两篇文章把python知识都更完,这篇是基础,可以拿来练习和巩固知识,下一篇是python的进阶知识,更完就开始机器学习和深度学习,详细介绍。结束,python已经结束,下一篇是python进阶篇,然后是机器学习和深度学习,这两个会深度详细文字说明,个人觉得python基础知识就是可以拿来练习巩固就行。Pycharm是一个Python开发的工具,是一个集成化开发环境(IDE)- IDE:将点吗的编写,编译,运行,调试等一系列集中在一起的运用软件。13.while循环语句。

2025-03-29 18:10:02 631

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除