自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(11)
  • 收藏
  • 关注

原创 大模型推理——MLA实现方案

MLA

2025-02-08 18:17:54 1417 2

原创 大模型推理——token生成策略

【代码】大模型推理——token生成策略。

2025-02-05 13:23:48 626

原创 大模型推理——kv cache机制

kv cache流程图

2025-02-04 10:21:23 379

原创 强化学习02——贝尔曼公式

这是一个联合概率,表示在给定状态 s 和动作 a 下,同时发生转移到状态 s' 并获得奖励 r 的概率。上面公式说的是,马尔科夫是没有记忆的,它只关注当前的状态,前面是什么状态不关注。另外,从状态 s 到状态 s' ,可能有多种方式,因此是。,表示在状态 s 下,得到的立即奖励值的期望值(平均值)。,表示在状态 s 下,得到的累计奖励值的期望值(平均值)。但是其中涉及到对矩阵求逆的过程,有一定的限制条件,不通用。会收敛到一个相对固定的值,那个值就是最终的结果。那么对应的累计回报值,可以写成下面的方式。

2025-01-13 15:56:34 1033

原创 强化学习01——基本概念

假设在状态 s1,如果我们采取行动 a1,那么 reward 的值是-1 的概率为 1,其他 reward 值的概率都是 0。和状态转移相同,策略可以是确定性的也可以是随机性的。,向上移动获得的确定的及时奖励是-1,然后后一个状态还是在 s1。,向右移动获得的确定的及时奖励是-1,然后后一个状态还是在 s1。,向左移动获得的确定的及时奖励是-1,然后后一个状态还是在 s1。,原地不动获得的确定的及时奖励是 0,然后后一个状态还是在 s1。,向下移动获得的确定的及时奖励是 0,然后后一个状态是在 s3。

2024-12-31 17:44:32 1002

原创 Deformable DETR源码——超详细图解

网上也有很多大佬讲deformable DETR 的原理和源码,但是我觉得纸上得来终觉浅,还是要自己一行代码一行代码地 debug,才能理解得更加透彻。于是有了这篇博客,方便自己后续复习。

2024-03-22 14:51:59 7061 9

原创 DBNet源码——超详细图解

来到这行代码,该行代码的作用就是将canvas里面的值压缩到self.thresh_min到self.thresh_max之间,即0.3-0.7。可视化结果如下:到这里,threshold_map的标签就制作好了。另外,如果是针对多边形标注,代码是一样的,下面是对印章的标注结果来到这行代码这行代码的作用就是在gt上用白色填充缩放后的多边形,可视化效果如下:第一个文本框的缩放gt第一个和第二个文本框的缩放gt第一个、第二个和第三个文本框的缩放gt第一个、第二个、第三个和第四个文本框的缩放gt。

2024-03-13 10:05:05 2959 5

原创 HRNet源码——超详细图解

其作用是将 box(目标检测的检测框) 的 h 和 w 的比例调整为fixed_size 的 h 和 w 的比例,以 fixed_size=(4, 2),调整前的 box 的 h=5, w=3,调整后的 h=6, w=3, h / w = 2 为例。关于模型结构部分的代码,可以参考第一部分的模型结构图(其他大佬画的),我觉得已经画的非常详细了,代码实际上也是这样的。:image(同输入一致)、target(缩放之后的target,box 参数为缩放之后的 xmin,ymin,w,h)

2024-03-11 09:57:47 4404 2

原创 PyFlink核心知识点

<plugins><plugin><goals></goals></plugin><plugin></plugin></plugins>

2024-02-29 10:48:35 2097 2

原创 SVTR源码——超详细图解

w_q、w_k、w_v 的 shape 为(8, 24),输出的 qkv 的 shape 为(2, 200, 24),reshape 之后的 shape 为(2, 200, 3, 2, 4),transpose 之后的 shape 为(3, 2, 2, 200, 4)。其中,qkv = self.qkv(x).reshape((0, N, 3, self.num_heads, C //self.num_heads)).transpose((2, 0, 3, 1, 4))这里的 p 为 4(32/8),

2024-02-27 16:00:45 2602 8

原创 Swin Transformer源码——超详细图解

假设输入 x 的 shape 为(2,3,16,16),那么输出 x 的 shape 为(2,8,4,4)。说明:在我的代码中,生成的特征图是 4*4 的,而 window_size 为 3,因此需要对特征图进行扩充,以适应窗口大小。解释下上面 q(k 和 v 是一样的)的 shape, 一个 batch 中的每一张图片中的每一个 window 的每个 head 都有自己的 q、k、v 值。,假设输入 x 的 shape 为(2,8,4,4),那么输出 x 的 shape 为(2,16,8)。

2024-02-23 14:20:50 3712

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除