学习中的一点总结
文章平均质量分 51
Keep_Trying_Go
无
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
华为开源框架MindSpore基本使用
本文介绍了华为昇思MindSpore AI计算框架的核心特性与应用实践。MindSpore作为面向"端-边-云"全场景的新一代框架,具备动静统一编程范式、自动并行技术及MindIR中间表达等创新设计,支持CPU/GPU/NPU异构算力。文章对比了PyTorch、TensorFlow等主流框架的差异,并通过MobileNetV2微调实战演示了完整开发流程:包括环境配置、数据加载(标准/自定义数据集)、模型构建(原生接口与兼容PyTorch的mint接口)、损失函数与优化器配置、训练验证(M原创 2026-06-14 16:00:23 · 398 阅读 · 0 评论 -
基于stable diffusion图像生成的小小demo应用(pytorch)
本文汇总了Stable Diffusion相关代码资源与参数说明,并整理了多篇文本生成图像(Text-to-Image)领域的核心论文。代码部分包含官方实现和PyTorch复现版本,重点解析了prompt、uncond_prompt、cfg_scale等关键参数的作用。论文部分系统梳理了GAN-based方法(如AttnGAN、MirrorGAN)、扩散模型(Stable Diffusion)、Transformer架构(VQ-GAN、MaskGIT)三大技术路线,涵盖基础模型(StackGAN)、优化方法原创 2026-03-09 16:04:01 · 680 阅读 · 1 评论 -
accelerate 深度学习分布式训练库的使用详细介绍(单卡/多卡分布式训练)
摘要:Accelerate是由HuggingFace开发的轻量级PyTorch分布式训练库,可简化单卡/多卡(DP/DDP)、TPU及混合精度训练流程。该库无需修改模型代码即可适配不同硬件环境,支持FP16/BF16混合精度和梯度累积。安装只需pip install accelerate,通过Accelerator()类配置训练参数(如精度模式、日志工具等)。相比传统分布式框架,Accelerate隐藏底层实现细节,开发者可专注模型逻辑。文中提供了GitHub示例链接和人群计数框架参考,展示如何快速迁移现有原创 2026-01-05 21:50:55 · 1493 阅读 · 0 评论 -
taming-transformers代码使用过程中的报错“packaging.version.InvalidVersion: Invalid version: ‘0.10.1,<0.11‘pyt”
本文介绍了VQ-GAN高分辨率图像生成模型的安装与调试过程。在按照作者提供的environment.yaml文件配置环境时,发现安装CPU版本的PyTorch较为稳定,但运行sample_fast.py时会出现版本报错。虽然官方建议直接使用conda安装环境即可正常运行,但实际调试中发现transformers库的版本冲突问题。通过将transformers版本从4.3.1降级到4.2.0,最终解决了"packaging.version.InvalidVersion"错误。文中详细列出了原创 2026-01-04 21:27:30 · 343 阅读 · 0 评论 -
统一的人群计数训练框架(PyTorch)——基于主流的密度图模型训练框架
本文介绍了一个开源的人群计数框架,支持一键生成密度图数据集,并内置多种常见损失函数。该框架采用模块化设计,用户无需修改核心代码即可训练模型,也可轻松集成自定义模型。项目实现了分布式训练功能,并汇总了相关论文解读和代码资源链接,包括CrowdCLIP、FFNet等前沿方法。附带的参考链接涵盖了数据集使用指南、算法详解和GitHub项目资源,为研究者提供了完整的人群计数学习路径和技术支持。原创 2025-12-15 09:48:25 · 745 阅读 · 0 评论 -
LightningCLI教程 + 视频讲解
本文介绍PyTorch Lightning的LightningCLI工具,它可以自动生成命令行接口,简化深度学习项目配置。传统方式需要手动编写参数解析代码,而LightningCLI通过分析LightningModule和LightningDataModule的初始化参数,自动生成完整的命令行和配置文件支持。相比传统方式,它减少了样板代码,统一管理配置,使训练启动更加高效,只需几行核心代码即可完成复杂功能。原创 2025-11-22 17:00:58 · 333 阅读 · 0 评论 -
论文TMTB(Taste More, Taste Better: Diverse Data and Strong Model Boost Semi-Supervised Crowd Count)详解
全监督,半监督以及无监督在人群计数中都有所研究,但是相关的研究并不太多,大部分都是基于全监督并且是基于密度图的人群统计,当然还有很多其他的研究,这里就不一一例举出来了。本文要讲的是刚刚发表出来的基于半监督来做的,作者主要是从修复增强以及引入了新的网络架构mamba在人群计数中,mamba也是我目前第一次在人群计数中使用,当然作者也不是直接拿来用,而是基于mamba的骨干网络(backbone)来进行改进的,从实验的效果来看,这篇论文得到效果再大部分数据集上的效果还是可以的。原创 2025-11-01 13:23:24 · 1111 阅读 · 0 评论 -
MiniGPT-v2论文中几个关键名词介绍(重要)
计算机视觉与自然语言处理的交叉任务包括:视觉问答(VQA)用于回答图像相关问题;图像描述(ImageCaption)生成文本描述;指代表达(ReferringExpression)解析特定区域的语言指代;带定位的图像描述(GroundedImageCaption)结合视觉定位;区域识别(RegionIdentification)定位特定区域;目标解析与定位(Object parsing and grounding)识别并定位对象;目标身份验证(object identification)确认对象身份。这些任原创 2025-09-26 16:22:42 · 1205 阅读 · 0 评论 -
PyTorch Lightning教程就看这篇(视频教程 + 文字教程)
简介:PyTorch Lightning 是一个基于 PyTorch 的高级深度学习框架,旨在将科研代码的灵活性与工程化最佳实践结合,通过标准化训练流程大幅减少模板代码。其中,继承LightningModule之后,可以很方便的把自己的训练过程,验证以及测试过程都给集成起来,包括优化器的配置等函数,可以比较容易的进行配置和训练。定义Trainer之后,结合继承至LightningModule对象,就可以实现完整的训练了(除了一些额外的配置之外)。这个视频和文字教程就是想让大家快速的上手PyTorch Lig原创 2025-05-20 19:06:35 · 4026 阅读 · 0 评论 -
Reference-less Counting,Zero-shot Counting,Few-shot Counting,单域泛化以及域自适应之间的区别?
之所以这里会着重区分“Reference-less Counting,Zero-shot Counting,Few-shot Counting,单元域泛化以及域自适应”这个五个概念的区别,是因为真的很重要。我们在学习的过程中经常容易把这些问题给搞混淆,而恰恰这些概念又是非常重要的,那么我们在给被人讲述,写东西或者自己看论文的时候也容易犯糊涂。因此,这篇博文着重把这几个概念加入进来,当然,最后,我们也会探讨“全监督,半监督,开发世界识别和开发词汇识别”。原创 2025-05-12 15:29:53 · 1355 阅读 · 0 评论 -
开源项目minGPT应用案例详解(PyTorch)
minGPT 是GPT的 PyTorch 重新实现,包含训练和推理功能。minGPT 力求精简、简洁、可解释且具有教育意义,因为目前大多数 GPT 模型实现可能略显臃肿。GPT 并非一个复杂的模型,该实现大约有 300 行代码。其工作原理是将一系列索引输入到Transformer中,然后得出序列中下一个索引的概率分布。其复杂性主要体现在巧妙地进行批处理(跨样本和跨序列长度),以提高效率。重写的nanoGPT,从单纯的教育导向转向一个仍然简单易行但又有实际意义的东西。原创 2025-05-11 12:45:05 · 1129 阅读 · 0 评论 -
我真的对anchor-base & anchor-free了解吗?(目标检测算法Faster-RCNN,YOLO系列,SSD,CornerNet,FCOS,EfficientDet等)
在目标检测领域主要分为两阶段和一阶段算法,其中不管是两阶段还是一阶段目标检测算法,其中细分的话,还可以分为anchor-based和anchor-free算法,基于anchor的算法好处是事先得到网格上的box,根据设计的anchor box对gt box进行匹配计算偏移量用于模型回归计算,这样的好处是能让模型快速的收敛,并且检测的效果还不错,在后处理方面主要是通过anchor box对其预测的偏移量进行解码,同时为了消除冗余的box以及重叠的box会设置IOU阈值和置信度阈值得到最终的预测框。原创 2024-12-30 16:03:42 · 1754 阅读 · 0 评论 -
window11下编译protobuf源码以及解决编译过程中遇到的问题
(关于源码的编译可以看这里)原创 2024-09-28 13:43:34 · 1161 阅读 · 0 评论 -
论文The Effectiveness of a Simplified Model Structure for Crowd Counting(FFNet)详解
当前的人群统计模型方法比较复杂,使用简单的 结构构建一个高性能的人群统计模型。采用多尺度特征融合的方法主要目的是对不同尺。第二点:一个多尺度特征融合结构,这个多尺度特征。融合结构包含三个分支,并且融合的方法采用直。第一点:采用已有的分类模型。原创 2024-08-20 16:07:15 · 1826 阅读 · 2 评论 -
接触计算机专业 => 学习计算机&学习编程 => 模仿代码 => 开始理解代码 => 提升自我(C/C++/Python/深度学习-PyTorch&TensorFlow&PaddlePaddle)
总结一点就是如果自己在接触一门语言之前,对这门语言没有一点了解,那么可以根据相关的视频从头开始学习,但是如果有了该语言一定基础的小伙伴就不要从头开始学习,我比较喜欢找一些简单的案例开始学习,从简单的案例中学习会进步的更快并且时间上也会节省很多,我们学习的过程中不要试图把所有的东西都记住,而是在学习的过程中去总结和掌握。“有时候做的越多并不是越好的,明确自己的方向,做出正确的选择可能才是最重要的”,我相信每个人都有自己的观点,不要因为我的观点而影响自己。努力很重要,选择同样很重要。原创 2024-08-16 15:56:05 · 657 阅读 · 0 评论 -
paddlepaddle深度学习框架训练LeNet5模型(一)
paddlepaddle深度学习框架训练LeNet5模型(一)原创 2023-07-21 21:40:08 · 1031 阅读 · 0 评论 -
windows平台使用CMake工具对darknet的编译以及安装过程+yolov3+图像检测+摄像头检测+视频检测+手机作为摄像头进行检测(详解)
windows平台使用CMake工具对darknet的编译以及安装过程+yolov3+图像检测+摄像头检测+视频检测+手机作为摄像头进行检测(详解)原创 2023-05-22 13:43:04 · 3271 阅读 · 3 评论 -
DarkNet的编译及安装的过程(无GPU的情况详解)
DarkNet安装的过程(详解)原创 2023-05-20 12:23:57 · 1837 阅读 · 2 评论 -
GAN原理及Pytorch框架实现GAN(比较容易理解)
Pytorch框架实现GAN(比较容易理解)原创 2023-04-26 14:58:23 · 7104 阅读 · 13 评论 -
基于Pytorch框架的目标检测迁移学习和微调训练自己的数据集
基于Pytorch框架的目标检测迁移学习和微调训练自己的数据集原创 2023-04-21 12:00:31 · 1395 阅读 · 4 评论 -
使用python修改文件名并保存
使用python修改文件名并保存原创 2023-01-02 15:03:33 · 1614 阅读 · 0 评论 -
使用Tensorflow训练检测口罩模型完整实例
使用Tensorflow训练检测口罩模型完整实例原创 2023-01-01 22:20:44 · 1774 阅读 · 3 评论 -
使用pytorch加载数据集和对数据集进行处理
使用pytorch加载数据集和对数据集进行处理原创 2022-12-30 20:45:27 · 1155 阅读 · 0 评论 -
Tensorflow中预处理图像的方法
Tensorflow中预处理图像的方法原创 2022-12-29 15:13:54 · 2383 阅读 · 0 评论 -
从开始学习算法到学习计算机视觉
从开始学习算法到学习计算机视觉原创 2022-10-21 17:32:10 · 745 阅读 · 0 评论 -
FCN中制作自己的数据集并进行训练
FCN中制作自己的数据集并进行训练原创 2022-07-30 23:53:14 · 3374 阅读 · 6 评论 -
深度学习领域语义分割常用数据集:PASCAL VOC 2007 ,2012 NYUDv2 SUNRGBD CityScapes CamVid SIFT-Flow 7大数据集介绍
深度学习领域语义分割常用数据集:PASCAL VOC 2007 ,2012 NYUDv2 SUNRGBD CityScapes CamVid SIFT-Flow 7大数据集介绍原创 2022-07-24 13:48:26 · 5927 阅读 · 0 评论 -
使用MobileNet_SSD进行目标检测
使用MobileNet_SSD进行目标检测原创 2022-07-14 18:39:33 · 5498 阅读 · 4 评论 -
图像分割FCN项目实战:测试和数据集训练
图像分割FCN项目实战:测试和数据集训练原创 2022-07-14 09:17:16 · 2878 阅读 · 7 评论 -
Nodejs安装和下载
Nodejs安装和下载原创 2022-06-28 19:52:36 · 3741 阅读 · 0 评论 -
深度学习之网络模型
深度学习网路模型原创 2022-06-25 15:31:40 · 3990 阅读 · 3 评论 -
使用Tensorflow实现EfficientNetV2-S结构
使用Tensorflow实现EfficientNetV2结构原创 2022-06-08 20:33:34 · 1648 阅读 · 0 评论 -
使用EfficientNetV1训练数据集进行图片预测(前端显示图片,包括微调对比)
使用EfficientNetV1训练数据集进行图片预测(前端显示图片,包括微调对比)原创 2022-06-02 21:53:16 · 923 阅读 · 0 评论 -
使用Tensorflow实现EfficientNetV1网络结构
使用tensorflow实现EfficientNetV1网络结构原创 2022-06-02 16:05:15 · 604 阅读 · 0 评论 -
神经网络参数量,计算量FLOPS,内存访问量MAC
文章目录神经网络参数量,计算量FLOPS,内存访问量MAC(Memory Access Cost)对于卷积层而言:1.神经网络参数量计算方式2.计算量3.内存访问量对于全连接层而言:1.参数量2.计算量3.内存访问量BN层的参数量:神经网络参数量,计算量FLOPS,内存访问量MAC(Memory Access Cost)对于卷积层而言:1.神经网络参数量计算方式卷积层:假设输入特征图大小为: Hin x Win x M,卷积核大小KxK,N个卷积核,输出特征图大小为Hout x Wout x N.原创 2022-05-07 21:32:17 · 4938 阅读 · 4 评论 -
ValueError: The list of inputs passed to the model is redundant. All inputs should only appear once.
文章目录1.出错截图2.解决出现问题的地方1.出错截图2.解决出现问题的地方这个地方需要注意,需要事先将input_shape使用keras.Input转换为网络层可以接收的数据类型,那么才能传递给下面的卷积网络进行卷积。...原创 2022-05-03 21:41:14 · 939 阅读 · 0 评论 -
使用TensorFlow-2.6.0实现Inception-ResNet-V2网络结构
1.输出结果2.InceptionV4网络结构细节https://mydreamambitious.blog.csdn.net/article/details/1244148003.代码复现import osimport kerasimport numpy as npimport tensorflow as tffrom tensorflow.keras import modelsfrom tensorflow.keras import layersfrom tensorfl原创 2022-04-27 22:02:12 · 1108 阅读 · 1 评论 -
InceptionV4,Inception-ResNet-V2,Inception-ResNet-V1(TensorFlow-2.6.0实现结构)
文章目录1.InceptionV4结构(1)整体网络结构(2)主干网络结构(Stem)(3)Inception模块(4)降采样模块2.InceptionV4整体讲解3.Inception-ResNet-V1结构(1)整体网络结构(2)主干网络(Stem)(3)Inception-ResNet-V1模块(4)降采样模块4.10.inception-ResNet-V2(1)整体网络结构(2)主干网络(Stem)(3)inception-ResNet-V2模块(4)降采样模块5.单模型,单帧和多帧的预测结果对比(原创 2022-04-27 21:56:44 · 3384 阅读 · 0 评论 -
使用TensorFlow-2.6.0实现Inception-ResNet-V1网络结构
文章目录1.输出结果2.InceptionV4网络结构细节3.代码复现1.输出结果2.InceptionV4网络结构细节https://mydreamambitious.blog.csdn.net/article/details/1244148003.代码复现import osimport kerasimport numpy as npimport tensorflow as tffrom tensorflow.keras import modelsfrom tensorflow原创 2022-04-27 21:55:30 · 694 阅读 · 0 评论 -
使用TensorFlow-2.6.0实现InceptionV4网络结构
文章目录1.输出结果2.InceptionV4网络结构细节3.代码复现1.输出结果从原始论文中可以看到这个结构设计没有什么问题。2.InceptionV4网络结构细节3.代码复现以下代码有点多,希望读者在阅读的时候最好对应每一个模块结构进行比较的看。其中每一个模块代指什么我已经标识出来。import osimport kerasimport numpy as npimport tensorflow as tffrom tensorflow.keras import models原创 2022-04-27 21:55:04 · 1068 阅读 · 2 评论
分享