自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

Mike

学习笔记

  • 博客(140)
  • 资源 (3)
  • 收藏
  • 关注

原创 神经网络很萌的!

这是知乎上一个科普问答,“如何简单形象又有趣地讲解神经网络是什么?”其中王小龙先生的答案被赞了7K,我想答案被赞了7K,就一定有被赞了7K的道理,嗯....,绝对是这样。所以我就把王小龙先生的答案粘贴了下来,以便大家来共同学习。问题链接:https://www.zhihu.com/question/22553761王小龙先生知乎主页:https://www.zhihu.com/people/wan...

2018-03-29 21:41:43 796 1

原创 AI coding

https://blog.csdn.net/csdnnews/article/details/162330253?spm=1000.2115.3001.5926

2026-06-29 09:47:00 165

原创 数据集网站

3、OpenDataLab,上海人工智能实验室数据开放平台。2、HyperAI超神经。

2026-06-26 18:02:51 49

原创 无人机大模型综述

二、Large Language Model-Assisted UAV Operations and Communications: A Multifaceted Survey and Tutorial。不稳定链路下的通信优化、蜂群控制、低延迟机载推理。复杂环境自主导航、动态任务推理、多机协同决策。航拍目标识别、灾害损伤评估、语义分割标注。大模型辅助的无人机操作与通信工程技术栈。无人机通信、控制全流程的LLM适配方案。无人机数据集在CV任务中的应用。无线通信、边缘部署、工程落地。通用人工智能、智能体系统。

2026-06-22 14:40:17 272

原创 无人机AI技术调研

1、2、3、4、道路分割:1、2、3、4、

2026-06-18 18:03:01 50

原创 车牌识别思路借鉴

【计算机视觉】复杂场景下的车牌识别:从传统算法到深度学习的融合优化。

2026-06-04 10:29:48 208

原创 RealESRGAN超分环境配置

根据我的cuda版本,安装。

2026-06-02 17:15:00 51

原创 推流和推理什么区别

GPU 编码器(推流)是独立的硬件单元,不占用 GPU 的 CUDA/MUSA 核心。例如:用同一张 GPU ,可以同时进行 GPU 推流 + GPU 推理,互不影响。工作原理:GPU 内部有专门的编码电路(ASIC),独立于 GPU 计算核心。工作原理:CPU 执行 H.264 压缩算法,逐帧分析、运动估计、熵编码。适用场景:离线转码、对画质要求高的场景。缺点:画质略差(同等码率下)、参数受限。优点:CPU 占用低、速度快、延迟低。适用场景:实时推流、直播、视频会议。优点:画质好、参数可调、兼容性高。

2026-05-15 16:22:56 112

原创 摩尔线程AB100安装torch环境

摩尔有个自定义编译的FFmpeg,它支持的是硬件编码器(h264_mtenc)而不是软件编码器libx264,这个自定义编译的FFmpeg不支持-preset和-tune参数。都安装上这个whl包,torch、torch_musa、torchaudio、torchvision,如果pip安装,和摩尔本身的硬件不匹配。要安装pip install torchada==0.1.48,这样能和上面的版本匹配上。这个版本组合应该可以gpu加速pt模型,但是gpu加速不了onnx模型。还有一个torchada,

2026-05-15 16:07:55 189

原创 git@gitlab-rdc.xxxxx.com: Permission denied (publickey).fatal: 无法读取远程仓库。

解决方案如下第一:进入 .ssh 目录 cd 用户目录/.ssh运行下面的命令ssh-keygen -t rsa -C "xxxxxxx.dddd@xxxxx.com"根据提示,什么 都不要输入,一直回车到结束会在当前目录 生成的文档第二:打开id_ras.pub,并拷贝内容到网站的上setting的sshkey里面第三:再测试连接,再git clonessh -T git@gitlab-rdc.xxxxx.com -p 30022

2026-05-15 14:54:55 206

原创 PaddleOCR v4模型转onnx出坑记

所以我新建了python 3.10的虚拟环境,准备安装paddlepaddle-gpu 3.1.1+paddle2onnx 2.0.2rc3来重新训练模型,重新转换。踩坑之后,我以为转换onnx模型都没有成功,甚至误以为paddlepaddle-gpu 3.2.0训练的模型,都转不成onnx,所以我准备推倒重来。我选择了安装11.8的版本,为了避免其他错误,我把PaddleOCR的版本也换成了PaddleOCR-release-3.1,然后安装相关依赖。第一条命令,关于字典,可加可不加,结果是一样的。

2026-05-09 10:35:07 105

原创 PaddleOCR v4模型转onnx踩坑记

要得到.pdmodel和.pdiparams的推理格式,得用paddlepaddle==2.4.2的版本,但是现在所有的镜像上好像都没有了paddlepaddle==2.4.2的版本。在训练的时候,我的paddlepaddle用的版本是3.2.0,用的是pp-ocrv4_mobile_rec的预训练模型,在上面这个环境中,我安装paddle2onnx工具,版本是2.1.0,进行onnx模型的转换,转换命令是。这种推理模型,在paddlepaddle的环境下是可以正常推理的。幸运的是,我搜到了另一个博客。

2026-05-06 18:29:11 520

原创 yolov11训练推理命令

【代码】yolov11训练推理命令。

2026-04-27 14:48:16 66

原创 ArcMap转换坐标系

背景:我有一个tif文件,坐标系是WGS_1984_UTM_Zone_49N,不符合我的要求,我想转成GCS_WGS_1984坐标系,GCS WGS 1984 是地理坐标系(单位:度),适用于全球范围或 Web 地图服务(如 EPSG:4326)5。WGS 1984 UTM Zone 49N 是投影坐标系(单位:米),适用于局部区域(约东经111°_117°)。我用的是第二种方法,转换速度很快。

2026-04-20 17:27:46 54

原创 测试PaddleOCR

在用命令paddleocr text_detection -i ./data/test/plateimages --model_name PP-OCRv5_mobile_det测试的时候出现了问题。8、按照上面的方式只能测试pp-ocrv3和pp-ocrv4,测试不了pp-ocrv5。下载download_ch.md,在这个里面发现了pp-ocrv5模型的下载。说是卸载,按照下面这个文档重新安装,解决环境不兼容的问题。测试pp-ocrv5的命令在下面的文档里面。需要进一步安装相关环境。

2026-04-16 18:08:05 287

原创 txt_json和xml_json

【代码】txt_json和xml_json。

2026-04-10 14:12:23 81

原创 IntelliJ IDEA Community Edition 2025.1.7配置JDK11的环境变量

我刚开始没有放在最前面,通过win+R,运行cmd之后,不能出来java的版本号。放到最前面之后,再运行cmd,输入java --version,就出来版本号了。4.1、新建一个系统变量,JAVA_HOME,把刚在jdk11suo。2、开始配置jdk11的环境变量,搜索“编辑系统环境变量”这个地方新建立3个环境变量,都是系统变量的地方。分成两个,放在最前面。

2026-04-10 14:12:13 125

原创 Intellij怎么打jar包

使用Intellij Idea打包java为可执行jar包。

2026-04-09 15:32:07 44

原创 百度云车牌调用识别-Java工程

5、看这个LicensePlate的Java类代码可以发现,需要输入图片路径和access_token,什么是access_token?用这个代码,获取access_token,然后把access_token填到步骤4的代码中,再输入图片的路径,就可以开始车牌识别了。这个代码里面定义了一个名为LicensePlate的Java类,但它不仅仅是"建立"这个类,而是实现了一个完整的车牌识别功能。7、上述就是调用百度云进行车牌识别的最小单元工程,后续可以集成到大的工程里面进行车牌识别。

2026-03-25 17:23:43 256

原创 Java中JDK11的安装

JDK是SUN提供的一套Java开发环境,全称JavaDevelopmentKit,简称JDK,它是整个Java的核心,其中包括Java编译器、Java运行工具、Java文档生成工具、Java打包工具等。注意:一定要把%JAVA_HOME%\bin 放在Path的第一个;先下载JDK11,然后找到JDK11的路径,把JDK11的路径添加到系统环境变量里面。1、新建环境变量,变量名为 JAVA_HOME,变量值为 jdk 安装的路径。1、Java JDK是什么?3、JDK11、IDEA安装与环境配置。

2026-03-04 09:27:06 332

原创 IntelliJ IDEA Community Edition 2025.1.7中使用opencv

原因:ClassLoader.getSystemResource()方法是从项目的 Classpath(类路径)中查找资源,例如在 src/main/resources目录下的文件。换成了System.load("D:\\tech_data\\code\\opencv440\\opencv_java440.dll");opencv-440.jar是需要的,我的是64位系统,x64\opencv_java440.dll是需要的。点击绿色三角形按钮,运行成功,显示出图片。3、在项目中导入jar包,

2026-03-02 14:52:26 332

原创 无人机的负载设备

后来发现无人机可以搭载不同的负载设备,以此来适应不同的任务需求;如果一个任务需求用普通相机来做可能很麻烦,但是换一种负载设备,可能只是轻而易举的事情。比如河道违规排污,用可见光拍摄,难以看清排污情况,发现不了异常;换用红外热成像拍摄,排污情况清晰可见,启发来自于DJI大疆行业应用视频号的一个视频。原以为无人机只是用普通相机来适配各种检测任务;1、解答|原来无人机功能取决于搭载什么设备!

2026-02-24 16:33:29 272

原创 图像算法工程师的分类与所处行业

内卷的行业、一二线城市,对算法工程师的要求高,大路边上的问题基本上都被解决,需要学术理论型工程师对一些难点问题进行学术型攻关,需要攻关细节问题。应用型工程师,在蓝海行业方向有较大发展,一般都是先上规模,项目先有一定数量上的突破。有较大的容错和成长空间,内卷行业的成功经验可以进行复制。学术理论型工程师,往专家教授型发展,是最贴近学术界的工程实践,是学术在工业界的理论实践与创新。3、工业缺陷检测革命:当AMDANet遇上热成像——基于多模态融合的隐蔽缺陷识别新范式。高铁、汽车、无人机、工业质检、医疗AI。

2026-02-24 16:21:23 397

原创 Java编译器IntelliJ IDEA 2025.1.7社区版的下载与使用

1、IntelliJ IDEA 2025.1.7社区版的下载地址,文件大小782MB。2.1、IntelliJ IDEA 2024社区版保姆及图文安装教程。2.2、IntelliJ IDEA安装教程(超详细)

2026-02-11 15:56:51 583

原创 收集数据集和购买数据集

基于先做出成果的考虑,在开发的道路上,都是先自行收集数据集。但是有些时候在收集数据集上遇到了瓶颈,项目上有了卡点,我觉得这个时候应该购买数据集。购买数据集或许就花了一两百块钱,但是产生的效果可以让老板更信服你的能力。项目没做出来,老板最直观的归因就是能力不行。有时候想想,一两百块钱花出去产生的收益还是挺大的,一天的工资都不止一两百,还有搜索所花费的精力和时间。1、购买AI构建的数据集的优点和缺点。2、高效检索公开数据集的实用指南。

2026-02-10 16:44:44 211

原创 Vibe Coding有感

先用严密的逻辑、合理的步骤把一个问题精准地描述出来,再讲出实现的过程需要注意哪些风险点,然后才是用代码实现出来。4、查找一段几百行的代码中,某个地方需要改动或替换时,如果人工进行这项繁琐且重复的工作,极容易出错,交给AI来做,效率极高。3、避免一次提很复杂的需求,渐进式提需求,AI生成更可控,更精准。了解AI的能力边界,了解自己的能力边界。1、描述世界最精准的两个学科,法学和计算机,法学从自然语言的角度描述世界;5、思想是自己的,AI只是操刀者。就像理发,自己才是自己的发型师,别人只是按照要求执行而已。

2026-02-04 10:03:22 181

原创 工作方法论2

1、一周的工作,工作架构要在周一周二完成;一天的工作,工作架构在上班的前两个小时要完成;假设老板问我,这个工作还需要多长时间,假如在理论思路层面没有跑通,是不好回答的,不好回答,老板就没有掌控感,就会感觉你不靠谱。3、在过往的工作中,需要脑力的工作,从来不是在加班的时候完成的。如果下班时间到了,一个问题还没有明确的解决方案,再让我干两三个小时也解决不了,因为大脑已经处于混沌状态。2、做事情,先进行理论推演,再付诸实践。先在理论层面走一遍,有没有思路上的卡点,思路上没有卡点,接下来就是按部就班地执行工作。

2026-02-03 10:19:36 141

原创 Git使用

Git使用教程(超全,看一篇就够了)

2026-01-30 11:03:15 130

原创 读2025博客之星有感

3、2025年AI创业总结:左手技术,右手营销,技术人如何像运营公司一样运营超级个体。1、从Java到YOLOv11:一个倔强程序员的年度技术跨界之旅。2、工业视觉技术的深耕与突破:2025年度技术总结与实践探索。4、在代码洪流中锚定思想:AI时代开发者的知识独立性。5、我的年度工作80% AI化转型实录。

2026-01-29 10:24:11 612

原创 Linux (Ubuntu) Jetson AArch64 架构 JetPack6.2 CUDA+CUDNN+PyTorch 安装踩坑经历

尝试每种方案,当遇到问题的时候,先不要尝试解决它,而是换其他的方案继续试。可能遇到的这个问题是个固有的问题,探索下去的结果就是官方提供的包不兼容等等,意义不大。索性直接删除了虚拟环境,重新安装,然后我又发现了下面这个博主的教程。他们两个成功了,但是我按照这个教程走下来的时候,遇到了下面的问题。目的不是解决每种方案中出现的问题,目的是找出一种可用的方案即可。直接下载,然后安装就可以测试了,我在测试的时候遇到下面的问题。我觉得按照这个教程再走一遍,出现了新的问题。我安装了官方推荐的最稳定的组合。

2026-01-12 18:50:31 1098 3

原创 Docker镜像构建opencv的时候,ImportError: libGL.so.1: cannot open shared object file: No such file or directo

2、docker环境里安装opencv ImportError: libGL.so.1: cannot open shared object file: No such file or directory。最后问了AI之后,安装opencv软件之前,先安装opencv依赖。尝试了下面的方法,但是没有成功。

2025-12-25 10:56:15 211

原创 噪声对图像的影响

1、常见的噪声:高斯、泊松和椒盐噪声。

2025-12-16 10:09:09 249

原创 Opencd的数据扰动类型怎么加入

在opencd/datasets/transforms的路径下, 由一个文件是transforms.py,在这个文件中注册数据扰动的新类型,在__init__.py中加入相应的数据扰动新类型的名字,就可以在standard_256x256_40k_levircd.py文件中调用这个数据扰动新类型,以实现对数据集的预处理。Opencd框架调用的是MMCV的transform包。1、数据变换 (Data Transform)

2025-12-16 09:45:33 341

原创 TIF图片怎么用ArcMap进行裁剪

我第一次先把小的像元改为大的像元,像元由4变成了5,想着分辨率高的变成分辨率低的,是一件轻而易举的事情。1、两张TIF图片在裁剪的时候范围相同,但最后输出的图片中,图像像素的宽度和高度不同。2、ArcMap,两张范围相同,像元大小不同的tif图片,为了保证像素宽高的一致,是把大的像元改为小的像元,还是把小的像元改为大的像元?就想着如果把两个TIF图片的像元统一大小,是不是输出的像素宽高就相同了,然后就尝试了这一设想,然后就有了第二个问题。搜了一下像元是什么,简单来说,就是像元越小,图像的详细程度越高。

2025-12-15 18:46:25 432

原创 工作方法论1

最后代码不熟练、Visual studio编译器没安装成功、电脑系统崩溃了,是工作执行上出了问题,并不是工作思路上出了问题。跟老板多探讨工作思路,不然老板想让你按照这个路线干,你按照别的路线干,即使做出来了也是不符合老板所想的,而且老板觉得你不被掌控。工程化是用不同的开源代码进行实践,然后找出最适合自己的,再修修改改。工作执行要善用工具,一篇论文,自己找花了两三个小时,咸鱼上花1块钱,别人10分钟给找到了。思路又分大思路、小思路,有时候调研一天,是为了工作思路的形成,了解清楚怎么干。工作思路是准备怎么干;

2025-11-26 19:24:51 271

原创 遥感图像TIFF格式数据的处理

元数据嵌入:TIFF文件可以包含丰富的元数据信息,如拍摄日期、作者信息等,有助于图像的追踪和管理。然而,过高的压缩率会导致图像质量的明显下降。JPEG:在日常使用中,如社交媒体分享、网页浏览、电子邮件附件等场景下,JPEG因其较小的文件大小和良好的显示效果而受到青睐。JPEG:虽然JPEG也可以进行一定程度的编辑,但由于其有损压缩特性,频繁的编辑和重新保存可能会导致图像质量的进一步下降。TIFF:由于其高质量特性和对多层及透明度的支持(在某些变种中),TIFF格式更适合于复杂的图像编辑和处理任务。

2025-11-25 16:39:19 734

原创 Open-CD开源工具箱的安装

参考以下文档1、2、GitHub地址。

2025-11-21 10:19:03 226

原创 Miniforge安装

参考以下文档1、2、3、

2025-11-21 09:28:01 268

原创 图像岗位的五个方向

主要在工控方向,涉及硬件的选型、Halcon的应用。这个方向特点,涉及模型的少,主要是图像算法的应用。基于模型开发一些视觉应用,在具体硬件平台上部署。这个方向特点,前处理后处理、模型算子替换要精通。这个方向的特点是需要大的算力训练。主要在芯片行业,如图像去噪,融合。如双目视觉拼接,360环视拼接。三、图像拼接领域如机器人。如RAG、多传感器融合。

2025-08-04 11:05:37 455

原创 Windows安装虚拟机、ROS2

在Windows上安装了虚拟机VMware17和ROS2。Windows和虚拟机之间的文件互传,参考以下文档。

2025-06-29 21:17:22 220

Winmerge,支持两个文件夹下的图片同步对比,同步翻页

Winmerge,支持两个文件夹下的图片同步对比,同步翻页

2026-02-02

根据图片大小对图片进行分类

根据图片大小对图片进行分类

2022-06-18

VS2017社区版安装所需文件

1、VS2017安装引导程序 2、.Net Framework 4.6 3、SQLSysClrTypes.msi

2022-06-06

PaddleOCR构建C++测试工程所需安装包

cmake-3.15.6-win64-x64 opencv-4.2.0-vc14_vc15 PaddleOCR的cpu版本推断模型2.0.2,paddle_inference PaddleOCR工程PaddleOCR-release-2.3 Git-2.36.1-64-bit版本 dirent-master安装包

2022-05-23

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除