- 博客(126)
- 收藏
- 关注
原创 VS Code Remote-SSH 连接Jetson踩坑完整解决记录(网段不通+主机密钥变更双重故障)
先执行ipconfig核对Windows网卡网段,和JetsonifconfigIP对比,确保同网段;CMD手动ping、ssh测试连通性,确认网络无问题;若ssh报密钥变更,执行ssh-keygen -R 目标IP清除旧指纹;手动ssh登录一次设备,完成新指纹信任;清理VS Code远程缓存,重启软件重连。网线直连≠同网段,静态IP设备必须手动对齐子网,这是嵌入式开发高频盲区;Jetson刷机/换系统后一定会触发SSH主机密钥变更,属于SSH安全机制,不是设备故障;
2026-07-17 15:24:21
238
原创 YOLOE:清华开源!实时感知一切的统一开放视觉检测模型
YOLOE是清华大学团队为开放集视觉检测带来的颠覆性成果,通过RepRTA、SAVPE、LRPC三大原创策略,首次实现了多范式开放提示、检测+分割、实时高效、训练轻量的四重统一。相比现有SOTA模型,YOLOE在性能、效率、成本上全面领先,且能无缝兼容传统封闭集检测,真正做到“一个模型,看见一切”。作为开源项目,YOLOE的代码和预训练模型已全部开放,为计算机视觉研究者和工程师提供了全新的开放检测基线,也为YOLO系列的未来发展指明了开放集的方向。
2026-03-12 10:05:10
114
原创 USB转网口+Windows共享网络异常:ax650无法上网排查与完美解决
ax650无法上网,看似是设备侧DNS/网络配置问题,实则是Windows ICS功能异常导致的IP/DNS转发失效,与ax650本地配置无关。
2026-02-13 15:26:41
852
原创 理解“x86 主机”与 ARM 交叉编译 —— Windows / Ubuntu 是否适用?
x86 是 Intel 提出的 CPU 指令集架构。x86_64AMD6464 位 x86IntelAMDARM 是另一种 CPU 架构。Jetson瑞芯微AX650树莓派手机 SoCaarch64项目x86_64aarch64CPU 架构ARM典型设备PC、服务器是否适合作为交叉编译主机是否是否需要交叉编译是(编 ARM)不需要x86 是 CPU 架构,不是操作系统。Windows 电脑 99% 是 x86_64。
2026-02-10 10:12:41
542
原创 【踩坑实录】Windows ICS 共享网络下,国产化盒子 SSH 连接异常的完整分析
网络问题 70% 不是“不通”而是“通到了你没意识到的那个接口”SSH 失败,先看Link双网口,先关一个同网段 ≈ 高风险状态。
2026-02-02 11:47:31
494
原创 国产边缘计算盒联网踩坑实录:从WiFi/USB共享到有线通网,一文讲清所有问题
DNS(域名系统,Domain Name System),本质是互联网的“通讯录/电话本”域名:如baidu.comgoogle.com,是给人看、让人记忆的“网络别名”,符合人的记忆习惯;IP地址:如百度的110.242.68.3、Windows网关192.168.137.1,是设备在网络中的“唯一身份证号”,互联网底层通信(TCP/IP协议)仅认IP地址,所有设备间的交互本质都是IP之间的通信;DNS的核心功能:将好记的域名翻译/解析。
2026-01-28 08:48:32
778
1
原创 昇腾与Jetson核心疑问解析:结合某高校自研国产盒子的实际场景说明
极简总结:AscendCL是昇腾NPU的“CUDA”,CUDA是Jetson GPU的“AscendCL”,两者都是“硬件算力的翻译官”,把上层应用的需求转换成硬件能听懂的指令。核心结论:AscendCL与CUDA是完全同级的“底层计算接口”,都是连接上层应用和硬件算力的“桥梁”,只是分别服务于不同品牌的硬件。结论:Ubuntu是“基础操作系统”,专属SDK是“专用NPU的算力钥匙”,两者功能完全不重叠,缺一不可。,工具包是绑定硬件的“专属算力调用工具”,跨生态自然无法兼容。
2026-01-27 15:25:41
683
原创 为什么大容量硬盘挂载失败,而小优盘却能直接使用?——Linux 挂载文件系统问题解析
场景文件系统问题解决方法大容量硬盘NTFS挂载失败,无法写入安装ntfs-3g大容量硬盘exFAT挂载失败安装或升级内核小优盘FAT32正常挂载内核自带支持,无需额外操作。
2026-01-26 14:55:20
695
1
原创 傅里叶变换、DFT 与 FFT 的区别:从原理到工程实现
对于长度为NNN的离散信号xnx(n)xnXk∑n0N−1xne−j2πNknk01N−1Xkn0∑N−1xne−jN2πknk01N−1xn1N∑k0N−1Xkej2πNknxnN1k0∑N−1XkejN2πknzajbz = a + jbzajbz∗a−jbz∗a−。
2026-01-05 14:40:41
1467
原创 ROS核心疑问解答:catkin是什么?环境配置能否一劳永逸?
catkin是ROS 1的官方构建系统,负责ROS包的编译、依赖管理和环境配置;是其快捷编译指令,简化构建流程;“每次source”是ROS的灵活设计,避免多工作空间/版本冲突;开发阶段可通过修改.bashrc自动加载,产品阶段可封装启动脚本、系统服务或Docker镜像,实现用户无感知;实际开发中,优先使用“修改.bashrc”(开发阶段)或“封装启动脚本”(产品阶段),简单高效且不易出错。如果在配置过程中遇到问题(比如.bashrc修改后不生效、系统服务启动失败),欢迎在评论区留言讨论!
2025-12-26 17:50:38
871
原创 一文搞懂SLAM:移动机器人的“自主定位导航灵魂”(ROS场景实战关联)
SLAM是的缩写,中文译为“同时定位与地图构建SLAM的本质是“边定位、边建图”,解决未知环境中机器人的“自主认路”问题;雷达、IMU是SLAM的核心传感器,LIO是常用的融合算法,ROS提供了成熟的SLAM工具链;你之前用的GMapping+LIO方案,是典型的2D激光-惯性融合SLAM,适用于地面机器人室内导航;工程中选择SLAM方案,需结合传感器成本、算力、环境场景(比如室内2D用GMapping,户外3D用LIO-SAM)。
2025-12-26 10:33:55
3709
1
原创 ROS建图导航核心知识:雷达/IMU/里程计区别、LIO算法解析与3D点云转2D原理
雷达、IMU、里程计是ROS建图导航的“铁三角”:雷达看环境、IMU感自身、里程计定位置,三者协同才能实现稳定的建图导航;LIO算法是“里程计精度的关键”:通过融合雷达和IMU的优势,解决纯雷达/纯IMU的痛点,输出高频低漂移的里程计数据;3D点云转2D激光扫描是“工程化优化”:核心是适配经典算法、降低算力消耗、满足地面导航需求,是大多数ROS移动机器人的实用选择。如果在实际开发中遇到具体问题(如LIO算法调优、3D转2D参数配置),欢迎在评论区留言讨论!
2025-12-26 09:53:24
1308
原创 C++ 工程编译模式详解:Debug 与 Release,以及跨平台实践
通过合理使用 CMake + VS2019 + Release 模式,我们既能方便开发,又能保证 TrackerDSST 或其他算法项目在 Windows / Linux 上高效运行。Tip:即便在 VS2019 中直接建工程,正式部署时也要切换到 Release 模式,否则算法性能可能严重受限。之前有人问:“VS2019 可以直接编译,CMake 有必要吗?,而是生成 VS 工程文件,让跨平台、大项目和多依赖管理更简单。本文结合我的实践经验,系统回答这些问题。注意:在 Windows + VS 下,
2025-12-09 11:54:05
213
原创 Kernelized Correlation Filter(KCF)目标跟踪算法原理与实现解析
KCF的核心贡献在于将循环矩阵、频域计算与核岭回归深度融合,打破了传统跟踪算法“精度-速度”的权衡困境。其本质是通过数学技巧简化复杂计算:用循环矩阵模拟海量训练样本,用频域点乘替代时域滑动运算,用核岭回归闭式解避免迭代优化,最终实现“高精度+高速度”的目标跟踪。尽管存在尺度与遮挡的局限性,KCF仍是目标跟踪领域的里程碑算法,其核心思想被后续CSK、DSST、ECO等算法继承与扩展,至今仍是实时跟踪场景的重要参考方案。
2025-12-04 20:41:32
1831
原创 理清Linux环境中NVIDIA组件:版本查看与环境一致性解析
在Linux服务器上进行GPU开发(尤其是深度学习)时,NVIDIA的一系列组件(驱动、CUDA、cuDNN等)常常让人 confusion。本文将详细梳理这些组件在**公共环境(系统级)和虚拟环境(如conda)**中的版本查看方法,以及版本一致性的要求。在开始前,先快速回顾各组件的层级关系(从底层到上层):输出中“Driver Version”即为驱动版本,“CUDA Version”是驱动支持的最高CUDA版本(非当前安装的CUDA版本)。虚拟环境(如conda):驱动是系统级资源,虚拟环境无法单
2025-11-13 15:54:52
633
原创 一帧就能“训练”的目标跟踪算法:通俗理解 KCF 的训练机制
想象你有一个 5×5 的目标窗口。现在我们让它“往右移一格”,最右边那一列会绕回左边,就像图像是“首尾相连”的。这就是循环平移。对原始窗口做所有可能的平移(上下左右、斜向等),就得到了一大堆样本:KCF 的训练并不依赖多帧数据,而是利用第一帧的目标窗口,通过循环平移自动生成成千上万对“样本—高斯标签”,再用最小二乘法求出一个滤波器,使得它的输出在目标位置产生最大响应。这就是为什么——KCF 只用一帧也能完成训练。
2025-11-12 15:34:57
914
原创 如何查看 Linux 下正在运行的 Python 程序是哪一个
在服务器上训练模型或者跑推理,经常会遇到一个典型问题:某个 GPU、某个 CPU 已经被占用,但是不知道是哪段 Python 在跑。无论是自己正在跑训练,还是别人占用了 GPU,只要有 PID,就能完全知道它在跑哪一个 python 文件,用了哪些参数,在干什么。/proc/PID/cmdline 是内核暴露出来的实际启动命令(参数之间用 0 字节分隔)x:显示没有 tty 的进程(daemon / nohup / 后台也能显示)-o cmd:o=output,输出字段,这里只要 cmd(启动命令)
2025-11-07 08:54:48
434
原创 如何避免 SSH 掉线导致服务器程序中断?(含 tmux 基本指令)
很多人用笔记本通过 mobiXterm/VSCode/ssh 连接服务器跑训练,一旦笔记本断网、合盖、换 Wi-Fi,SSH 会中断,然后训练程序直接被杀。二,让程序运行与 SSH session 解耦,SSH 掉线程序仍然继续跑。这只减少“长时间 idle 掉线”问题,不解决“你网络真的断”这种情况。SSH 掉线也不会停,但它没有 tmux 那么方便“再进去看现场”。这一个习惯就能彻底避免“笔记本断网导致训练中断”的问题。你就算断网,这个虚拟终端仍然在服务器里跑。tmux 不会退出,训练继续跑。
2025-11-06 15:04:37
422
原创 为什么 transformers 要 import TensorFlow
很多模型和工具模块(尤其与 image/video 预处理相关的统一接口层)在 package import 时会触发导入与后端相关的模块检查 —— 这就把 TF 的 import 放在了很早(全局)的位置。或尝试导入 TF 相关子模块以检测能力,这就暴露了“必须能 import TF 或至少能成功 import TF 的一部分依赖”的要求。如果你的环境里装了部分 TF(或某些工具以为 TF 存在),但缺少其中一个基础包,就会在 TF 初始化阶段报错(像上面的。的 import,进入到。
2025-11-04 15:34:56
762
原创 HTTP 请求与数据交互全景指南:Request、GET、POST、JSON 及 curl
HTTP 请求的基本概念常用方法数据交换格式:JSON 的序列化与反序列化命令行调试工具:curl 的使用技巧实战操作:Python 与 curl 对照完成 GET/POST 请求,并解析 JSON完整流程对照表:一眼理解请求发送、响应接收、数据解析的全过程。
2025-11-04 14:59:17
1402
原创 使用 TortoiseGit 正确提交子模块代码与处理 Unknown 文件
目标操作目录菜单路径说明只提交子模块改动MediaCore子模块目录推荐做法忽略主项目提示主项目目录Ignore子模块开发者无需理会处理 Unknown 文件Commit 窗口勾选或忽略根据文件类型判断使用 TortoiseGit 管理子模块时,最容易混淆的地方就是主项目与子模块的边界。改了哪个模块,就在那个模块里 Commit;不要在主项目里提交子模块的改动。这样不仅能避免冲突,还能让版本历史更清晰,协作更高效。
2025-10-21 15:42:10
1125
原创 YOLOv10 项目适配 JetPack 6.2.1 系统(TensorRT 10.x / CUDA 12.5)
YOLOv10 项目可以在系统下顺利编译和运行。解决了.destroy()不兼容的问题。可选向下兼容宏保证旧系统(<= TensorRT 8.5)仍能编译。
2025-10-21 11:25:29
1039
原创 Jetson Orin NX 安装与升级 JetPack 6.2.1 实战指南
JetPack 是 NVIDIA 为 Jetson 系列设备提供的一体化系统开发套件,包含操作系统、驱动、CUDA、cuDNN、TensorRT、OpenCV、VPI 等核心组件。JetPack 6.2.1 对应的底层系统是CUDA 12.4 与 cuDNN 9 支持TensorRT 10.x 推理优化框架升级版 VPI 与 DeepStream SDK对 Orin Nano / NX / AGX 全系列完全兼容改进的功耗与热管理机制。
2025-10-20 15:11:32
2887
原创 如何实现 5 μm 精度的视觉检测?不仅仅是相机的事
实现 5 μm 精度检测,并不是买个高分辨率相机就够了,而是一个系统工程相机:保证像素分辨率能达到目标精度。镜头:选用远心镜头或显微镜头,避免畸变与透视误差。光学照明:确保目标特征有足够对比度。运动平台:保证定位与重复精度。算法:AI 用于缺陷识别,传统算法用于尺寸计算。只有各环节协同,才能真正实现5 μm 级别的视觉检测能力。
2025-09-22 17:01:38
1480
原创 基于 Unitree L1 的 SLAM 实践 —— 从 LIO-SAM 到 Point-LIO
机械多线雷达(重复扫描):如 Velodyne、Ouster。每条激光束固定角度,每转一圈扫描轨迹相同。点云规则,有 ring 字段。非重复扫描雷达:如 Livox Horizon、Unitree L1/L2。采用振镜/旋镜,让激光束轨迹准随机分布,每帧覆盖不同区域。单帧点云稀疏,分布不规则随着时间累积,能逐渐填充整个视场,最终形成稠密点云体积小、重量轻、成本更低👉 Unitree L1 就是一款非重复扫描 LiDAR,因此点云没有 ring 字段。
2025-09-01 11:39:23
1411
原创 Point-LIO 详解与非重复扫描雷达解析
LiDAR 的成像方式主要分为重复扫描和非重复扫描非重复扫描雷达(如 Unitree L1)单帧稀疏、轨迹不重复,但随着时间积累能得到稠密点云,轻量、低成本,适合机器人建图。Point-LIO不依赖特征点提取和 ring 字段,采用点到体素 ICP + 紧耦合 IMU 融合,既鲁棒又高效。对于 Unitree L1,Point-LIO 是最佳选择,相比 LIO-SAM 更稳定、更易用。
2025-09-01 11:37:58
1087
原创 相机曝光调节与自动曝光控制详解
曝光不仅仅是曝光时间,还包括光圈和增益,但在工业相机中通常主要是“曝光时间 + 增益”。曝光时间决定亮度和模糊程度,同时受制于帧率上限。自动曝光的核心是“测光—误差计算—参数调整—迭代”,既可以依赖硬件驱动,也可以在软件层面实现自定义控制。无论是机器视觉中的弱小目标检测,还是日常摄影,合理的曝光控制都是获取高质量图像的前提。
2025-08-22 11:31:55
1896
原创 基于 Unitree LiDAR L1 的 LIO-SAM 入门指南
在自动驾驶、无人机与移动机器人等领域,实时定位与建图(SLAM)是核心技术。对于高频采集的 LiDAR 和 IMU 数据,如何融合实现精确定位,是研究与工程实践的重要环节。本文将带你从零开始了解LIO-SAM,并结合,给出完整跑通流程与注意事项,帮助工程师快速上手。LIO-SAM(LiDAR-Inertial Odometry via Smoothing And Mapping)是一种基于LiDAR + IMU 融合的实时建图与定位系统,由香港科技大学 Tixiao Shan 开源。
2025-08-20 17:19:55
1883
原创 ROS 版本与依赖管理笔记:以 GTSAM 为例
ROS 有多个版本,是因为它和 Ubuntu LTS 紧密绑定,同时需要逐步迭代功能,每个版本有自己的生命周期。通过或可以快速查询你当前的 ROS 版本。在依赖说明中看到 “依赖核心是 GTSAM 4.x”,说明项目必须依赖 GTSAM 4 系列,而“官方推荐的 PPA”则提供了最便捷的安装方式。理解这些基础点,可以大大减少在环境搭建中的踩坑概率,也能更快地上手 ROS 项目。
2025-08-20 08:30:58
876
原创 Unitree LiDAR L1 在 ROS 中的点云与 IMU 可视化实践
官方run.launch已经集成了 RViz 显示和 LiDAR 驱动节点点云和 IMU 的话题是节点内部定义的和IMU 红色错误通常是 TF 问题,可用修正通过升级版 launch,开机即可看到对齐的点云和 IMU通过理解官方节点、话题发布和 TF 机制,你就能轻松掌握 LiDAR 数据可视化流程,为后续 SLAM、障碍物检测和自动驾驶打下基础。
2025-08-19 13:55:32
687
原创 从零理解:为什么 `roslaunch unitree_lidar_ros run.launch` 就能看到点云?
所以,官方已经写好并封装了驱动节点;你只需要编译 + 启动;数据就能自动流入 ROS 的话题系统;RViz 再订阅话题,就能展示点云。这就是 ROS 的威力:把“硬件 → 驱动 → 数据 → 可视化”这一整套流程都标准化了。
2025-08-19 11:03:31
647
原创 宏观认识 Unitree LiDAR L1 及其在自动驾驶中的应用
Unitree LiDAR L1是一款多线激光雷达,集成了高精度点云采集和IMU功能,为自动驾驶提供关键感知数据。其SDK支持底层数据获取与解析,而ROS包则将数据封装为标准化话题,便于系统集成。在自动驾驶应用中,LiDAR L1可参与感知层环境建模,结合IMU实现定位与建图,最终形成感知-决策-控制的闭环系统。开发建议从基础数据获取起步,逐步接入定位算法(如LIO-SAM),最终构建完整自动驾驶框架。该设备为中小型自动驾驶平台提供了高性价比的感知解决方案。
2025-08-18 18:33:13
1327
原创 理解 ROS1 工作空间和包的目录结构:src 与 include 的关系
本文介绍了ROS1工作空间和包的基本目录结构,重点解释了src和include目录的双重含义及其关系。工作空间的src用于存放多个ROS包,而每个包内部的src则存放源码文件,include存放头文件。文章通过对比分析指出不应将节点直接放在工作空间src下的原因,强调遵循标准结构的重要性,并提供了实践建议。最后通过建筑工程类比帮助理解,建议初学者从规范结构入手,便于后续开发扩展。
2025-08-18 16:41:40
576
原创 形态学图像处理:腐蚀、膨胀、开运算与闭运算的原理与实战
本文介绍了形态学图像处理中四种核心操作:腐蚀、膨胀、开运算和闭运算的原理与应用。形态学操作通过结构元素对图像形状进行调整,可用于去噪、边缘增强、目标提取等任务。腐蚀缩小亮区域,膨胀扩大目标,开运算去除亮噪点,闭运算填补黑洞。文章还提出了一种差分增强算法(MNWTH),通过膨胀-腐蚀-差分的组合突出弱小目标。结构元素的设计(如方形、椭圆形、环形)会直接影响处理效果。合理组合这些操作能构建更鲁棒的图像预处理算法,适用于低照度、弱特征的场景。形态学操作是计算机视觉中不可或缺的基础工具。
2025-07-14 11:55:15
276
原创 Jetson 入门必看:JetPack 系统到底要不要烧录?新手也能看懂!
Ubuntu 系统(定制版)CUDA、cuDNN、TensorRT(用于 AI 推理加速)OpenCV、摄像头驱动、编解码库BSP(硬件支持包)Jetson 系列之所以强大,正是因为 JetPack 把 AI 所需的工具和驱动都集成在一起了。烧录,就是把 JetPack 系统安装到 Jetson 的内部存储(eMMC、NVMe、SD 卡)里,就像你给一台新电脑装 Windows 系统一样。
2025-05-23 17:05:15
1153
原创 Jetson系统烧录与环境配置全流程详解(含驱动、GCC、.Net设置)
本文从系统烧录开始,到环境搭建、GCC、.Net 配置,再到摄像头驱动安装,覆盖了 Jetson 开发板常用的基础操作流程,适用于大多数国产主板 + 模块组合的新手开发者。Jetson平台摄像头图像采集、ISP调试与多路并发采集实战(基于 v4l2 + OpenCV)如需定制 Jetson 系统裁剪、定制部署、摄像头驱动适配等,也欢迎私信交流!
2025-05-23 17:02:44
2303
原创 使用 SiamMask 实现单目标逐帧跟踪与掩码中心提取
加载 SiamMask 模型与配置文件读取首帧标签并初始化跟踪器逐帧读取图像并执行提取目标掩码并计算其中心点输出每帧的目标中心坐标。
2025-05-15 18:21:27
268
原创 基于中心点预测的视觉评估与可视化流程
这段脚本提供了一个简单但实用的目标中心点评估与可视化框架。相比只依赖数值结果,图像级别的直观反馈更利于发现问题、调优模型。如果你正在调试跟踪模型,不妨试试把它接入你的 pipeline 中。
2025-05-15 18:11:42
312
原创 CUDA error: no kernel image is available for execution on the device 解决方案(适配 RTX 4090)
PyTorch 版本太旧,不支持新显卡(如 RTX 4090)升级 PyTorch 到 2.1.0+使用 cu118 编译版本(CUDA 11.8),兼容 Ada 架构若有 API 不兼容问题,适当修改 SiamMask 源码即可解决如果你也遇到相同问题,希望这篇博客能帮你少踩一点坑。如果有更多关于 SiamMask 或目标跟踪相关的问题,欢迎留言交流!
2025-05-14 14:50:53
1675
2
预训练权重SiamMask-DAVIS.pth和SiamMask-VOT.pth
2025-05-07
yolov10n.pt转换得到的best.onnx,用于跨平台验证转engine是否成功,免去配环境的步骤
2025-04-16
基于caffe框架用于识别人脸,质心法实现跟踪,支持多人脸跟踪,包含配置文件deploy.prototxt和res10-300x
2022-12-19
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅