前沿视觉模型指南
文章平均质量分 94
阿_旭
专注计算机视觉、AI相关内容研究分享。目标检测、图像分割、图像分类、目标跟踪等项目均可做,有需要的可以联系我!
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
【使用指南】YOLO26-depth单目深度估计:让深度估计不再有10米天花板,速度碾压Depth Anything V2
【使用指南】YOLO26-depth单目深度估计:让深度估计不再有10米天花板,速度碾压Depth Anything V2原创 2026-07-29 12:08:47 · 546 阅读 · 0 评论 -
【完整指南】YOLO26知识蒸馏:一行代码让大模型教小模型,不增加推理成本,精度秒提升1%
【完整指南】YOLO26知识蒸馏:一行代码让大模型教小模型,不增加推理成本,精度秒提升1%原创 2026-07-27 12:54:34 · 479 阅读 · 0 评论 -
【开源】小目标计数利器GECO2:不再靠拼图,逐尺度查询让精度+10%速度×3
【开源】小目标计数利器GECO2:不再靠拼图,逐尺度查询让精度+10%速度×3原创 2026-07-26 08:00:00 · 321 阅读 · 0 评论 -
商汤SenseNova-Vision:一个模型统一所有视觉任务,全面超越,代码已开源
商汤SenseNova-Vision:一个模型统一所有视觉任务,全面超越,代码已开源原创 2026-07-25 16:19:09 · 496 阅读 · 0 评论 -
【前沿】ZipDepth轻量单目深度模型:搞定全场景深度识别,手机、无人机都能实时跑
【前沿】ZipDepth轻量单目深度模型:搞定全场景深度识别,手机、无人机都能实时跑原创 2026-07-15 11:49:36 · 593 阅读 · 0 评论 -
【亲测】LocateAnything使用教程与6大应用示例【附源码】
【亲测】LocateAnything使用教程与6大应用示例【附源码】原创 2026-06-16 18:32:30 · 1114 阅读 · 1 评论 -
重磅开源!LocateAnything 一站式搞定全场景视觉定位,解码速度暴涨 10 倍
重磅开源!LocateAnything 一站式搞定全场景视觉定位,解码速度暴涨 10 倍原创 2026-06-05 19:44:43 · 1119 阅读 · 0 评论 -
X2SAM:打通图像+视频全场景的统一多模态分割大模型
X2SAM:打通图像+视频全场景的统一多模态分割大模型原创 2026-06-03 08:21:37 · 508 阅读 · 0 评论 -
突破SAM极限!ConceptSeg-R1:从“分割物体”到“分割任意概念”,AI视觉再进化
突破SAM极限!ConceptSeg-R1:从“分割物体”到“分割任意概念”,AI视觉再进化原创 2026-05-29 10:03:14 · 479 阅读 · 0 评论 -
FSS-SAM3封神 !无训练、不调参,靠 “拼图” 搞定小样本分割,负提示词居然是绊脚石?
你有没有想过,AI 对图片 进行语义分割时,要是遇到没见过的物体,只给 1-5 张参考图,它能精准分割吗?这就是「小样本语义分割(FSS)」的核心任务 ——用极少标注样本,搞定新类别的像素级分割。但传统方法有两个大痛点:「训练成本高」:得靠海量 “模拟小样本任务” 训练模型,又费时间又费算力;「泛化能力差」:换个场景、换类物体,性能就断崖式下跌。直到视觉大模型(比如 SAM 系列)出现,大家才发现:能不能跳过训练,直接用预训练大模型解决?这篇论文就给出了答案 ——用 SAM3,不用调参、不用改结构,就能实现原创 2026-04-17 09:16:53 · 555 阅读 · 0 评论 -
【深度好文】YOLO算法的演进之路:从YOLOv1到YOLO26
【深度好文】YOLO算法的演进之路:从YOLOv1到YOLO26原创 2026-04-05 19:46:09 · 577 阅读 · 0 评论 -
手把手教你用ViT做图像分类!从环境搭建到可视化输出,5分钟上手
手把手教你用ViT做图像分类!从环境搭建到可视化输出,5分钟上手原创 2026-03-30 20:07:55 · 512 阅读 · 0 评论 -
DINOv3实战|手把手教你生成图像相似度图(附完整代码)
DINOv3实战|手把手教你生成图像相似度图(附完整代码)原创 2026-03-25 15:11:55 · 705 阅读 · 0 评论 -
从 CNN 到 ViT:视觉 Transformer 如何重构计算机视觉?
从 CNN 到 ViT:视觉 Transformer 如何重构计算机视觉?原创 2026-03-22 15:02:23 · 581 阅读 · 0 评论 -
YOLO26+SAM3实战教程:从检测到分割,一键搞定目标掩码生成【附源码】
YOLO26+SAM3实战教程:从检测到分割,一键搞定目标掩码生成【附源码】原创 2026-03-21 17:26:13 · 1168 阅读 · 0 评论 -
【保姆级教程】YOLO26网络结构可视化并保存
YOLO26网络结构可视化原创 2026-03-19 18:01:53 · 580 阅读 · 0 评论 -
YOLO26打印模型结构配置信息并查看网络模型详细参数:参数量、计算量(GFLOPS)
YOLO26打印网络结构原创 2026-03-19 16:59:51 · 518 阅读 · 0 评论 -
3年颠覆20年研究,视觉Transformer如何终结CNN时代?
3年颠覆20年研究,视觉Transformer如何终结CNN时代?原创 2026-03-18 20:50:29 · 474 阅读 · 0 评论 -
单目RGB直出深度图|Depth Anything V2从原理到实战【附源码】
单目RGB直出深度图|Depth Anything V2从原理到实战【附源码】原创 2026-03-10 18:28:54 · 1026 阅读 · 0 评论 -
YOLO26实战教程:手把手教你训练药片检测AI模型,赋能医药行业
YOLO26实战教程:手把手教你训练药片检测AI模型,赋能医药行业原创 2026-02-28 12:42:32 · 1025 阅读 · 0 评论 -
YOLO26高效部署5大核心技巧:边缘+云端实现生产级落地
YOLO26高效部署5大核心技巧:边缘+云端实现生产级落地原创 2026-02-24 07:30:00 · 1914 阅读 · 0 评论 -
超全小目标检测mAP提升指南!数据、训练调优、模型选择、评估方式、部署一站式搞定
超全小目标检测mAP提升指南!数据、训练调优、模型选择、评估方式、部署一站式搞定原创 2026-02-23 11:08:35 · 1140 阅读 · 0 评论 -
【视觉AI赋能智慧农业】三大应用场景、简化农作流程、核心价值全解析
【视觉AI赋能智慧农业】三大应用场景、简化农作流程、核心价值全解析原创 2026-02-22 21:02:03 · 1433 阅读 · 0 评论 -
YOLO26实战|转ONNX模型实现视频实时检测,可视化+FPS统计全搞定【附完整源码】
YOLO26实战|转ONNX模型实现视频实时检测,可视化+FPS统计全搞定【附完整源码】原创 2026-02-20 12:18:23 · 1052 阅读 · 0 评论 -
目标检测性能天花板之争:YOLO26 与 RF-DETR 全面对比,选型不再纠结!
目标检测性能天花板之争:YOLO26 与 RF-DETR 全面对比,选型不再纠结!原创 2026-02-11 17:07:06 · 1516 阅读 · 0 评论 -
速度与精度双突破!RF-DETR-Seg 新模型家族来袭,附完整部署 & 微调教程
速度与精度双突破!RF-DETR-Seg 新模型家族来袭,附完整部署 & 微调教程原创 2026-01-30 15:31:04 · 1247 阅读 · 0 评论 -
YOLO26与4大前沿模型性能对比:RF-DETR、 LW-DETR、YOLO11、D-FINE
YOLO26与4大前沿模型性能对比:RF-DETR、 LW-DETR、YOLO11、D-FINE原创 2026-01-15 07:30:00 · 3106 阅读 · 0 评论 -
YOLO26重磅开源!边缘AI新标杆,43%提速+端到端无NMS推理
YOLO26重磅开源!边缘AI新标杆,43%提速+端到端无NMS推理原创 2026-01-14 17:02:32 · 1475 阅读 · 0 评论 -
拆解 DINOv3 核心架构:ViT 与 ConvNeXt 的结构密码,谁更适配你的场景?
拆解 DINOv3 核心架构:ViT 与 ConvNeXt 的结构密码,谁更适配你的场景?原创 2025-12-30 11:29:31 · 2175 阅读 · 0 评论 -
一文吃透 Grounding DINO:从原理到实战,文本驱动目标检测入门教程【附源码】
一文吃透 Grounding DINO:从原理到实战,文本驱动目标检测入门教程【附源码】原创 2025-12-29 08:32:16 · 3336 阅读 · 0 评论 -
一文读懂Vision Transformer:DINO、DETR、CLIP、SAM 家族如何重塑图像理解?
一文读懂Vision Transformer:DINO、DETR、CLIP、SAM 家族如何重塑图像理解?原创 2025-12-27 13:14:27 · 1023 阅读 · 0 评论 -
【SAM3教程-5】视频分割:文本与点提示一键分割与跟踪视频中指定目标【附源码】
【SAM3教程-5】视频分割:文本与点提示一键分割与跟踪视频中指定目标【附完整步骤与源码】原创 2025-12-13 20:29:58 · 2464 阅读 · 0 评论 -
【SAM3教程-4】使用文本精准分割视频里的目标,附完整代码教程
【SAM3教程-4】使用文本精准分割视频里的目标,附完整代码教程原创 2025-12-12 15:47:57 · 1594 阅读 · 0 评论 -
【视觉前沿】OneThinker:一个模型搞定所有视觉任务!堪称图像视频的“全能推理大神”
【视觉前沿】OneThinker:一个模型搞定所有视觉任务!堪称图像视频的“全能推理大神”原创 2025-12-10 09:39:15 · 831 阅读 · 0 评论 -
【SAM3教程-3】使用提示点 + 提示框精准 “圈” 出指定目标,正负样本搭配更高效!【附源码】
【SAM3教程-3】使用提示点 + 提示框精准 “圈” 出指定目标,正负样本搭配更高效!【附源码】原创 2025-12-06 20:04:21 · 2656 阅读 · 1 评论 -
【SAM3教程-2】使用正负样本提示框一键分割图片中的相似目标详细步骤与示例
【SAM3教程-2】使用正负样本提示框一键分割图片中的相似目标详细步骤与示例原创 2025-12-04 20:34:35 · 1392 阅读 · 0 评论 -
【SAM3教程-1】SAM3 使用文本提示进行图像分割详细步骤与示例【附源码】
【SAM3教程-1】SAM3 使用文本提示进行图像分割详细步骤与示例【附源码】原创 2025-12-02 22:10:27 · 3815 阅读 · 0 评论 -
SAM3分割一切大模型中BPE文件bpe_simple_vocab_16e6.txt.gz是什么?有什么作用?
SAM3分割一切大模型中BPE文件bpe_simple_vocab_16e6.txt.gz是什么?有什么作用?原创 2025-12-01 23:14:47 · 1743 阅读 · 0 评论 -
6大顶流深度估计模型对比评估与选型指南
6大顶流深度估计模型对比评估与选型指南原创 2025-11-30 18:32:54 · 1202 阅读 · 0 评论 -
保姆级SAM 3D 配置与使用教程:从环境搭建到 3D 重建,代码 + 步骤直接抄作业!
保姆级SAM 3D 配置与使用教程:从环境搭建到 3D 重建,代码 + 步骤直接抄作业!原创 2025-11-27 07:30:00 · 5735 阅读 · 17 评论
分享