- 博客(1164)
- 资源 (12)
- 收藏
- 关注
原创 RadYOLO论文精读
通过精心的架构调整(Anchor-free, L1 loss, 原型掩码分割),可以将 YOLO 的高效性完美移植到 3D 医学图像领域。RadYOLO 打破了“高精度必然伴随高计算成本”的固有认知,为临床环境中(尤其是缺乏高端 GPU 的基层医院或边缘设备)的实时 3D 病灶检测与分割提供了一个极具实用价值的开源解决方案。
2026-09-14 15:16:49
314
原创 Medical Segmentation Decathlon分割标签数据转3D slicer的mrk.json
在 3D Slicer 5.x 新版中,对于 ROI 类型的立体框,它的 center(中心)、size(尺寸:长宽高) 和 orientation(方向矩阵) 属于顶层核心参数,必须直接写在 markups 的大括号内,而不是像老版本那样塞在 controlPoints(控制点)数组里面。
2026-09-09 15:09:32
40
原创 基于OpenPCDet框架训练centerpoint教程
在 OpenPCDet 框架中,使用已经下载好的 nuScenes mini 数据集训练 cbgs_voxel0075_res3d_centerpoint 模型,核心流程主要分为 数据放置、数据预处理(生成 Info 文件和 GT 数据库)、修改配置文件 以及 启动训练 四个步骤。
2026-09-08 16:48:56
24
原创 VoxTell 论文精读
架构创新:多阶段融合打破了传统"末端单次融合"的范式,让文本信息真正渗透到特征提取的全过程规模优势:158 个数据集、62K+ 体积、1K+ 概念的训练规模前所未有临床实用性:能直接解析放射报告中的句子级描述进行分割,这是此前方法无法做到的泛化能力:在跨模态和未见概念上展现出有意义的开放集泛化,虽然仍有提升空间该工作将文本提示 3D 医学分割从"闭集标签选择器"推向了真正的语言驱动开放集分割。
2026-09-02 11:26:46
309
原创 《一种基于深度学习的超分辨率重建方法及系统》专利精读
这篇专利的方法论非常前沿且严谨。它没有盲目堆叠更深的神经网络,而是抓住了工业CT成像的物理本质。“物理模型(可学习RL反卷积)打底提供先验 + 局部特征提取(RegionCNNNet)生成引导信号 + 全局注意力(Swin-UNet)在引导下进行精准重建”。这种“物理先验 + 深度学习”的融合范式(Physics-Informed Deep Learning),有效弥补了纯数据驱动模型在工业高精度检测中泛化弱、易产生伪影的致命缺陷,具有极高的学术价值和工程落地潜力。
2026-08-27 17:30:17
387
原创 《基于深度超分辨率网络的集成电路CT图像增强方法及系统》专利解读
通用大模型 + 垂直领域高质量数据 + 约束性分阶段微调 = 工业级高保真重建”。它没有盲目追求更复杂的网络结构,而是抓住了“IC CT图像的特殊性”这一关键矛盾,通过数据构造(ROI标注)和训练策略(分阶段+加权)的创新,有效解决了AI在工业无损检测中“好看但不真实(伪影)”的致命痛点,具有很高的工程应用价值。
2026-08-27 16:23:42
374
原创 《一种超分辨率重建方法和相关装置》专利解析
解决“AI味”与泛化差的问题传统的AI超分往往“一刀切”,导致真人视频看起来有噪点或过于锐利。该专利通过残差分离掩膜,实现了**“该锐化的地方锐化(轮廓),该去噪的地方去噪(平坦)”**,并且可以根据视频类型(动漫vs真人)动态调整系数,画质更符合人眼主观感受。极度贴近线上真实业务场景在训练数据中引入了视频压缩编码噪声(CRF),并在标签端使用PS锐化来补偿模糊退化,使得模型在实验室训练时就能“见多识广”,直接部署到线上长视频/短视频APP中时,面对各种压缩伪影都能有极好的鲁棒性。训练效率更高。
2026-08-26 17:32:47
462
原创 《超分辨率图像处理方法过程》专利解析
极致的移动端适配(低延迟、低功耗)采用代替传统的转置卷积(Transposed Convolution)进行上采样,计算效率更高。采用重参数化残差链接,将残差加法运算融合进卷积权重中,推理时没有额外的加法开销,完美契合手机NPU的硬件特性。高保真画质并行卷积结构能捕获更丰富的特征组合。残差机制确保了原始像素信息在深层网络中不丢失。利于端侧量化部署全程使用将特征值钳制在[0, 1]区间,这极大地缓解了神经网络在转换为 int8 量化模型时的精度掉点问题,使得模型在手机上跑得又快又好。
2026-08-26 17:27:13
217
原创 CenterPoint — Center-based 3D Object Detection and Tracking论文精读
✅提出center-based 3D检测框架:将3D物体表示为点而非框,天然旋转不变,减少搜索空间✅设计轻量二阶段精炼:仅提取5个表面中心点特征,+6ms即获+2 mAP提升✅极简跟踪算法:速度预测 + 贪心最近点匹配,1ms完成,无需卡尔曼滤波✅SOTA性能:Waymo和nuScenes双榜第一,NeurIPS 2020挑战赛Top4中3个方案采用。
2026-07-28 09:43:46
499
原创 SECOND: Sparsely Embedded Convolutional Detection论文解析
利用点云的天然稀疏性,用稀疏卷积替代稠密3D卷积,在保留完整3D空间信息的同时实现实时检测。配合正弦角度损失和真值采样数据增强,SECOND在2018年以仅LiDAR输入达到了KITTI 3D检测的SOTA,同时推理速度达到20-40fps,是3D目标检测领域的里程碑式工作。
2026-07-28 09:30:51
352
原创 GAMING SUPER RESOLUTION专利解读
预处理:原始高分辨率图像被归一化并下采样为低分辨率输入。特征提取路径A(线性):卷积 -> 线性特征图。路径B(非线性):卷积 -> 激活函数 -> 卷积 -> 激活函数… -> 非线性特征图。合并:线性特征图 + 非线性特征图 = 组合特征图。上采样 (Pixel Shuffle):将组合特征图重新排列,填充到高分辨率网格中。后处理:反归一化,转换回标准色彩空间。输出:显示高分辨率图像。
2026-07-24 16:21:47
324
原创 一种CT图像中床板自动去除的方法及系统
维度传统方法痛点本专利解决方案优势自动化程度需医生手动选取或半自动交互全自动:无需人工干预,一键完成节省人力,避免疲劳误差识别依据依赖边缘曲线或空床扫描匹配依赖连通性与密度间隔不依赖特定床型硬件参数,通用性强计算复杂度3D边缘检测或配准计算量大2D区域生长 + 简单投影算法简单,运算速度快,适合临床实时处理准确性薄床板易漏选或误选利用空气间隔隔离只要人体与床板间有低密度间隔,即可完美分离该专利通过巧妙的**“最大密度投影降维”和。
2026-07-21 09:53:49
448
原创 一种从CTA图像中去除扫描床的方法及装置
该专利利用脑组织与扫描床在空间上的不连通性,通过灰度加权质心定位种子点并结合区域增长算法,智能地分割出脑组织,进而反向识别并剔除扫描床。这是一种基于形态学和连通性分析的经典图像处理方案在医学影像中的具体应用。
2026-07-21 09:47:24
288
原创 Automatic Segmentation of CT Scans of Checked Baggage论文精读
好的,我们来解析一下你提供的这篇论文。
2026-07-17 11:51:31
339
原创 Automatic Patient Table Removal in CT Images论文精读
这篇论文提出了一种基于矢状面直线检测 + 霍夫变换的CT床自动去除方法,具有无需模板、适应多种床型、抗倾斜、全自动等优点,并在多厂商产品上验证有效。该方法已落地于商用系统,具有实际临床应用价值。
2026-07-16 18:35:14
399
原创 CT-RATE, CT-CLIP, and CT-CHAT: 推进3D医学影像的基础模型
本论文是3D医学影像基础模型领域的重要里程碑首个大规模开放3D CT-报告数据集(CT-RATE)。首个针对3D CT的对比学习视觉-语言模型(CT-CLIP)。首个3D CT多模态对话模型(CT-CHAT)。尽管距离临床应用仍有差距,但本研究为后续工作奠定了坚实的数据、模型和评估基础,并全面开源,极大推动了3D医学影像AI的发展。
2026-07-14 15:06:50
374
原创 vtkCameraPass代码解析
是VTK渲染管线中的相机渲染通道,它负责设置相机的投影矩阵和模型视图矩阵,管理视口和裁剪区域,并委托给其他通道进行实际的几何体渲染。
2026-07-09 08:52:55
47
原创 vtkOpenGLFXAAFilter代码解析
是一个高效、模块化的后处理组件。它通过将帧缓冲内容拷贝到纹理,利用 GPU 并行计算能力运行 FXAA 算法,最后将平滑后的结果写回屏幕。其设计允许用户在运行时动态调整抗锯齿的强度和风格,非常适合实时可视化应用。
2026-07-08 15:42:20
55
原创 vtkDefaultPass代码解析
是 VTK 渲染引擎的“默认行为”实现者。如果你没有自定义复杂的渲染管道,VTK 内部就会使用这个类(或其变体)来确保你的场景被正确地、按顺序地绘制出来。它是理解 VTK 渲染顺序(不透明 -> 透明 -> 体数据 -> 覆盖层)的最佳切入点。
2026-07-08 14:22:10
46
原创 vtkEDLShading代码解读
是一种基于深度的实时阴影技术,由法国电力公司 (EDF)、CNRS 等机构联合开发。它通过模拟从"眼穹顶"发出的光线来计算局部遮蔽效果,类似于 SSAO 但算法不同。是一个成熟的深度感知后处理通道✅重度依赖深度信息:所有三个阶段都使用深度纹理✅多分辨率策略:平衡性能和质量✅保边滤波:双边滤波避免伪影✅模块化设计:清晰的三阶段流水线✅高效实现:相比 SSAO 可能有更好的性能与 SSAO 相比,EDL 提供了另一种屏幕空间遮蔽方案,特别适合需要实时性能的应用场景。
2026-07-08 14:15:34
45
原创 vtkEDLShading代码解读
是一种基于深度的实时阴影技术,由法国电力公司 (EDF)、CNRS 等机构联合开发。它通过模拟从"眼穹顶"发出的光线来计算局部遮蔽效果,类似于 SSAO 但算法不同。是一个成熟的深度感知后处理通道✅重度依赖深度信息:所有三个阶段都使用深度纹理✅多分辨率策略:平衡性能和质量✅保边滤波:双边滤波避免伪影✅模块化设计:清晰的三阶段流水线✅高效实现:相比 SSAO 可能有更好的性能与 SSAO 相比,EDL 提供了另一种屏幕空间遮蔽方案,特别适合需要实时性能的应用场景。
2026-07-08 10:34:54
43
原创 vtkImageProcessingPass代码解析
是一个抽象基类,用于实现后处理渲染通道(post-processing passes)。它继承自,为子类提供了常用的便捷方法。抽象基类: 不能直接实例化,需要子类实现具体后处理逻辑委托机制: 通过实现灵活的渲染管道组合离屏渲染: 使用 FBO 和纹理进行中间结果存储相机适配: 自动处理不同分辨率下的相机参数调整资源管理: 正确管理 OpenGL 资源和内存这个类是 VTK 渲染管道中后处理效果的基础设施,为 SSAO、模糊、边缘检测等效果提供了统一的框架。
2026-07-08 10:15:53
42
原创 vtkDepthPeelingPass代码解析
是 VTK 中处理高质量半透明渲染的重型武器。它通过牺牲一定的性能(多次渲染),换取了无需排序且物理正确的透明度效果。常用于医学可视化(如多层组织叠加)、科学计算可视化等对透明度准确性要求极高的场景。
2026-07-07 15:57:06
400
原创 vtkDepthOfFieldPass代码解析
是一个典型的基于深度的屏幕空间特效。它不修改几何体,而是通过“欺骗”人眼的方式,利用深度缓冲区的数值来控制模糊程度。如果你想在 VTK 场景中实现类似单反相机的背景虚化效果,就是使用这个类。
2026-07-07 15:39:42
50
原创 vtkDepthImageProcessingPass代码解析
是 VTK OpenGL2 渲染后端中连接几何渲染与屏幕空间后处理的桥梁。它解决了“如何在改变分辨率的情况下正确渲染场景并同时输出深度图”这一通用问题,使子类只需关注具体的 Shader 效果实现,而无需重复处理复杂的 FBO 管理和相机校正逻辑。
2026-07-07 15:25:27
180
原创 在vtk中集成FXAA来实现防锯齿功能
define FXAA_SPAN_MAX 8.0 // 最大搜索跨度,限制模糊范围,防止过度模糊#define FXAA_REDUCE_MUL (1.0 / 8.0) // 用于计算最小步长的系数#define FXAA_REDUCE_MIN (1.0 / 128.0) // 最小步长阈值,避免除以零或过小步长这段 FXAA 代码是一个高效、实用的后处理抗锯齿方案。优点:计算量小,对 GPU 压力低,能显著改善视觉上的锯齿感。缺点。
2026-07-06 14:37:09
371
原创 Study on Color Coding for X-ray Imagery for Security Control论文精读
论文从人类视觉生理和心理机制出发,系统评估了不同颜色空间(RGB, HSV, YIQ, YCbCr等)和数学映射函数(如余弦函数)在安检X射线灰度图像伪彩色化中的表现,最终通过实验证明基于余弦函数的颜色编码在YIQ/YCbCr空间中能提供最平滑的视觉效果,最有助于安检员识别威胁物品并降低视觉疲劳。
2026-07-03 15:03:15
184
原创 Sharpening filter for false color imaging of dual-energy X-ray scans论文精读
论文提出了一种边缘增强图像伪彩色算法(EEIPC),通过将物质物理分类(Q值阈值)与计算机视觉边缘检测(Canny算子+梯度投票)相结合,在CIE Lab*色彩空间中进行渲染,彻底解决了传统双能X射线伪彩色图像中“物质边界模糊、颜色混叠”的问题,使图像边缘如刀刻般锐利,大幅提升了安检员的视觉辨识度。
2026-07-03 14:30:42
658
原创 双能颜色表文献(3)
这篇文献展示了一种典型的“物理标定+色彩空间转换+人机交互”的工业级颜色表制作方案。它摒弃了在RGB空间里盲目试凑颜色的做法,利用HSL空间的直观性和物理测试箱的准确性,为双能X射线安检设备提供了一套科学、可定制、高清晰度的伪彩色显示标准。
2026-07-03 11:17:06
202
原创 双能颜色表文献(2)
这篇文献中的“颜色表”本质上是一个“物理信号 -> 隶属度概率 -> HSV非线性映射 -> RGB概率加权”的数学模型。它摒弃了死板的查表法,利用概率融合和非线性视觉增强,极大地提升了单源伪双能X光机对复杂行李中危险品的辨识度。
2026-07-03 10:58:04
441
原创 双能颜色表文献(1)
论文提出将HSB(色相、饱和度、明度)色彩模式应用于伪双能X射线透射成像系统,通过建立颜色与物质物理属性(原子序数、密度、厚度)的深度映射关系,不仅实现了有机物/无机物的分类,还能区分同类物质(如木头和矿泉水),并高亮凸显低密度的爆炸物/毒品,大幅提升了安检员的物质识别能力。这篇论文虽然发表年份较早(2010年左右),且属于传统图像处理范畴,但它深刻揭示了双能X射线物质识别的物理本质。
2026-07-03 10:45:07
75
原创 The Magic Volume Lens: An Interactive Focus+Context Technique for Volume Rendering
这篇论文是体数据可视化(Volume Rendering)领域中“焦点+上下文”技术的经典之作。理论贡献:将 2D 信息可视化中的“魔法透镜(Magic Lens)”和“ distortion(变形)”概念,成功且严谨地推广到了 3D 体数据领域,并给出了基于光学和采样理论的数学解释。应用价值:解决了医学影像分析、工程 CT 检测中“管中窥豹”的痛点。医生或工程师不再需要在“看整体”和“看局部细节”之间频繁切换视角,极大地提升了空间认知效率。未来启发:论文在最后提出,未来的透镜可以结合。
2026-07-02 17:19:28
330
原创 Illustrative Visualization – New Technology or Useless Tautology
主要关注“如何渲染(How to render)”,即模仿传统插画中的笔触和材质风格,属于非真实感渲染(NPR)的主要研究范畴。利用数据的一阶/二阶导数等局部属性生成特征线,如脊线与谷线、轮廓线、暗示轮廓线(Suggestive contours)等,以模拟手绘线条。用计算机算法模拟手绘的点画法(Stippling)、阴影线(Hatching)或卡通着色(Toon shading)。主要关注“渲染什么(What to render)”,即通过改变布局或变形特征来增强沟通意图。
2026-07-02 17:11:15
601
原创 人体手部MRI数据的体绘制论文精读
这篇论文没有发明新的体绘制数学公式,而是巧妙地利用已有的高精度分割网格作为“空间引导”,为手部MRI的每个组织独立分配传递函数,从而绕开了传统灰度值重叠导致的分类难题,在保持外部上下文的同时,高质量、稳定地展示了手部复杂内部结构。
2026-07-02 11:40:42
43
原创 Context-Preserving Volume Rendering论文精读
这篇论文提出了一种“智能透明”方法,让体绘制像插画师一样,在重要特征处保持不透明,在平坦区域变透明,从而在揭示内部结构的同时保留外部上下文,兼顾信息量与可读性。
2026-07-02 10:35:02
270
原创 PRISM论文精读
PRISM(Programmable Ray Integration Shading Model)旨在提供一个灵活、易用、可扩展可编程着色器替换:允许用户替换光线积分算法中的关键步骤(Init、Volume、StopCondition)。实时编辑:支持在运行时修改着色器代码并即时查看效果。多体积支持:可同时渲染多个体积,并分别设置传递函数。开源与可集成:基于VTK开发,易于嵌入现有医学影像平台(如3D Slicer、MITK、IBIS Neuronav等)。
2026-06-27 11:33:08
342
原创 Security threats on Data-Driven Approaches for Luggage Screening论文精读
核心背景:传统的全人工行李筛查耗时且极易因疲劳导致漏检,近年来计算机视觉与深度学习模型被引入安检系统 (p. 1)。主要挑战:行李严重遮挡、样本类别极度不平衡、标注数据稀缺,以及潜在的对抗攻击(Adversarial Attacks)威胁 (p. 1)。核心贡献:系统梳理了现有X射线行李安检的AI技术、对比了主流公开基准数据集、深入剖析了新兴的物理世界对抗攻击及其对安检模型的破坏性影响 (p. 1)。
2026-06-25 10:37:06
245
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅