- 博客(461)
- 收藏
- 关注
原创 基于Transformer-LSTM的光伏功率预测
本文提出了一种结合K-means天气聚类的Transformer-LSTM混合模型用于光伏功率预测。通过K-means聚类自动划分晴天、阴天、雨天三种天气类型,使模型能针对不同天气学习精准规律。模型融合Transformer的全局注意力机制和LSTM的局部时序捕捉能力,有效提升预测精度。实验结果表明,该模型在三种天气条件下均表现优异,R²最高达0.972,MAE和RMSE显著优于传统方法,为电网调度和新能源消纳提供了可靠技术支撑。该方法具有良好的泛化能力,可推广至风电、负荷预测等时序任务。
2026-05-20 20:58:50
207
原创 2025CVPR:APHQ-ViT:Vision Transformer 后训练量化的“精准手术刀”,兼顾性能与硬件友好
本文提出APHQ-ViT方法,解决了Vision Transformer在3/4位后训练量化中的精度骤降问题。针对ViT量化两大挑战:1)传统海森矩阵损失估计不准;2)GELU激活后数值分布不均,作者创新性地提出平均扰动海森损失和MLP重建技术。前者通过精确扰动估计提供误差指导,后者将GELU替换为ReLU以优化数值分布。实验表明,该方法在ImageNet分类、COCO检测等任务上,3位量化平均提升7.21%,且保持硬件友好性。这项工作为ViT高效部署提供了实用解决方案。
2026-04-02 15:18:47
85
原创 CALICO:让大视觉语言模型学会“找茬”——多图像部件级语义共分割新突破
CALICO突破LVLM部件级语义共分割新边界 伊利诺伊大学团队在CVPR2025提出CALICO框架,解决了大型视觉语言模型在多图像部件级语义共分割任务中的关键挑战。
2026-04-01 14:10:35
355
原创 MoLM:用多模态语言模型统一人类动作的“语音、文本与身体语言”
《TheLanguageofMotion》提出了一种创新的多模态语言模型框架,首次统一了语音、文本和3D人体动作的生成与理解。通过组合式动作分词和两阶段训练策略(模态对齐+指令微调),该模型在BEATv2基准测试中取得SOTA性能,并展现出数据高效性和任务泛化能力。研究突破了传统动作生成模型的模态隔离局限,实现了"可编辑动作生成"等新功能,为自然智能交互奠定了基础。这项工作开创性地将语言模型应用于动作语言处理,验证了"动作即语言"的可行性,为人机交互领域提供了新范式。
2026-04-01 13:58:11
62
原创 2025CVPR:Uni4D:用“模型乐高”拼出动态世界的4D数字孪生
CVPR2025论文《Uni4D》提出了一种创新的4D场景重建框架,通过巧妙集成现有视觉基础模型(如深度估计、运动跟踪、分割模型)而非训练新模型,实现了从单目视频重建动态4D场景(3D几何+时间运动)。该框架采用三阶段优化流程:相机初始化、静态束调整和非刚性束调整,将2D视觉线索反向融合为时空连贯的4D表示。实验表明,Uni4D在多个基准测试中达到SOTA性能,显著提升了深度一致性和重建质量,且完全无需训练或微调。这项工作为利用现有基础模型解决复杂任务提供了新范式,展示了优化与学习结合的潜力。
2026-04-01 13:34:26
151
原创 ROADWork数据集:破解自动驾驶“施工区困境”的钥匙
《ROADWork:面向道路施工区的自动驾驶数据集与基准》 卡内基梅隆大学团队在ICCV2025上提出了首个专门针对道路施工区场景的大规模多任务自动驾驶数据集ROADWork。
2026-03-31 20:51:45
375
原创 2025ICCV:MM-IFEngine:开启多模态大模型的精准“听令”时代
《MM-IFEngine:多模态指令跟随的系统性解决方案》 本文针对多模态大语言模型(MLLMs)指令跟随能力的两大核心瓶颈——高质量训练数据稀缺和评估基准简单化,提出了完整的解决方案。
2026-03-31 20:40:10
394
原创 2025ICCV:参数高效微调新突破:AOFT,用近似正交性增强Vision Transformer泛化能力
本文提出了一种基于近似正交性理论的参数高效微调方法AOFT,用于Vision Transformer在下游任务中的适配。研究发现预训练ViT权重矩阵具有近似正交特性,而传统PEFT方法(如LoRA、Adapter)的投影矩阵缺乏这种性质。AOFT通过单向量生成机制构造近似正交矩阵,在保持90%参数压缩的同时提升模型泛化能力。实验表明,AOFT在FGVC和VTAB-1k基准上均优于原版方法,且对瓶颈维度选择更具鲁棒性。该工作为参数高效微调提供了新的理论视角和实用方案。
2026-03-31 20:16:59
914
原创 2025年小目标检测技术全面总结:从理论突破到工业应用
2025年小目标检测技术取得显著突破,但仍面临特征稀缺、尺度不匹配等核心挑战。研究聚焦多尺度特征融合、注意力机制和频域特征挖掘,YOLO系列和Transformer-CNN混合架构展现出优异性能。领域专用方案在遥感、无人机和医疗影像检测中表现突出。未来将向轻量化、多模态融合方向发展,但极端密集场景适配和速度-精度平衡仍是难题。该技术为自动驾驶、医疗诊断等关键领域提供了重要支持。
2025-12-28 23:42:55
1574
原创 2025年小目标检测技术全面总结
2025年小目标检测技术取得重大突破,针对像素占比低于3%的目标检测难题,研究聚焦四大核心挑战:特征稀缺、尺度不匹配、背景干扰和样本不均衡。关键技术突破包括:多尺度特征融合(如改进的BiFPN)、注意力机制增强(CBAM、LAM-YOLO)和频域特征保留(YOLO-WF)。专用检测框架如YOLO系列和Transformer混合架构显著提升性能,YOLOv8小目标mAP达28.7%。领域专用方案在遥感、无人机、医疗等场景表现优异,如医疗影像Dice系数达0.89。未来将向高效化、多模态融合方向发展,但极端密集
2025-12-28 23:38:27
331
原创 自适应Transformer模型:光伏发电中温度与辐射的长期预测新突破
摘要:本文探讨了一种基于Transformer的自适应模型在光伏发电温度和太阳辐射长期预测中的应用。研究针对传统预测方法(如ARIMA、LSTM)在处理非线性关系和长期依赖方面的不足,提出改进方案。该模型通过多头自注意力机制并行处理数据,结合自适应位置编码和贝叶斯优化超参数调优,显著提升了预测精度。实验结果显示,在埃及5个城市的测试中,该模型的MAE比ARIMA低69%,R²达到0.9773。研究为光伏电站运营、电网调度和维护规划提供了有效工具,并为可再生能源预测领域的技术发展提供了新思路。
2025-12-07 22:48:26
1143
原创 基于LSTM的光伏电站功率输出预测:原理、实现与性能全面解析
摘要:本文探讨基于LSTM的光伏发电功率预测模型,以解决可再生能源并网中的波动性问题。研究采用巴西光伏电站实际数据,构建4层LSTM网络结构,创新性地引入季节性分层训练和自适应优化策略。实验结果显示,该模型预测误差低于5.2%,较传统BPNN方法提升57%以上,能有效捕捉不同季节的发电特征。该技术为电网调度、电力交易等应用提供了高精度预测工具,未来可结合注意力机制等进一步提升性能,推动智能电网建设。
2025-12-07 22:43:13
976
原创 【2025CVPR 异常检测方向】DFM: Differentiable Feature Matching for Anomaly Detection
论文摘要:本文提出可微分特征匹配框架DFM,用于解决无监督异常检测方法的三大局限:特征提取与匹配分离、静态匹配算法和无法利用异常样本。DFM通过可微分的特征匹配网络(FMN)实现端到端优化,结合两阶段训练策略优化特征提取器和匹配头。实验表明,DFM在MVTecAD和VisA数据集上持续异常检测任务达到SOTA(实例AUROC 96.9%),在1-shot设置下性能提升14.5%。核心贡献包括:首次实现特征提取与匹配的端到端联合优化、增强任务适配性以及提供实用解决方案。
2025-11-16 16:36:45
1628
原创 【2025CVPR物体姿态估计方向】ONDA-Pose:面向自监督六维物体姿态估计的遮挡感知神经域自适应方法
摘要:本文提出ONDA-Pose方法,通过神经域自适应实现自监督6D物体姿态估计。针对现有方法在合成图像翻译中存在的域差距和遮挡处理不足问题,创新性地将真实图像翻译至合成域,并利用CAD-like Radiance Field生成无遮挡图像。方法包含三个核心步骤:CARF域翻译、全局姿态优化器改进伪标签精度,以及联合自监督训练。在LineMOD等基准测试中,ONDA-Pose显著优于现有方法(Occluded-LineMOD上69.3%准确率),特别在处理遮挡和跨数据集泛化方面表现突出。消融实验证实各模块的
2025-11-16 16:25:16
146
原创 【2025CVPR】GleSAM:通过生成性潜在空间增强实现任意质量图像分割
摘要:本文针对SegmentAnythingModels(SAMs)在低质量图像上性能下降的问题,提出了GleSAM框架。该框架通过生成性潜在空间增强技术,利用预训练扩散模型重建高质量特征表示,显著提升了模型在退化图像上的分割鲁棒性。关键创新包括特征分布对齐技术、通道复制扩展方法和LoRA微调策略。实验结果表明,GleSAM在保持清晰图像性能的同时,有效提升了在模糊、噪声等退化图像上的分割精度。构建的LQSeg数据集为低质量图像分割研究提供了新基准。
2025-11-09 10:00:00
1050
原创 【2025CVPR】TFCustom:基于时间感知频率特征引导的定制图像生成模型详解
本文提出TFCustom框架,一种无需微调的定制图像生成方法。该框架创新性地引入时间感知频率特征引导机制,通过同步噪声注入和多尺度特征提取实现高质量图像生成。关键创新包括时间感知频率细化模块(将参考图像分离为高低频特征)和奖励模型优化。实验表明,TFCustom在单主体和多主体生成任务中均达到SOTA性能,显著提升图像一致性,同时保持文本可控性。该方法为零样本定制生成提供了新思路,在保留细粒度细节方面表现出色。
2025-11-09 08:30:00
95
原创 液压泵故障转移诊断:动态仿真与改进域对抗神经网络的创新融合
摘要:本文提出一种基于动态仿真和改进域对抗神经网络(DS-IDANN)的液压泵智能故障诊断方法,解决标注数据稀缺和域偏移问题。该方法通过建立液压泵动力学模型生成仿真数据,并采用融合图卷积网络和最大熵优化的改进域对抗框架实现跨域知识迁移。实验表明,DS-IDANN在仅有4个真实标注样本情况下达到95.6%的平均诊断准确率,显著优于传统方法。该技术为工业设备智能运维提供了新思路,特别适用于故障数据获取困难的关键设备健康管理场景。
2025-11-08 16:05:49
1038
原创 基于深度卷积与自注意力的自适应域适应方法:滚动轴承故障诊断
本文提出了一种新型深度迁移学习模型LRSADTLM,用于解决变工况下轴承故障诊断的挑战。该模型创新性地融合小波包变换、轻量残差网络和自注意力机制,构建了多尺度时频特征表示和深度融合网络。通过结合多核最大均值差异和域对抗神经网络的联合优化策略,有效实现了跨域特征对齐。实验验证表明,模型在多个轴承数据集上取得了95.28%-99.77%的优异诊断准确率,显著优于现有方法。该技术为工业设备智能运维提供了有效解决方案,特别适用于工况多变场景下的故障诊断需求。
2025-11-08 15:53:44
1123
原创 [2025CVPR]Active Multimodal Distillation for Few-shot Action Recognition:基于主动推理的多模态知识蒸馏框架
本文提出AMFIR框架,通过主动模态选择、双向知识蒸馏和自适应推理融合解决少样本动作识别中的多模态融合问题。实验表明,该方法在Kinetics-400和SSv2等数据集上显著优于现有基线(1-shot准确率达82.8%和70.6%)。核心创新包括:1)ASI模块动态评估模态可靠性;2)AMD模块实现跨模态知识迁移;3)AMI模块自适应融合多模态特征。可视化分析证实了该框架在模态重要性评估和多模态融合上的有效性。未来将探索更多模态整合和跨数据集泛化能力。
2025-11-08 15:48:03
2020
原创 [2025CVPR-Vision Transformers方向]BHViT:二值化混合视觉Transformer详解
本文提出了一种二值化混合视觉Transformer架构(BHViT),旨在解决视觉Transformer在边缘设备部署中的效率问题。该方法通过三个关键创新实现了性能突破:(1)混合CNN-Transformer架构,前阶段使用多尺度分组空洞卷积处理高分辨率特征,后阶段采用改进的窗口注意力机制;(2)量化分解技术,通过组合多个二值注意力矩阵提升表示能力;(3)移位增强MLP和自适应正则化损失,有效缓解二值网络优化问题。实验表明,BHViT在ImageNet分类任务上相比纯二值化ViT提升超过20%,同时大幅降
2025-11-02 08:30:00
421
原创 [2025CVPR-Vision Transformers方向]ERUPT: Efficient Rendering with Unposed Patch Transformer 详解
本文提出ERUPT(高效无姿态块变换渲染)方法,通过创新的块查询机制和学习的潜在相机姿态,实现了仅需5张未姿态输入图像的高效新视角合成。核心创新包括:基于块的解码器降低64倍计算量(达600fps渲染速度);自适应姿态学习机制支持无姿态训练;混合注意力架构增强场景理解。实验表明,ERUPT在MSN数据集上PSNR达24.20,比传统方法快5倍,且仅需5%姿态标注即可接近全监督性能。该方法为真实场景的新视角合成提供了高效解决方案。
2025-11-02 08:00:00
94
原创 基于数字孪生的永磁同步电机早期匝间短路故障诊断方法
摘要: 本研究提出了一种基于数据驱动数字孪生模型的永磁同步电机早期匝间短路故障诊断方法。通过建立NARX网络数字孪生模型,仅需健康电机数据即可完成故障诊断,无需精确电机参数和故障数据。方法通过分析三相电流残差实现故障检测,能有效消除电机谐波干扰,在短路匝数比低至0.03时仍具有高灵敏度。实验验证表明,该方法在变速工况下也能准确识别故障相,相比传统谐波分析方法具有明显优势。核心代码实现了NARX网络建模、残差计算和实时诊断功能,为早期故障检测提供了有效解决方案。
2025-11-01 17:14:34
1024
原创 基于融合数字孪生与多尺度特征提取的轴承故障模型详解
本文提出了一种结合数字孪生和多尺度特征提取的轴承故障诊断方法。通过构建4层数字孪生框架建立高保真动力学模型(误差<5%),并开发混合模型(1DCNN-SENet-2DSwinTransformer)进行多尺度特征提取。实验表明,该方法在测试集上达到98.9%的准确率,优于单一模型。开发的交互式诊断系统实现4.76秒快速响应,支持多维参数分析。未来将优化模型轻量化和泛化能力,推动工业应用。
2025-11-01 17:00:57
1016
原创 【2025CVPR-域泛化方向】Link-based Contrastive Learning for One-Shot Unsupervised Domain Adaptation
本文提出了一种基于链接对比学习(LCL)的一样本无监督域适应(OSUDA)方法。针对源数据稀缺和域对齐困难的挑战,LCL通过原型对比学习(PC)从目标域学习判别性特征,利用域内链接对比学习(ILC)增强特征判别性,并采用跨域链接对比学习(CLC)实现精确语义对齐。实验表明,LCL在VisDA-2017等基准数据集上取得显著提升(最高23.97%),在监控人脸识别等真实场景中平均提升11.84%。该方法创新性地通过链接机制避免了阈值选择,具有强兼容性和鲁棒性。
2025-11-01 10:05:12
132
原创 [2025CVPR 异常检测方向]OODD:基于动态字典的测试时分布外检测方法详解
本文提出OODD,一种基于动态字典的测试时分布外(OOD)检测新方法。该方法通过信息性内点采样构建高质量ID字典,利用优先级队列动态管理OOD样本,并采用双稳定化机制确保检测稳定性。实验表明,OODD在CIFAR和ImageNet等基准上显著优于现有方法,如在CIFAR-100 FarOOD检测中将FPR95降低26%。该方法无需微调模型,计算效率高,为实时OOD检测提供了有效解决方案。核心创新包括动态字典管理、信息性采样和双稳定化机制。
2025-11-01 09:53:42
411
原创 基于多尺度特征融合的自注意力度量学习的小样本故障诊断
本文针对小样本条件下轴承故障诊断难题,提出了一种融合多尺度特征(MSFF)和自注意力机制(SA)的SAML-MSFF模型。该模型基于孪生网络架构,通过并行多尺度卷积提取多层次特征,并利用SA机制优化相似性度量。实验表明,在CWRU等数据集上,仅需每类10-30个样本即可实现90%以上准确率,跨负载条件下仍保持70%以上性能。消融实验验证了MSFF对特征提取的关键作用(提升6%)和SA对度量学习的优化效果(提升4%)。模型在实际工业数据中表现良好,为小样本故障诊断提供了有效解决方案。未来将结合迁移学习进一步提
2025-10-25 22:31:13
347
原创 用于小样本故障增量学习的多视图 Shapelet 原型网络
本文针对工业过程中少样本新故障诊断挑战,提出多视角形状原型网络(MSPN)解决少样本故障增量学习(FSFIL)问题。方法通过多视角形状子原型分类器构建可泛化特征空间,结合Transformer元校准模块优化新旧类特征区分性。在Tennessee Eastman和铝电解过程数据集上的实验表明,MSPN在准确率(84.90%)、抗遗忘性和时间效率上优于基线方法,且形状子提供直观故障解释。研究为工业故障诊断提供了可解释、高效的增量学习方案,未来可扩展至多变量数据和新类发现场景。
2025-10-25 22:24:57
143
原创 面向小样本蜂窝网络故障诊断的模型与知识互增强方法
本文提出鲁棒信念加权框架(RBWF)解决蜂窝网络故障诊断中的两大挑战:标注数据稀缺和领域知识利用不足。RBWF通过四阶段实现数据与知识的双向增强:(1)模式提取(PET)从无标签数据学习特征;(2)信念加权机制利用知识库修正模型伪标签;(3)用可靠预测更新知识库;(4)SMOTE过采样解决类别不平衡。实验表明,在仅3.75%标注数据下,RBWF准确率达97.68%,性能接近全量监督学习,显著优于基线方法。该框架通过创新的互增强机制,实现了从小样本和粗糙知识库出发的高性能故障诊断。
2025-10-23 23:55:53
103
原创 基于类内类间优化的元学习少样本故障诊断方法
本文提出了一种基于类内类间优化的元学习(MLIIO)少样本故障诊断方法。针对工业场景中故障样本稀缺的问题,MLIIO创新性地设计了类内聚合损失(IAL)和类间判别损失(IDL)两个互补组件,通过优化特征空间实现高效诊断。方法采用原型网络架构,在元学习框架下同时优化类内紧凑性和类间可分性。实验表明,MLIIO在CWRU轴承和铁路道岔等数据集上均优于现有方法,在3-way5-shot任务中准确率超90%,且具有强抗噪能力和跨工况适应性。该方法为数据稀缺条件下的工业设备智能诊断提供了有效解决方案。
2025-10-23 23:45:35
1096
原创 基于自注意力动态采样的GNNs到KANs知识蒸馏:面向消费电子边缘部署的高效框架
本文提出了一种创新的自注意力动态采样蒸馏(SA-DSD)框架,首次实现了从图神经网络(GNNs)到Kolmogorov-ArnoldNetworks(KANs)的知识蒸馏。该框架通过改进的FR-KAN+学生模型(引入动态频率基、复数权重和相位偏移)和自注意力动态采样机制,有效解决了GNNs在边缘设备部署时的计算复杂度问题。实验表明,SA-DSD在六个基准数据集上平均准确率提升15.61%,参数量压缩16.96倍,推理时间减少55.75%,显著优于传统GNN到MLP的蒸馏方法。该技术为消费电子边缘设备提供了高
2025-10-17 08:30:00
1989
原创 【2025CVPR-密集检测】
本文提出TIDE(文本到图像与密集标注统一生成模型),创新性地实现仅通过文本输入同时生成水下图像及多类型密集标注(深度图、语义掩码)。核心贡献包括:1)首创统一生成框架,通过隐式布局共享机制(ILS)和时间自适应归一化(TAN)确保多模态输出一致性;2)构建14K真实数据四元组及5万样本合成数据集SynTIDE;3)实验表明模型在深度估计(SIlog指标提升14.7%)和语义分割(mIoU提升2.1%)任务中显著提升性能,并具备零样本生成能力。该研究为水下视觉任务提供了高效数据合成方案,论文代码已开源。
2025-10-17 08:30:00
218
原创 IEEE TRANSACTIONS 论文《MTSNN: 一种跨机器异构故障类别的少样本细粒度诊断框架》
本文提出了一种名为元传输脉冲神经网络(MTSNN)的跨机器少样本细粒度故障诊断框架,结合脉冲神经网络(SNN)与元学习技术,有效解决了传统方法对标注数据依赖大、跨机器泛化能力差、细粒度诊断不足等问题。MTSNN通过卷积脉冲神经网络提取特征,并创新性地设计了包含原型学习、元对比学习和熵信息最大化的损失函数,在多个真实机械数据集上验证了其优越性,在5-way5-shot任务中准确率达95.86%,较传统方法提升显著。该研究为工业设备智能诊断提供了新思路,未来将优化参数调优和实时部署。
2025-10-16 23:07:34
1277
原创 高压断路器故障诊断:基于注意力机制的少样本迁移学习(FSTL)方法详解
本文提出了一种创新的少样本迁移学习(FSTL)方法,结合注意力机制(1DACNN)和子域自适应技术,用于解决高压断路器在小样本条件下的故障诊断问题。该方法通过一维注意力CNN提取细粒度时间特征,并利用局部最大均值差异(LMMD)实现类别级子域对齐,有效解决了传统方法在样本不平衡时的性能下降问题。实验表明,FSTL在现场小样本(160个)条件下达到94.86%的准确率,较传统方法提升5-10个百分点。该方法为电力设备智能运维提供了高效可靠的技术方案,显著降低了对现场故障数据量的需求。
2025-10-16 22:56:07
213
1
原创 Adaptive Multi-prompt Contrastive Network for Few-shot Out-of-distribution Detection
本文提出自适应多提示对比网络(AMCN)来解决少样本OOD检测的关键挑战。针对样本稀缺性和类别多样性差异问题,AMCN创新性地结合三种自适应提示(LIPs、LFOPs、LAOPs)进行跨模态对比学习,并设计类自适应阈值和分布归一化机制来优化决策边界。实验表明,AMCN在多个基准数据集上显著优于现有方法,如在1-shot设置下将FPR95降低9.71%。该方法为安全关键领域的异常检测提供了新思路,有效解决了少样本场景下的OOD检测难题。
2025-10-10 08:30:00
110
原创 基于KAN融合的混合CNN-Transformer模型应用于皮肤癌分类
本研究提出一种混合CNN-Transformer架构结合卷积Kolmogorov-Arnold网络(CKAN)的皮肤病变分类方法。通过顺序和并行两种混合模型设计,有效融合CNN的局部特征提取能力与Transformer的全局建模优势。在HAM10000等四个公开数据集上的实验表明,该方法准确率最高达97.83%,显著优于单一模型。创新性地引入CKAN特征融合模块,提升了模型表达能力,为医学图像分类提供了新思路,具有较好的泛化能力和临床应用价值。
2025-10-09 18:59:05
318
原创 基于时频的长期时序KAN预测模型:TFKAN: Time-Frequency KAN for Long-Term Time Series Forecasting
本文提出TFKAN,一种基于KAN网络的时频双分支时间序列预测架构。创新性在于首次将KAN直接应用于频域处理,通过FFT/IFFT转换实现时域与频域信息的互补融合,并设计维度调整策略优化频域表示。实验表明,TFKAN在多个数据集上优于现有方法,尤其擅长捕捉周期性模式,同时保持较低计算开销。该方法为时间序列预测提供了新的频域建模思路,未来可进一步优化效率并扩展应用场景。
2025-10-09 18:54:44
289
原创 [2025CVPR-域泛化方向]:通过改进损失景观实现更好的域泛化
摘要:本文提出自反馈训练(SFT)框架解决机器学习中的域泛化问题,通过优化损失景观一致性提升模型在未知域的泛化能力。SFT采用迭代式两阶段设计:反馈阶段检测域间损失景观差异并生成反馈信号,改进阶段利用这些信号优化景观改进器。实验表明,SFT在多个基准数据集上优于现有方法,平均提升1.5%-3.8%准确率。理论分析证实损失景观一致性具有可转移性,为域泛化提供了新视角。该方法兼容不同骨干网络,在保持训练效率的同时显著提升性能。
2025-09-23 20:25:01
351
原创 【2025CVPR-域泛化方向】PEER Pressure:单源域泛化的模型间正则化方法解析
论文《PEERPressure》提出PEER框架解决单源域泛化问题,通过任务模型和代理模型的双模型结构,结合熵正则化和参数平均机制,有效缓解了数据增强导致的性能波动和特征失真。实验表明,该方法在多个基准数据集上达到SOTA性能,显著提升模型泛化能力,为域泛化研究提供了新思路。
2025-09-23 20:17:49
1030
原创 基于特征级跨域对齐和型对比学习的小样本故障诊断模型
本文提出DWPCN方法解决轴承故障诊断中的小样本和跨域分布差异问题。通过特征级跨域对齐模块(FCA)结合条件域判别器和样本感知加权,抑制异常值影响;原型对比学习模块(PCL)则增强类内一致性和类间判别性。在CWRU和HUST数据集上的实验表明,DWPCN在10-way-5-shot任务中准确率达99.88%,显著优于现有方法,有效解决了负迁移问题,为工业故障诊断提供了可行方案。
2025-09-17 08:00:00
1033
原创 基于多级任务知识补充网络的小样本条件下的多故障诊断模型
本文提出了一种多级任务知识补充网络(MTKS)用于解决固定翼无人机故障诊断中的小样本和多任务挑战。MTKS通过公共知识池(PKP)共享故障部件诊断(FCD)和故障程度诊断(FSD)的公共知识,采用自适应知识补充策略(筛选矩阵和注意力机制)实现知识动态共享,并引入动态加权平均优化多任务学习。实验表明,在80个训练样本的小样本场景下,MTKS平均准确率达73.79%,显著优于单任务和传统多任务学习方法,且满足实时性要求。消融实验验证了各模块的有效性。该方法为无人机故障诊断提供了新思路,特别适用于数据稀缺场景。
2025-09-17 08:00:00
1766
基于Hive的大数据分析与智能分类推荐系统-多媒体作品集管理解决方案
2025-01-15
神经网络源码-GoogLeNet源码
2024-11-22
神经网络源码+AlexNet模型源码+人工智能
2024-11-22
人工智能KAN神经网络+python代码
2024-11-22
基于PyTorch的故障检测CNN模型训练与应用
2024-11-22
基于一维CNN和LSTM的融合网络用于时间序列数据的预测分类
2024-10-19
机器学习基于鸢尾花数据集的决策树与随机森林分类模型对比:特征工程、模型训练及性能评估
2025-04-28
医学领域基于CatBoost与贝叶斯优化的高原脑水肿风险预测模型研究:多模态数据挖掘与性能评估
2025-04-28
【软件工程、计算机专业】基于Java SSM的图书管理系统开发与实现:需求分析、架构设计及性能优化摘要
2025-04-28
【无人机识别技术】基于射频信号与改进视觉Transformer的无人机检测与识别系统设计
2025-04-27
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅