异步汪仔
这个作者很懒,什么都没留下…
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
81、《UPC++ DepSpawn 库:数据流式计算的改进与评估》
本文介绍了UPC++ DepSpawn库在数据流式计算中的改进与性能评估。通过对共享和分布式内存组件的重构,利用C++11替代Intel TBB实现轻量级任务调度,并优化任务执行顺序、内存管理和同步机制,显著提升了运行时性能。实验结果显示,在Cholesky、LU分解和Gauss-Seidel等基准测试中,平均加速比达9.3%,最大提升达66.3%。文章还分析了不同场景下的适用性,并展望了未来优化方向。原创 2025-10-05 02:04:04 · 91 阅读 · 0 评论 -
80、图像分类与并行计算技术的研究与进展
本文探讨了PRISM图像分类技术与UPC++ DepSpawn数据流计算库的研究进展。PRISM通过特征级可视化帮助理解卷积神经网络的决策过程,尤其在动物图像特征融合与聚类分析中表现出潜力,但存在缺乏显著性指标的问题;而UPC++ DepSpawn基于PGAS模型提供高效的分布式并行计算支持,通过动态数据流机制简化开发流程,适用于处理复杂不规则依赖的大规模科学计算。文章还对比了相关技术,并展望了二者在自动化、性能优化及跨领域融合方面的发展趋势。原创 2025-10-04 09:54:10 · 106 阅读 · 0 评论 -
79、资源分配与图像特征映射方法研究
本文研究了弹性资源分配与图像特征映射方法。在资源分配方面,提出由AOPartitioner、OLPredictor和OPPlanner组成的三模块协同框架,通过自适应分区、基于元学习的负载预测和RFR驱动的并行度规划,在降低端到端延迟和总成本的同时满足QoS要求。在图像分析方面,提出PRISM方法,利用PCA对卷积层特征进行主成分提取并插值生成彩色特征掩码,有效识别关键区分特征如眼睛区域在狼与郊狼分类中的作用。两种方法分别在系统性能优化与模型可解释性方面展现出显著优势,并具备在复杂实时图像处理系统中综合应用原创 2025-10-03 12:56:30 · 65 阅读 · 0 评论 -
78、分布式流处理中基于算子影响域动态感知的弹性资源分配
本文提出了一种基于算子影响域动态感知的弹性资源分配方法,旨在提升分布式流处理系统(DSPSs)在数据流动态波动下的服务质量(QoS)与资源利用率。该方法通过结合静态与动态选择性指标,自适应划分算子分区,并利用随机森林回归(RFR)建模分区内部算子间的相关性,实现并行度的精准规划。同时,引入基于LSTM元学习器与MLP基学习器的在线负载预测器,有效捕捉数据流的短期波动与长期趋势。实验结果表明,该方法能够提前、动态地调整资源,在满足端到端延迟要求的同时减少资源开销,显著提升系统稳定性与效率。原创 2025-10-02 09:29:28 · 67 阅读 · 0 评论 -
77、大数据集最小包围球的简单高效加速方法
本文提出了一种针对大数据集最小包围球问题的简单高效加速方法。通过引入基于轴对齐边界框(AABB)和凸包直径估计的预处理步骤,显著减少了参与计算的点数,从而大幅降低了Welzl算法(MSW版本)的递归深度与运行时间。该方法在E2和E3空间中均有效,具有Oexp(N)的时间复杂度,且易于实现与扩展。实验结果表明,预处理可带来高达100倍的加速效果,并显著优化内存使用。未来可通过SIMD指令或GPU进一步提升性能。原创 2025-10-01 13:33:38 · 61 阅读 · 0 评论 -
76、口罩对人类年龄和性别分类的影响
本文研究了口罩对人类年龄和性别自动分类的影响,采用DNN、CNN1、CNN3和CNN4四种深度学习模型,在由StyleGAN2生成的8000张人脸图像数据集上进行实验。通过引入不同类型的口罩(黑色织物口罩、彩色口罩、不同颜色和纹理口罩),分析其对分类性能的影响。结果显示,口罩显著降低了模型在13-20岁和21-50岁年龄组的分类准确率,且复杂纹理的口罩干扰了模型的学习能力;相比之下,卷积神经网络在极端年龄组(0-12岁和51+岁)表现更稳健,而DNN模型受口罩影响较大。研究建议在人脸识别系统中集成口罩检测与原创 2025-09-30 12:10:03 · 86 阅读 · 0 评论 -
75、深度神经网络在词汇替换与面部识别中的应用研究
本文探讨了深度神经网络在词汇替换与面部识别中的应用。在词汇替换方面,研究了基于Seq2Seq架构的多种合成数据集生成方法及其对模型性能的影响,并分析了预训练模型如BART和BERT在不同数据集下的表现;实验表明混合真实与合成数据可提升效果,但仍存在反义词替换和上下文干扰问题。在面部识别方面,研究了口罩遮挡对面部年龄与性别分类的负面影响,指出当前深度模型准确率显著下降,并提出了数据增强、特征融合和模型改进等应对策略。最后,文章展望了未来在数据优化、模型可解释性、实时处理及跨领域融合等方面的研究方向。原创 2025-09-29 09:04:31 · 51 阅读 · 0 评论 -
74、银行违约预测与波兰语词汇替换研究
本文探讨了银行违约预测与波兰语词汇替换两个领域的研究进展。在银行违约预测方面,分析了POD、POU和NI/TA等指标在不同预测期的表现,指出Merton DD模型的Z分数函数形式在6个月预测期内具有优越性能,但长期预测需结合净收入与总资产比率等补充指标。对于波兰语词汇替换任务,比较了BERT与BART等深度语言模型的应用效果,强调BART在处理强屈折语言中的多标记预测优势,并介绍了基于语料库生成合成数据集的方法及其局限性。研究还提出了未来改进方向,包括扩展Merton框架以适应随机波动率以及优化合成数据生成原创 2025-09-28 09:04:56 · 62 阅读 · 0 评论 -
73、利用默顿模型预测银行违约:以美国银行为例
本文探讨了默顿模型中的违约距离(DD)及其扩展资本距离(DC)在银行违约预测中的有效性,以美国银行为例,利用2010-2014年322家银行的季度数据进行实证分析。研究通过Cox比例风险模型和样本外预测检验三个假设,发现POD在6个月短期预测中具有显著预测能力,但并非充分统计量;引入资本充足率的POU在短期内优于POD,但在9个月长期预测中失效。股权波动率倒数(1/σ(E))是持续有效的强预测因子。研究表明默顿模型适用于短期银行违约预警,而长期预测需结合其他变量。原创 2025-09-27 16:17:46 · 100 阅读 · 0 评论 -
72、GPU 功率限制:深度学习训练中的能效权衡
本文探讨了在深度学习训练中通过GPU功率限制实现能效优化的方法与实验结果。基于NVML API和StaticEnergyProfiler(StEP)工具,对Quadro 6000和V100 GPU在不同功率限制下的能耗与性能进行评估,采用总能耗(E)、能量-延迟积(EDP)和能量-延迟和(EDS)三种指标进行双目标优化分析。实验表明,合理设置功率限制可在性能损失可控的前提下,实现高达33%的节能效果。文章还提供了针对不同优化目标的功率配置建议及操作流程,为绿色AI计算提供实践指导。原创 2025-09-26 11:04:45 · 101 阅读 · 0 评论 -
71、社交媒体隐私悖论与深度学习网络GPU能耗优化分析
本文探讨了社交媒体隐私悖论与深度学习网络训练中GPU能耗优化两大问题。通过系统动力学模型分析隐私相关参数对平台采用的影响,揭示了不同用户群体在隐私悖论中的作用;同时实验研究了GPU功率限制技术在多种CNN模型上的能耗与性能权衡,结果表明在合理配置下可实现显著能量节省并控制性能损失,为平台设计和AI能效优化提供了参考。原创 2025-09-25 13:50:28 · 64 阅读 · 0 评论 -
70、社交媒体中的隐私悖论:系统动力学分析
本文通过系统动力学方法构建了一个基于扩展巴斯模型的社交媒体平台采用模型,旨在揭示隐私悖论背后的动态机制。模型将用户分为实用主义者、原教旨主义者和不关心隐私者三类,并引入社会规范、隐私担忧及其消退(隐私疲劳)等关键因素,模拟了四种平台采用的动态模式。通过四个模拟实验,展示了在不同隐私担忧程度、开始时间、消退速度和社会规范强度下,用户行为如何演化,进而解释社会规范如何在多种情境下超越隐私担忧,导致隐私悖论的出现。研究结果为理解用户行为和制定平台运营策略提供了理论支持。原创 2025-09-24 11:35:21 · 74 阅读 · 0 评论 -
69、基于绝对键伸长的近场动力学损伤模型与社交媒体隐私悖论分析
本文探讨了基于绝对键伸长的近场动力学损伤模型在材料断裂模拟中的应用,推导了一维情况下的临界能量释放率与多种损伤常数,并通过能量分析证明了系统的能量守恒与衰减特性。结合无网格数值方法,验证了模型在动态裂纹扩展与分支问题中的有效性。另一方面,针对社交媒体中的隐私悖论现象,构建了考虑隐私关注多样性的系统动力学模型,揭示了少数低关注度者诱导多数高关注度者采用平台,以及少数高关注度者因社会压力难以退出的两种典型情景。研究表明,系统动力学能有效整合社会与技术因素,为理解隐私悖论提供新视角。未来研究将致力于模型扩展与完善原创 2025-09-23 10:40:12 · 53 阅读 · 0 评论 -
68、迭代方法与基于绝对键伸长的近场动力学损伤模型研究
本文研究了迭代方法的优化及其在生成美学图案和最小化迭代次数中的应用,同时提出了一种基于绝对键伸长的近场动力学损伤模型,以解决传统模型中损伤不连续的问题。通过对比多种迭代算法的性能,分析了New’和New”方法在收敛速度上的优势,并探讨了系数调整对视觉效果的影响。在损伤模型方面,通过引入绝对键伸长和Hermite插值构造连续损伤函数,提升了模型的适定性与物理合理性。文章还给出了弹性常数和损伤常数的确定方法,并总结了两类方法的应用流程与联系,展望了其在材料模拟、跨领域应用中的潜力。原创 2025-09-22 09:36:56 · 80 阅读 · 0 评论 -
67、野火周长多边形表征与新型广义迭代方法研究
本文研究了野火周长的多边形表征算法与基于PSO的牛顿类方法中的新型广义迭代方案。在野火周长检测方面,对比了迭代最小距离算法(IMDA)和四边形划分算法(QA),结果表明IMDA在精度和计算效率上更具优势。在数值计算方面,提出了一种可涵盖多种经典迭代形式的广义迭代框架,并结合粒子群优化(PSO)用于非线性方程的求解与美学图形生成。实验显示该广义方法能有效减少迭代次数并生成具有视觉美感的动力学图案。研究为野火监测与复杂系统数值分析提供了新思路。原创 2025-09-21 12:36:54 · 74 阅读 · 0 评论 -
66、野火边界多边形特征提取与乐器识别训练集设计
本文探讨了基于QUIC-Fire模拟数据的野火边界封闭多边形提取方法,重点研究了迭代最小距离算法(IMDA)和四分法算法(QA)在复杂燃烧区域图像中的应用。IMDA通过有序连接边界点有效处理多燃烧区域,具备较低计算复杂度;QA则通过递归划分与合并避免点排序,生成规整边界。两种算法均能在一秒内完成计算,具有良好的稳健性与实用性,为野火进展预测与防控提供了有效的技术支撑。原创 2025-09-20 15:52:12 · 95 阅读 · 0 评论 -
65、乐器识别训练集的设计
本文系统研究了乐器识别训练集的设计方法,重点探讨了声音特征提取(采用MFCC)与分类算法(使用最近邻法)在自动识别乐器音色中的应用。通过多组实验分析了训练数据量、声音特征多样性(如动态与发音变化)以及数据类型(模拟与数字乐器)对识别准确率的影响。结果表明,增加训练样本数量、丰富声音特征和融合多种数据来源可显著提升识别性能。文章总结了关键结论,提出了实际应用建议,并展望了多乐器分离、度量标准优化及数据集扩展等未来研究方向。原创 2025-09-19 13:38:11 · 120 阅读 · 0 评论 -
64、网络欺凌检测与乐器识别研究:数据驱动的创新探索
本文探讨了数据驱动方法在网络欺凌检测与乐器识别两个领域的应用。在网络欺凌检测方面,提出了一种混合深度模型HMMF,结合评论内容与用户侧面信息,在多个中文预训练模型基础上显著提升了检测性能,尤其在融合多源信息时表现出更强的识别能力。在乐器识别研究中,系统分析了训练集设计的关键因素,包括声音动态、发音方式、数据量及数据类型的影响,结果表明混合多种特征和真实与数字样本能有效提升模型泛化能力和准确率。两项研究均强调了高质量数据设计对模型性能的重要作用,为后续相关领域的发展提供了实践指导和研究方向。原创 2025-09-18 12:19:05 · 59 阅读 · 0 评论 -
63、利用辅助信息进行网络欺凌检测:新冠疫情新闻中文评论的实际应用
本文提出了一种基于多特征融合的混合深度模型(HMMF),用于检测社交媒体中的网络欺凌行为,特别是在新冠疫情相关新闻的中文评论场景下。HMMF首次将多种中文预训练模型与Transformer架构结合,充分利用评论内容和辅助信息(如点赞数、回复数等)进行联合建模,提升了检测性能。同时,研究发布了一个新的公开基准数据集JRTT,包含4016条来自今日头条的标注评论,是首个带辅助信息的中文网络欺凌检测数据集。实验结果表明,HMMF在准确率、精确率、召回率和F1值上均显著优于传统机器学习和主流深度学习模型,验证了其有原创 2025-09-17 14:45:58 · 80 阅读 · 0 评论 -
62、基于MapReduce和LSH的可扩展集合相似性连接算法研究
本文研究并提出了一种基于MapReduce和局部敏感哈希(LSH)的可扩展集合相似性连接算法MRSS-join。该算法通过引入MinHash函数、分布式直方图和随机通信模板,有效减少了集合比较次数和通信开销,在处理大规模数据集时展现出优异的性能与可扩展性。实验结果表明,相较于传统VJ算法,MRSS-join在处理时间、数据传输效率及负载均衡方面具有显著优势,尤其适用于包含高频率连接属性值和大宇宙规模的数据集。同时,算法在保证高召回率的前提下大幅降低了计算成本,具备良好的实用性。未来工作将拓展其至更通用的相似原创 2025-09-16 16:12:33 · 63 阅读 · 0 评论 -
61、网络技术与算法研究进展
本文介绍了两项网络技术与算法领域的研究进展:一是基于MEEK的TOR隐藏服务访问识别方法,该方法通过分析关键序列片段显著提升了识别及时性并降低了硬件资源消耗;二是MRSS-join算法,结合MapReduce与局部敏感哈希(LSH)技术,实现了大规模数据集下高效、可扩展的集合相似度连接,具备良好的负载平衡与低通信成本优势。两项成果分别在网络安全监测和大数据相似性计算中具有重要应用价值。原创 2025-09-15 10:16:54 · 58 阅读 · 0 评论 -
60、基于MEEK的TOR隐藏服务访问识别
本文提出了一种基于关键序列的轻量级方法,用于识别通过Meek协议访问Tor隐藏服务的行为。在不解密流量的前提下,网络级攻击者可通过分析TCP数据包中的特定关键序列(即建立会合单元到接收rendezvous2单元之间的流量)有效区分用户是否访问Tor隐藏服务。研究构建了包含四种CDN场景的MEEK21数据集,并验证了深度学习模型DF在识别性能上显著优于传统CUMUL方法。实验表明,利用关键序列进行分类可提升3%-4%的准确率,同时大幅减少所需处理的数据量,显著提高识别效率并降低资源消耗,为对抗审查环境下的匿名原创 2025-09-14 13:30:47 · 105 阅读 · 0 评论 -
59、基于图拉普拉斯多任务学习的股票预测与MEEK - 基于关键包序列的Tor隐藏服务访问识别
本文介绍了两项前沿研究:一是基于图拉普拉斯多任务学习的股票预测方法FMSP-FGL,通过构建图结构并结合DARNN模型,在DJIA和SP500数据集上实现了优于多种基线方法的预测性能,尤其在准确率和精确率方面表现突出;二是MEEK环境下基于关键TCP包序列的Tor隐藏服务访问识别方法,通过提取通信早期的关键序列,显著提升了识别及时性与效率,降低了资源消耗,并公开了包含四种MEEK场景的大规模数据集。两项研究分别为金融时间序列预测和网络匿名流量识别提供了高效、可扩展的新思路。原创 2025-09-13 14:22:10 · 76 阅读 · 0 评论 -
58、基于图拉普拉斯的多任务学习股票预测器
本文提出了一种基于图拉普拉斯的联邦多任务学习股票预测器(FMSP-FGL),通过引入金融约束的图结构学习,有效捕捉股票之间的序列间关系和集群内依赖。该方法结合联邦多任务框架为每只股票构建个性化预测模型,并利用图拉普拉斯正则化建模任务间关系。实验表明,FMSP-FGL在两个主流股票指数上优于独立模型、FMTL和FedU等基线方法,在准确率和均方误差方面均有显著提升。研究为股票预测提供了新的融合图学习与深度学习的思路。原创 2025-09-12 14:35:26 · 100 阅读 · 0 评论 -
57、金刚石中n型B - N共掺杂与N掺杂研究
本文研究了金刚石中B-N共掺杂与单一氮掺杂的n型掺杂特性,系统分析了杂质形成能、能带结构、电离能及电子结构。结果表明,B-N共掺杂尤其是B-N3结构具有低形成能(-0.875 eV)和极低电离能(0.23 eV),显著优于传统单一掺杂,且N-2p态主导导带边缘,有利于实现高效n型导电。结合直接带隙和小电子有效质量优势,B-N3被视为实现浅施主n型金刚石的理想候选,未来需通过实验验证并探索其在半导体、光电器件和传感器中的应用潜力。原创 2025-09-11 16:34:14 · 129 阅读 · 0 评论 -
56、深入探究超级计算机登录节点用户行为与金刚石掺杂技术
本文深入研究了超级计算机登录节点的用户行为与金刚石n型掺杂技术。在HPC方面,分析了用户会话时长、不当使用现象(如运行紧密耦合和高吞吐量应用)以及科学工作流的使用趋势,提出了优化系统管理和提升用户体验的策略;在材料科学方面,探讨了金刚石n型掺杂的挑战与进展,重点介绍了B-N共掺杂的优势及其在未来电子器件中的潜力,并展望了工艺优化、新掺杂组合探索和电子结构研究等方向。原创 2025-09-10 16:20:17 · 66 阅读 · 0 评论 -
55、银行客户动态分类与超级计算机用户行为洞察
本文探讨了银行客户交易行为的动态分类方法与Summit超级计算机登录节点的用户行为分析。在银行业务方面,基于LSTM模型和增量学习的动态分类方法能有效识别客户行为的可预测性,适应数据分布变化,在疫情期间表现优于非自适应模型,ROC-AUC从0.74提升至0.78。在高性能计算领域,通过对Summit登录节点两年的数据分析,揭示了用户访问模式、I/O性能瓶颈及作业资源消耗不均等问题,发现少数用户提交了超过82%的计算作业,大量进程运行导致I/O性能显著下降。研究还识别出非典型使用和不当行为,并建立了用户行为与原创 2025-09-09 14:21:41 · 46 阅读 · 0 评论 -
54、网络传输与银行客户分类的技术研究与应用
本文探讨了网络传输中的一致性栅栏(Consistency Fences, CFs)机制与银行客户交易行为可预测性的动态分类方法。CFs通过支持部分顺序交付,有效减少因数据包丢失导致的队首阻塞和延迟,结合前向纠错(FEC)进一步提升传输效率,适用于远程桌面等延迟敏感场景。在银行客户分析方面,提出基于LSTM和双向LSTM的预测与分类模型,结合增量学习实现对客户可预测性类别的动态划分,并通过可预测性轮廓分析客户行为变化,尤其在COVID-19等危机期间展现出良好的适应能力。实验结果表明,所提方法在不同数据集上均原创 2025-09-08 13:41:10 · 74 阅读 · 0 评论 -
53、利用一致性栅栏实现部分有序交付以降低延迟
本文提出了一致性栅栏(Consistency Fences, CF)机制,结合前向纠错(FEC)技术,实现部分有序交付以降低数据传输中的消息阻塞时间。通过在发送依赖数据块前插入栅栏,接收方能分阶段交付数据,有效缓解头阻塞问题。实验基于UDT协议,在不同丢包率、RTT和消息更新规模下验证了该方案的性能优势。结果表明,尤其在高丢包率和高RTT场景中,部分有序交付结合2D XOR FEC显著减少了累积延迟,优于传统全序交付。该方法为实时应用如屏幕更新、视频流等提供了高效低延迟的传输解决方案。原创 2025-09-07 14:11:10 · 46 阅读 · 0 评论 -
52、MHGEE:基于多粒度异质图的事件提取与一致性栅栏的部分有序交付
本文提出了一种基于多粒度异质图的事件提取模型MHGEE,通过构建包含实体、上下文和触发词等多类型节点的异质图,并利用R-GCN实现信息聚合,有效提升了事件检测与参数识别的性能。实验表明,MHGEE在ACE 2005数据集上优于现有模型,尤其在处理多事件场景和缓解触发器歧义方面表现突出。同时,文章引入一致性栅栏(CF)机制,支持部分有序消息交付,显著降低特定工作负载下的消息延迟。消融分析验证了各图结构组件的重要性,未来计划将MHGEE拓展至其他信息提取任务,并优化CF在不同网络环境中的应用。原创 2025-09-06 15:24:59 · 54 阅读 · 0 评论 -
51、MHGEE:基于多粒度异质图的事件提取模型
MHGEE是一种基于多粒度异质图的句子级事件提取模型,旨在解决触发词歧义和事件依赖两大挑战。该模型通过构建包含单词、实体和上下文三种节点及六种边类型的异质图,融合多粒度信息,并利用带门控机制的R-GCN进行信息传播,有效增强语义表示。MHGEE首次为整个事件提取任务构建异质图,能够同时建模句内与句间事件关系,在ACE 2005数据集上显著优于现有方法,触发词识别F1提升近5%,参数识别提升2%。实验表明其在处理多事件句子和歧义触发词方面具有优越性能,具备广泛应用于信息检索、舆情分析等领域的潜力。原创 2025-09-05 11:12:41 · 57 阅读 · 0 评论 -
50、频繁串行事件的增量挖掘
本文介绍了一种针对频繁串行事件的增量挖掘方法,通过树合并、出现次数列表完成和非频繁模式修剪等步骤,有效提升数据流中复杂串行模式的挖掘效率。算法在合成数据和真实智能电表数据上的实验表明,IncSeq方法在执行时间上显著优于传统Batch方法,尤其在高窗口大小和低支持度下表现更优。未来工作将拓展至最大模式、闭模式及公平模式挖掘,并探索图数据表示的应用场景。原创 2025-09-04 11:30:01 · 55 阅读 · 0 评论 -
49、优化算法与序列模式挖掘:新方法与应用
本文介绍了两种前沿方法:TROPHY——一种基于可变精度的信任域优化算法,能显著降低高成本函数评估的计算开销,在气候模型等场景中具有广泛应用前景;以及IncSeq——一种用于项目集流的增量序列模式挖掘框架,能够精确计算频繁串行事件的出现次数,并通过高效的树结构与剪枝策略实现快速在线挖掘。文章对比了二者在计算效率、应用场景和发展潜力方面的异同,并探讨了它们在气候模拟、网络流量分析等领域的实际应用。未来,两种方法有望在硬件优化、算法融合及跨领域应用中发挥更大作用。原创 2025-09-03 12:00:20 · 56 阅读 · 0 评论 -
48、TROPHY:利用精度层次结构的信赖域优化
本文提出了一种名为TROPHY的信赖域优化算法,通过利用精度层次结构实现动态精度切换,有效降低大规模计算中目标函数和导数的计算成本。TROPHY在CUTEst测试集和多普勒雷达风场反演问题中表现出优越的计算效率,尤其在调整调用次数方面显著优于固定精度方法。实验表明,使用两到三个间隔较大的精度级别时效果最佳,但在多精度频繁切换或中小规模问题中存在局限性。该算法为高成本优化问题提供了一种高效的解决方案。原创 2025-09-02 14:35:02 · 88 阅读 · 0 评论 -
47、网络攻击流量检测与优化算法解析
本文介绍了两种关键技术:HNOP方法用于单包攻击流量检测,通过分层节点跳跃映射和G BERT模型提取多层次特征,有效识别各类网络攻击,在CICIDS2017和IIE HTTP数据集上表现出高准确率与强泛化能力;TROPHY算法是一种基于混合精度的信赖域优化方法,结合L-SR1海森矩阵近似,显著降低大规模非线性无约束问题的计算负载。两者分别在网络安全与科学计算领域具有重要应用价值,未来可结合应用于复杂系统的安全与性能协同优化。原创 2025-09-01 09:31:02 · 64 阅读 · 0 评论 -
46、元数据挖掘与攻击流量检测技术解析
本文探讨了元数据挖掘与攻击流量检测两项关键技术。在元数据挖掘方面,提出基于轻量级字节特征和机器学习的文件类型识别方法,结合提取器调度策略提升元数据提取的准确性与效率,并通过实验验证其优于传统工具Libmagic。在攻击流量检测方面,针对现有方法忽略层次关系和泛化性差的问题,提出HNOP模型,利用层次节点跳跃结构和GBERT与卷积结合的方式提取深层特征,有效提升单包攻击检测的准确率与鲁棒性。实验结果表明,该模型在CICIDS2017和IIE HTTP数据集上表现优异。最后,文章给出了两项技术在数据管理与网络安原创 2025-08-31 16:54:57 · 54 阅读 · 0 评论 -
45、挖掘有意义元数据的模型与指标
本文提出了一种基于文件类型识别(FTI)的智能提取器调度器,旨在提升科学数据元数据提取的效率与质量。通过训练统计学习模型,系统能优先选择最合适的提取器,最大化元数据产量与时间的比值。同时引入产量、完整性、熵和可读性等质量指标,全面评估元数据实用性。在CDIAC和CORD两个大型科学数据集上的实验表明,该方法在文件类型识别准确率上超越libmagic达35%,并显著提升元数据的完整性与可读性。此外,系统支持自动化质量评估与反馈调度,为科学数据的高效管理提供了有力支撑。原创 2025-08-30 14:09:53 · 62 阅读 · 0 评论 -
44、自动化显微镜的超快速焦点检测技术解析
本文介绍了一种基于多尺度组织学特征检测的超快速焦点检测技术,用于增强自动化显微镜在数据采集过程中的实时质量控制能力。该技术利用GPU加速实现近实时的图像聚焦评估,通过检测不同尺度下的组织学特征数量作为景深的替代指标,并结合funcX平台将其部署为按需服务,支持远程调用与研究自动化流程集成。系统在单GPU下对1024×1024图像实现约50Hz的处理速度,具备高准确性与可扩展性,适用于生命科学、材料科学和工业检测等领域。尽管存在GPU内存依赖和funcX平台引入延迟等局限,未来可通过内存优化、算法改进与深度学原创 2025-08-29 11:07:03 · 59 阅读 · 0 评论 -
43、超大规模图的PageRank算法扩展与自动化显微镜的超快焦点检测
本文探讨了超大规模图的PageRank算法扩展与自动化显微镜的超快焦点检测两项关键技术。在PageRank方面,分析了不同MPI配置和存储格式对性能与内存使用的影响,揭示了可扩展性优势及内存瓶颈挑战;在焦点检测方面,提出了基于多尺度组织学特征检测(MHFD)的技术,实现了低延迟、高精度的失焦图像识别,并部署为GPU加速的按需服务。文章还对比了技术方案的优劣,讨论了实际应用中的挑战,并展望了未来结合深度学习与跨学科协作的发展方向。原创 2025-08-28 10:59:14 · 51 阅读 · 0 评论 -
42、在富岳超级计算机上扩展超大型图的PageRank算法
本文研究了在富岳超级计算机上扩展超大型图的PageRank算法,重点分析了其在分布式环境下的并行实现与可扩展性。通过使用MPI和OpenMP结合C++实现,采用CSR、ELLPACK和SCOO等稀疏矩阵存储格式,并利用A64FX处理器的SVE向量化能力,在高达1024个计算节点上进行了弱缩放实验。结果表明,即使处理包含超过4000亿非零元素的巨型矩阵,算法仍能在几秒内完成迭代,展现出良好的性能和扩展性。研究还比较了不同MPI/OpenMP配置对性能的影响,发现每个CMG一个MPI进程的设置通常表现更优。同时原创 2025-08-27 15:47:53 · 71 阅读 · 0 评论
分享