- 博客(700)
- 资源 (3)
- 收藏
- 关注
原创 人工智能SCI顶刊实验步骤
假设你提出一个新模型:| 论文主张 | 必须做的实验 |你可以把一篇顶级AI论文实验理解成下面这条流水线:真正需要你跑很多次模型的,是中间这一大段。而不是:假设我们的任务是:例如:N=[10000, 2000, 1000, 500, 200]N=[10000,\ 2000,\ 1000,\ 500,\ 200]N=[10000, 2000, 1000, 500, 200]最大类别与最小类别之比:IR=10000200=50IR=\frac{10000}{200}=50IR=20010000
2026-10-01 11:03:51
363
原创 超参分析入门教程
超参数分析旨在揭示关键超参数对模型性能的影响规律,而非简单寻找最优值。通过控制变量法,逐个调整学习率、dropout、λ等参数,观察性能变化趋势,可解释为何选择特定值。例如学习率过大会导致训练震荡,过小则收敛慢,而适中值(如0.001)表现最佳。此类分析能增强论文可信度,回应审稿人质疑,体现研究的严谨性与深度。
2026-10-01 10:37:37
272
原创 时间序列非平衡样本分类研究综述:发展脉络、核心方法与前沿方向
时间序列非平衡分类(ITSC)面临样本数量少、时间结构复杂、模式多样等挑战。研究历经五代演进:从早期重采样到结构保持生成,再到代价敏感学习与损失函数优化,近年聚焦于对比学习、图建模与长尾表示学习,核心逻辑已从“补样本”转向“重构特征表示与决策边界”,强调在真实分布下提升少数类识别能力。
2026-10-01 10:10:44
359
原创 智能体(AI Agent)研究进展与发展现状文献综述
智能体(AI Agent)研究历经经典符号系统、强化学习与大模型驱动三大阶段。早期聚焦BDI认知架构与多智能体协作;2010年后强化学习实现自主策略学习;2022年起,大语言模型(LLM)赋予智能体推理、规划、工具调用与环境交互能力,推动其从“回答问题”转向“持续执行任务”。以ReAct为代表的新范式整合思考与行动,形成感知—决策—行动闭环。当前主流框架包含记忆、规划、工具使用与自我反思等模块,评测体系亦转向动态环境下的真实任务表现。截至2026年,LLM Agent已发展为融合语言理解、自主决策与持续学习
2026-09-30 16:04:45
619
原创 变分模态分解(VMD)的教程
VMD(变分模态分解)的核心思想是将复杂时间序列分解为若干个频率集中、物理意义明确的模态分量,每个分量可表示为时变幅值与相位的调制信号。它通过构造解析信号并利用Hilbert变换提取瞬时频率,再将各模态解调至基带,以导数能量衡量带宽,实现“窄带”约束下的最优分解。相比傅里叶变换,VMD更适用于非平稳信号,能有效分离趋势、周期与噪声成分,在电力负荷等场景中展现出强大优势。
2026-09-30 14:46:01
337
原创 时间序列异常诊断
<think>我们只需要生成一个不超过150字的摘要,基于用户提供的长文内容。摘要应简洁概括文章主题:时间序列异常诊断的定义、层次、方法等。注意字数限制。</think>时间序列异常诊断是通过分析随时间变化的数据,不仅检测“何时异常”,还深入定位异常变量、识别故障类型并追溯根因。它区别于单纯异常检测,强调从“发生了什么”到“为什么发生”的递进推理。工业中常采用仅学习正常状态的方法,通过重构误差等量化偏离度,适用于故障数据稀缺的场景。
2026-09-06 20:57:01
190
原创 AutoEncoder时间序列异常检测
<think>我们只需要生成摘要,直接根据内容概括即可。目标:≤150字。内容涉及传感器数据、滑动窗口、AutoEncoder异常检测。摘要应包含核心流程和要点。</think>基于真实传感器数据(压力、流量、振动)的异常检测案例:系统仅用正常数据训练AutoEncoder,对最近60秒滑动窗口标准化后重构,通过重构误差是否超阈值判断异常。该方法只识别“数据不像正常”,属异常检测而非故障诊断,为后续定位与诊断奠定基础。
2026-09-06 10:26:48
231
原创 基于重构的无监督/单类时间序列异常检测
这类方法通常叫做,典型模型包括 AutoEncoder、LSTM-AE、TCN-AE、Transformer-AE、VAE 等。
2026-09-06 10:15:55
403
原创 注意力机制入门教程:从本质到彻底理解QKV
<think>我们只需要根据用户要求生成≤150字的文章摘要。用户输入是一篇完整的教程内容。我们需要从内容中提炼出核心要点。注意摘要要简洁,不超过150字。中文摘要。要涵盖注意力机制的本质、QKV的角色、为什么分开等核心点。输出直接是摘要内容。注意字数限制。</think>注意力机制本质是软性数据库查询:不丢弃信息,只调整权重。Q代表需求清单,K代表索引标签,V代表实际内容。流程为Q与所有K点积算相似度,经Softmax归一化后加权求和V。Q打破对称性以建模方向关系,K/V分离实现检索与存储解耦,权重矩阵由
2026-09-02 17:00:55
315
原创 石油工程压裂入门教程
摘要: 水力压裂的核心目标是在储层中形成高导流能力的有效裂缝,而非单纯“压开地层”。其原理是通过流体压力创造裂缝,支撑剂维持裂缝,优化设计控制裂缝。压裂涉及六个关键问题:必要性、裂缝形成机制、压力类型(如井底压力、净压力)、储层特性、岩石力学参数(应力、模量等)及压裂液与支撑剂的选择。压裂液需平衡携砂能力与储层伤害,支撑剂需考虑强度、粒径等因素。设计流程包括目标确定、资料收集、可压性评价、小型测试及裂缝模拟。最终,压裂成功取决于能否形成长期有效的“油气高速公路”。
2026-08-12 15:35:43
456
原创 LSTM公式计算推演
LSTM是一种改进的RNN结构,通过细胞状态和三个门控机制(遗忘门、输入门、输出门)解决长序列记忆问题。遗忘门决定丢弃哪些旧记忆,输入门控制新记忆的写入,细胞状态线性更新实现长期记忆,输出门筛选当前有用信息。例如在处理"小时候住在成都,现在依然喜欢成都"时,LSTM能遗忘早期无关细节(如"小时候"),保留关键地名("成都"),并输出当前语义("喜欢成都")。核心公式为细胞状态的线性组合:Ct=ft⊙Ct-1+it⊙C̃t,确保梯度不消失,从而有效学习长距离依赖关系。
2026-07-13 20:20:39
343
原创 注意力机制与transformer 的关系与区别
摘要: 注意力机制是Transformer的核心组件,其本质是一种动态权重分配方法,通过计算Query、Key和Value的相关性,确定信息的重要性。而Transformer是一种完整神经网络架构,系统化整合了多头自注意力、位置编码、前馈网络等模块,实现了并行化长序列建模。二者的关系类似于发动机与汽车——注意力机制提供基础计算能力,Transformer通过多层堆叠和工程优化形成高效模型,支撑了BERT、GPT等大语言模型的发展。相比传统RNN,Transformer因自注意力机制的优势,在并行计算和长程依
2026-07-05 20:54:57
385
原创 AGENT 教程 S05 技能系统(Skill)
不再把所有知识一次性塞进提示词,做到用什么技能,就加载什么技能。技能系统的核心不是新增一个工具,而是把「各类专项知识」从常驻提示词中剥离,拆分为「轻量目录发现 + 完整内容按需加载」,精简上下文、节约 Token,让 Agent 架构更灵活易扩展。
2026-06-11 15:11:15
356
原创 AGENT 教程 S04 子代理 Subagent|上下文隔离
本文介绍了S04子代理(Subagent)的实现,旨在解决S03架构中主上下文消息爆炸的问题。通过新增task工具和子代理逻辑,实现任务隔离,避免中间日志污染主上下文。 核心改进点: 父Agent可将探索类子任务外包给子代理 子代理拥有独立消息列表,仅返回精简总结给父上下文 限制子代理工具集(禁用task)和最大运行轮数(5轮) 关键特点: 保持S03原有代码不变 子代理为一次性临时实例 防止递归调用和无限循环 有效降低API调用成本 文章包含详细的问题分析、架构对比、常见误区说明以及完整实现代码,强调子代
2026-06-11 15:04:38
349
原创 Agent教程 S03 会话级待办规划
文章摘要: S03会话级待办规划系统在S02基础上新增todo工具,将任务计划从LLM隐性记忆转为程序外置状态。该系统解决了多步骤任务的三大痛点:任务漂移、重复操作和计划不可控。通过TodoManager类实现任务清单的增删改查,强制单任务锁定(in_progress)和自动提醒机制。架构上保持S02原有4个工具不变,仅新增todo工具和状态管理模块。代码实现采用分层设计,确保与S02兼容性,并修复了Windows bash编码问题。系统提示词明确要求AI必须使用todo工具进行多步骤任务规划,实现任务进度
2026-06-05 10:52:05
249
原创 agent教程S02 工具路由分发
本文介绍了S02工具路由分发的结构化设计方案,目标是解耦工具与主循环,支持新增工具无需修改Agent主代码,并增强文件操作安全性。文章通过分析S01硬编码工具的三大痛点(代码膨胀、安全漏洞、循环稳定性差),提出分层架构方案:在Agent主循环外新增工具分发层,通过字典映射(TOOL_HANDLERS)实现工具路由,并引入路径沙箱(safe_path)限制文件访问范围。具体实现包括:定义安全工作目录、编写四类独立工具函数(bash/读写/编辑文件)、工具分发字典、复用S01主循环逻辑,以及消息规范化处理。该设
2026-06-04 23:34:48
387
原创 agent教程S01-Agent 最小循环教程整理
文章摘要 该教程详细介绍了如何将原生大语言模型(LLM)升级为自主执行任务的智能体(Agent)。首先指出原生LLM的局限性——只能生成文本而无法主动调用工具、获取执行结果并进行迭代思考。核心解决方案是建立循环调度机制,实现模型输出→工具执行→结果反馈→继续推理的闭环流程。教程拆解了Agent的关键概念(循环、轮次、工具结果等)和数据结构(消息体、工具结果块、循环状态),并提供了最小Agent循环的代码实现,强调工具结果必须回写消息历史的必要性。最后通过三个实战案例(计算器、时间查询、文件操作)演示了如何基
2026-06-04 22:48:26
380
原创 告别 akshare 依赖!a-stock-data V3.0 A 股全栈数据工具包:7 层架构一站式搞定投研数据
a-stock-data 是一款A股全栈数据工具包,核心以独立SKILL.md文件为载体,采用结构化Markdown+内嵌Python设计,把13个分散的A股原始数据源封装成可直接调用的工具集。a-stock-data V3.0 无疑是目前最适合个人开发者的免费A股全栈数据工具,摒弃臃肿的akshare依赖,直连原生API更稳定;7层架构覆盖全投研场景,28个端点满足绝大多数数据需求;同时深度适配AI编程助手,把复杂的数据采集、接口适配全部封装,让投研和量化开发零门槛、高效率。
2026-05-24 19:28:56
3419
原创 Transfomer的位置嵌入理解
本文详细解析了Transformer模型中的位置嵌入机制。对于文本Transformer,位置嵌入解决自注意力机制的位置无关性问题,通过将位置索引编码为向量并与词向量相加,使模型理解词序。主流方法包括固定正弦编码和可学习位置嵌入。对于图像Transformer(ViT),位置编码需处理二维空间关系,常见方法有1D顺序编码、2D行列编码和相对位置编码。关键区别在于:文本位置是词序索引,图像位置是patch的2D坐标。位置嵌入使Transformer既能理解内容又能感知结构信息,对处理序列和空间数据至关重要。
2026-05-19 09:35:11
373
原创 燃气调压器数据可能存在的问题
本文整理了燃气调压器SCADA数据建模前常见的八类数据问题,包括调压器未使用/停用数据、低负荷运行数据、正常运行数据、缺失值问题、重复时间戳问题、异常尖峰值问题、异常低值/瞬时掉零问题以及传感器卡死/数据冻结。针对每类问题,提供了模拟数据样本、判断特征和处理建议。这些问题可能影响建模效果,需在数据预处理阶段进行识别和适当处理,如标记特殊状态、删除重复数据、插值填充缺失值等,以确保数据质量和模型准确性。
2026-05-10 10:59:50
473
原创 VUE3入门
Vue3 是一个基于组件化的前端框架,通过响应式数据自动同步页面更新。核心概念包括:单文件组件(.vue文件)整合模板、逻辑和样式;响应式数据(ref/reactive)实现数据驱动视图;模板语法(插值、指令)连接数据与DOM;组件化开发(props/emit)构建模块化应用;组合式API提升逻辑复用性;配套工具(Vue Router/Pinia)处理路由和状态管理。Vue3让开发者专注于数据状态,自动处理DOM更新,简化复杂前端开发。
2026-05-08 21:21:33
480
原创 采油工程从入门到理解
石油开采技术创新与应用摘要 本文系统介绍了四种提高石油采收率的核心技术及其配套管理措施: 热力采油技术 蒸汽驱/吞吐通过300℃高温将稠油粘度降低100-1000倍 典型案例:辽河油田稠油热采使单井日产量从0.5吨提升至5-10吨 成本效益:蒸汽驱采收率达40-60%,吨油成本约150元 气体驱油技术 CO₂驱实现原油体积膨胀10-40%,粘度降低50-80% 吉林油田应用显示可提高采收率10-20个百分点 兼具环保效益:单吨油消耗0.3-0.5吨CO₂实现碳封存 生物技术应用 微生物采油通过代谢产物改善原
2026-05-02 14:08:28
989
原创 机器学习从入门到理解
偏差(拟合不足)与方差(拟合过度)。不存在绝对最优的单一模型,所有模型选择、正则化、特征工程、集成学习、模型复杂度设计,本质都是在动态平衡二者,寻找全局最优泛化点。机器学习模型天然只能学习相关性,无法自动推导因果关系。数据中的混杂变量、辛普森悖论、虚假关联、时序耦合会产生大量伪规律;顶尖研究者会天然区分「统计关联」和「现实因果」,拒绝把拟合规律直接等同于业务逻辑。泛化能力是模型的唯一终极指标,训练集准确率无实际价值。在同等效果下,优先选择结构更简单、参数更少、约束更强、依赖更少特征的模型;
2026-04-26 20:24:02
679
原创 CNN循环神经网络关键知识点
完全沿用你之前RNN表格格式思维模式解决核心问题技术支撑理论意义局部相关性先验图像空间冗余连接局部连接机制放弃全连接暴力建模,利用图像天然结构先验空间参数共享位置差异、参数爆炸、过拟合滑动卷积权重复用实现特征位置无关提取,极大轻量化模型层次化特征抽象底层像素到高层语义建模多层卷积堆叠融合复刻视觉认知规律,实现高阶目标识别空间聚合降维鲁棒特征冗余、形变干扰、计算量大池化下采样操作信息提纯,提升模型抗干扰能力与计算效率感受野逐层扩张局部卷积无法获取全局信息。
2026-04-20 00:06:49
580
原创 RNN循环神经网络关键知识点
以下是循环神经网络(RNN)核心内容的摘要(150字以内): RNN领域存在五大核心思维模式:1)时序依赖建模,通过循环连接捕捉序列元素间动态关系;2)隐藏状态记忆机制,动态编码历史信息;3)参数共享设计,适应变长序列并降低复杂度;4)时间维度展开,将循环结构转化为可训练的前馈网络;5)长短期依赖权衡,通过门控机制(LSTM/GRU)解决梯度问题。主要争议集中在:RNN与Transformer的架构选择、门控机制的有效性,以及参数共享的合理性。当前趋势倾向于混合架构(如RNN+注意力),在保持时序建模优势的
2026-04-19 23:56:24
466
原创 Time-Series-Library 仓库的使用
本文介绍了如何在Time-Series-Library时序预测框架中添加自定义模型。主要步骤包括:1) 在models目录下编写模型代码并遵循接口规范;2) 在__init__.py中注册新模型;3) 创建配置文件指定参数;4) 通过run.py脚本运行训练。该框架采用标准化设计,只需实现模型结构并正确注册,即可复用现有的训练/测试流程。文中以MyMLP为例演示了完整接入流程,并说明了模型替换和常见问题解决方法,帮助开发者快速集成自己的时序预测模型。
2026-04-19 21:55:15
393
原创 THUML 团队开源的时间序列深度学习工具箱
-model:换模型(TimesNet/iTransformer/DLinear):换任务(long_term_forecast/imputation/anomaly_detection):换数据集(ETTh1.csv/ETTh2.csv/ETTm1.csv)示例:长预测换iTransformer模型克隆代码→装环境→放数据→一键运行,不用懂复杂原理,就能直接用时间序列SOTA模型做任务。
2026-04-15 22:04:17
671
原创 机器学习中的小提琴图有什么作用
让我画一个直观的对比来帮助理解:如上图所示,左侧的箱线图中两组数据的统计摘要几乎一样(中位数、四分位距接近),很容易误以为它们是相似的分布。在房价预测中,“房屋面积"这个特征的小提琴图如果出现两个明显的"鼓包”(双峰),往往意味着数据混合了两种不同类型的房屋(比如公寓和别墅)。小提琴图(Violin Plot)是机器学习和数据分析中一种非常实用的可视化工具,它结合了箱线图和核密度估计图的优点,主要用于展示数据的分布形态。好的,下面用三个具体场景来说明小提琴图在特征分布分析中的应用。
2026-04-15 21:21:24
573
原创 什么是机器学习中的类别不平衡
本文探讨了数据不平衡问题及其解决方案。数据不平衡指各类别样本数量差异显著,如欺诈检测中正常交易远多于欺诈交易。这会导致模型偏向多数类、少数类学习不足、评估指标误导等问题。文章分析了模型"偷懒"的理论原因,如损失函数和梯度下降的影响。判断不平衡程度可分为基本平衡(1:1~1:2)、轻度(1:2~1:10)、中度(1:10~1:100)和极度不平衡(1:100+)。解决方案包括数据层面的重采样技术(随机过采样、SMOTE合成采样、随机欠采样)和算法层面的调整(类别权重、代价敏感学习、集成方法
2026-04-13 17:31:30
513
原创 油藏工程设计、地质工程设计、钻井工程设计、采油工程设计
石油工程四大设计协同作业体系解析 石油开发是一个系统工程,主要包括四大设计环节:油藏工程设计作为"总设计师"制定整体开发方案;地质工程设计担任"侦察兵"角色,提供地质依据;钻井工程设计作为"施工队长"负责具体钻井方案;采油工程设计则是"运营经理",负责开采方案制定。这四大设计形成递进依赖关系:油藏设计指导地质设计,地质数据支撑钻井设计,钻井结果决定采油设计,而采油数据又反馈优化油藏设计。通过渤海湾油田开发案例可见,四大设计协同作
2026-04-07 14:38:58
472
原创 如何利用agent进行软件开发
文章摘要(150字): 本文提出一套AI Agent开发标准化流程,解决90%开发者「需求模糊→Agent盲写→结果偏离」的痛点。核心采用人主导规划+Agent分阶执行模式,将开发拆解为6个阶段:1)结构化需求锚定;2)原子任务拆分;3)单微任务执行;4)即时校验;5)集成联调;6)验收交付。通过钻井现场「固井工程设计系统」案例,演示如何用Python+PyQt6实现需求结构化(输入井深/套管参数→生成规范文档)、任务原子化(每个功能10分钟完成)、边做边验(避免堆叠错误)。最终交付可离线运行的工程软件,满
2026-04-02 21:47:35
771
原创 孤立森林(Isolation Forest)原理小白教程
孤立森林通过随机划分的难易程度来判断异常,异常点因稀疏而"易碎",正常点因密集而"坚韧"。这个算法之所以优美,在于它完全放弃了"定义什么是正常"的复杂建模,转而利用异常点的结构性弱点——稀疏性,使其成为工业界异常检测的首选方案之一。孤立深度 = 把这个点单独切分出来,需要砍多少刀拿一堆数据(99%正常,1%异常)建很多棵孤立树,每棵树随机切分数据统计每个点被孤立需要的刀数(孤立深度)算平均深度,得出异常分数分数低=异常,分数高=正常一句话终极总结正常点扎堆,难切分,刀数多,分数高。
2026-03-29 11:09:27
1217
原创 OpenClaw + Claude Code 组合开发软件小白教程
OpenClaw+Claude Code的核心价值,是让小白跳过「学习编程细节」,直接掌握「项目开发逻辑」——你只需要说清**「想要什么」,OpenClaw帮你拆成「该做什么」,Claude Code帮你落地「怎么做好」**。这套组合的本质是AI分层协作,而非单纯的「代码工具」,掌握后你能从「写代码的程序员」升级为「管项目的产品经理」,用AI完成原本需要专业开发团队才能做的事,这也是未来AI开发的核心趋势。
2026-03-29 10:08:58
1581
原创 石油开发全流程
8个阶段的核心逻辑的是“找油→认油→定方案→定路线→打通道→取油→输油→稳产”,每个阶段都有明确的目标和产出,案例均来自真实油田场景,小白可快速理解每个环节的作用和意义。
2026-03-28 11:10:05
853
原创 科研龙虾 Research-Claw 使用教程
科研龙虾Research-Claw是一款本地运行的AI科研助手,覆盖文献管理、论文写作等全科研流程,数据完全存储在本地。支持macOS/Linux/Windows系统,推荐使用Docker一键安装。安装后只需配置LLM API Key即可使用,无需复杂设置。核心功能包括:Zotero文献自动分类、组会材料自动生成、论文写作辅助、科研文献追踪和实验复现等。提供可视化Dashboard界面,支持自然语言对话操作,适合科研新手快速上手。所有操作均在本地完成,确保数据安全,个人学术使用完全免费。
2026-03-22 12:23:37
3173
原创 agent的核心模式
AI编程Agent的核心工作原理是一个循环执行"推理-行动-反馈"的过程。其基本流程包括:1)调用大模型进行决策;2)根据模型输出决定是否使用工具;3)执行工具并记录结果;4)将结果反馈给模型进行下一轮决策。这种模式使AI能够像人类一样,通过调用工具获取信息,经过多轮思考后给出最终答案。典型案例包括查询天气或股价,Agent会根据当前信息决定是否需要调用外部工具,并根据工具返回结果采取不同行动。这种循环机制赋予了AI动态决策和记忆能力,使其能够处理复杂多步骤任务。
2026-03-20 11:36:02
548
原创 EUR简明教程
EUR(估算最终采收量)详解:石油工程核心指标 EUR指一口井或油田从投产到报废期间可采出的总油量,是石油开发的关键指标。常规油藏时代,EUR=地质储量×采收率;现代非常规油藏(如页岩油)则需通过产量递减曲线(DCA)动态预测。核心公式为EUR=已累计产油+未来可采油量,其中未来产量需推算至经济极限产量。典型示例:常规井EUR=10万吨储量×30%采收率=3万吨;页岩油水平井通过DCA推算出EUR=1.2万吨。EUR受地质条件、工程手段(水平井长度、压裂规模)、开发方式和油价共同影响,需注意其与经济可采量的
2026-03-17 21:16:27
766
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅