自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

像风一样自由的博客

兴趣是深度学习,神经网络,python

  • 博客(425)
  • 资源 (16)
  • 收藏
  • 关注

原创 算法模型部署后_python脚本API测试指南-记录3

本文提供了多种测试API的方法,包括使用Curl命令和Python脚本。通过Curl命令,用户可以发送图像文件到API并获取预测结果。Python脚本则提供了更灵活的方式,用户可以通过命令行参数指定图像路径,并选择输出详细的JSON响应或简化的预测结果。测试时需确保API服务正在运行,并根据实际情况修改脚本中的URL和图像路径。这些方法适用于不同场景,帮助用户快速验证API的功能和性能。

2025-05-12 15:21:21 751

原创 算法模型部署(非docker版本)- 完整部署文档-ubuntu(香橙派开发板测试)学习记录2

本项目是一个基于机器学习的局部放电(PD)图像识别系统,使用支持向量机(SVM)算法实现对不同类型局放图像的自动分类。系统通过FastAPI框架提供RESTful API服务,可以接收上传的图像并返回识别结果。

2025-04-27 08:15:00 1178

原创 16.时间序列预测入门到实战(完结) 收官:怎么给你的场景选对模型

认清时序为什么难(自相关、非平稳、季节性);学会给数据体检(平稳性、分解、ACF/PACF);走完统计 → 机器学习 → 深度学习 → 大模型四个时代;更重要的是,养成了两个贯穿始终的习惯先建基准线用真实数字说话。模型会不断更新换代,但这两个习惯不会过时。愿你面对任何时序问题时,都能不慌不忙地问一句:“我的基线是多少?这个复杂度,值吗?这个系列到此完结。如果这 16 篇对你有帮助,欢迎把它分享给同样在和时间序列较劲的朋友。《时间序列预测入门到实战》全 16 篇完结。

2026-07-22 00:15:00 299

原创 15.时间序列预测入门到实战: 时序基础大模型:TimesFM / Chronos / Moirai

本文介绍了时间序列预测领域的新范式——时序基础大模型(Time-series Foundation Model),它打破了传统"一数据一模型"的模式,通过海量预训练实现对任意新序列的zero-shot预测。文章重点分析了TimesFM、Chronos、Moirai等代表性模型,其中Chronos创新性地将时序数值离散化为token,像训练语言模型一样处理时序数据。虽然这种大模型在冷启动、异构数据处理方面优势明显,但作者也理性指出其在特定数据集精度、计算成本和长序列处理等方面的局限,建议将其作为工具箱的补充而

2026-07-21 00:15:00 336

原创 14.时间序列预测入门到实战: 面向真实业务:Temporal Fusion Transformer

本文介绍了谷歌2019年提出的Temporal Fusion Transformer(TFT)时间序列预测模型。TFT针对实际业务需求设计,具有三大特色:1)区分处理静态协变量、已知未来信息和历史观测三类输入,特别擅长利用已知未来信息(如促销计划);2)内置变量选择网络实现自动特征筛选并提供可解释性;3)结合LSTM处理局部模式与注意力机制捕捉长期依赖,通过分位数回归输出预测区间。该模型适用于多变量、信息丰富的业务场景(如零售需求预测),但结构复杂、训练成本高。TFT平衡了精度与业务实用性,是面向真实业务场

2026-07-20 00:30:00 270

原创 13.时间序列预测入门到实战: 概率预测:DeepAR 与 N-BEATS / N-HiTS

本文是「码海寻道」《时间序列预测入门到实战》系列的第 13 篇。的精度——预测出一个数,越准越好。但真实业务里,一个光秃秃的数往往不够用。(DeepAR,给出一个分布而非一个点),以及(N-BEATS / N-HiTS,证明不用注意力也能 SOTA,还自带可解释)。

2026-07-20 00:15:00 399

原创 13.时间序列预测入门到实战: 概率预测:DeepAR 与 N-BEATS / N-HiTS

本文介绍了时间序列预测中的概率预测方法及两种高效模型。首先分析了点预测的局限性,指出实际业务往往需要概率预测(如DeepAR)来提供不确定性区间。DeepAR通过RNN输出分布参数,采用最大化似然训练,通过采样生成多条预测轨迹,适用于零售等海量相似序列场景。其次介绍了纯MLP架构的N-BEATS及其改进版N-HiTS:N-BEATS通过双重残差堆叠实现可解释的趋势/季节分解;N-HiTS采用多率采样和分层插值,在长序列预测中兼顾效率与精度。文章提供了neuralforecast库的实践代码,并建议根据需求选

2026-07-19 17:29:48 326

原创 12.时间序列预测入门到实战: 反思:DLinear / PatchTST / iTransformer

本文回顾了时间序列预测领域2022-2024年的"反思三部曲":DLinear、PatchTST和iTransformer。DLinear以简单的分解+单层线性结构击败复杂Transformer,引发对模型复杂度的反思;PatchTST通过分块处理和通道独立改进Transformer的数据表示方式,重新取得优势;iTransformer则创新性地将变量作为token,在建模变量关系上更进一步。这系列研究揭示了时序预测的核心启示:简单基线优先、数据表示比模型复杂度更重要、需先理解数据结构。文章建议实践中从DL

2026-07-18 00:15:00 308

原创 11.时间序列预测入门到实战:时序专用 Transformer:Informer / Autoformer

本文介绍了针对长序列时间预测(LSTF)问题改进的两种Transformer模型:Informer和Autoformer。Informer通过ProbSparse注意力机制筛选重要Query,将复杂度降至O(L·log L),并结合自注意力蒸馏和生成式解码解决原版Transformer的三大痛点。Autoformer则内置时序分解模块,利用自相关机制基于周期特征聚合数据,同样达到O(L·log L)复杂度。文章指出这些复杂模型曾主导LSTF领域,但预告了一个反转:简单线性模型DLinear将在下篇中展示对这

2026-07-17 00:30:00 350

原创 GPU 选型指南(2026 升级版):从 H100/H200/B200 到 H20/L20/RTX PRO 6000D,一篇讲透你能买到的每一张卡

GPU选型指南(2026升级版)摘要 本文是面向AI工程师和技术决策者的2026年GPU选型指南,重点针对国内实际采购环境。核心内容包括: 新增"中国特供卡"分析:详解H20/L20等国内合规卡的性能特点,特别是H20作为推理神卡的技术逻辑(高带宽低算力的设计原理) 完整NVIDIA产品线覆盖:从数据中心卡(H100/H200/B200)到工作站卡(RTX PRO 6000系列),特别推荐96GB显存的Blackwell架构工作站卡 关键选型维度:在传统5个维度(算力/显存/互联/功耗/价格)基础上,新增"

2026-07-16 00:15:00 447

原创 10.时间序列预测入门到实战: Transformer 登场:注意力与时序

本文介绍了Transformer在时间序列预测中的应用及其局限性。主要内容包括: 注意力机制的原理和优势:通过Query/Key/Value机制,让模型动态决定关注序列中的哪些部分,解决了RNN和CNN的固定模式问题。 位置编码的必要性:由于注意力机制本身不具备顺序感知能力,需要通过位置编码引入时间顺序信息。 原版Transformer在时序预测中的三个主要问题:计算复杂度高(O(L²))、逐点注意力难以捕捉局部模式、需要大量数据且容易过拟合。 后续研究方向:改进注意力效率(如Informer)和重新思考T

2026-07-15 00:15:00 329

原创 9.时间序列预测入门到实战:卷积视角:从 TCN 到 TimesNet

本文介绍了两种基于卷积的时间序列预测方法:TCN和TimesNet。TCN采用一维因果卷积和膨胀卷积处理序列,具有并行计算快、感受野大的特点;而TimesNet创新性地将一维序列按周期折叠成二维矩阵,用2D卷积同时捕捉周期内和周期间模式,在多个任务上表现优异但计算成本较高。文章对比了两者的适用场景,建议优先尝试TCN这类轻量基线。最后指出时序预测领域存在"复杂度不等于效果"的现象,为下一篇讲解Transformer埋下伏笔。

2026-07-14 00:15:00 651

原创 8.时间序列预测入门到实战:RNN / LSTM / GRU:让网络记住过去

过一个全连接层,输出下一个值。

2026-07-13 00:15:00 477

原创 我把个人主页又改了一遍

科技感不是把页面变黑,也不是堆满粒子、光效和数字,而是让视觉语言与内容本身发生联系。“码海寻道”关注 AI 工程、信号分析、时间序列和部署交付,所以我选择了数据网格、扫描光、GIS 预览和克制的空间反馈。它们服务于主页的内容定位,而不是单纯为了展示前端技巧。如果你也在打造个人主页,可以先问自己两个问题:你希望别人记住什么?哪一种动态方式最能表达你的内容?答案通常不在特效库里,而在你的作品本身。—— 码海寻道。

2026-07-11 18:27:47 314

原创 7.时间序列预测入门到实战:Prophet:让业务同学也能上手

还记得第 2 篇的时序分解吗?。Prophet 干脆把这个分解直接做成了一个可拟合、可预测的模型:关键区别在于:ARIMA 是自回归视角(今天由过去决定),而 Prophet 是曲线拟合视角(把 y 看成时间 t 的函数,去拟合这条曲线)。这个视角的转变,正是它易用的根源——它不要求平稳、不用差分、对缺失和异常都不敏感。趋势 g(t):分段线性(或逻辑增长),会自动检测变点(changepoint)——增长速率突然变化的位置,模型自己找出来并在那里"拐弯"。季节 s(t):用傅里叶级数拟合,能同时叠加日、周

2026-07-10 08:44:21 310

原创 6.时间序列预测入门到实战:树模型打天下:LightGBM 做预测

本文介绍了使用LightGBM进行时间序列预测的关键要点: LightGBM优势:适合表格数据,能自动捕捉特征交互,对数据预处理要求低,训练速度快且可解释性强。 梯度提升原理:通过多棵树串行纠错,每棵树拟合前一棵树的残差,逐步逼近真实值。 核心注意事项: 树模型无法外推趋势,需先差分/去趋势处理 多步预测三种策略(递归/直接/多输出)的优缺点 全局模型可同时学习多条序列,实现规模化预测 实践建议: 特征重要性分析验证特征工程 在复杂特征场景下通常优于传统统计方法 需注意不同序列规律冲突时的处理方法 文章为树

2026-07-10 00:15:00 379

原创 5.时间序列预测入门到实战:把时序变成监督学习:特征工程

本文是「码海寻道」《时间序列预测入门到实战》系列的第 5 篇,也是全系列的。前四篇的统计方法有个共同天花板:每条序列单独拟合、很难吃进外部特征。这一篇我们做一次——把"预测未来"改写成一个普通的问题。一旦转换成功,XGBoost、LightGBM 乃至整个机器学习军火库,就全都能用了。

2026-07-08 08:56:26 446

原创 4.时间序列预测入门到实战:指数平滑:被低估的实战利器

本文介绍了时间序列预测中的指数平滑方法,从简单指数平滑(SES)到Holt线性趋势法,再到Holt-Winters季节模型,最后到统一的ETS框架。指数平滑通过给历史数据赋予指数衰减的权重进行预测,具有参数少、计算快的特点,尤其适合大规模自动化预测场景。文章比较了指数平滑与ARIMA的适用场景,指出指数平滑在强趋势/季节数据上表现优异,是工业界长期青睐的实用工具。文末预告下一主题是将时序问题转化为监督学习问题,引入机器学习方法。

2026-07-08 00:15:00 307

原创 3.时间序列预测入门到实战(三)· 从 AR 到 ARIMA:统计预测的基石

摘要 本文是时间序列预测系列第三篇,重点介绍ARIMA模型及其在ETTh1油温数据集上的实战应用。主要内容包括: ARIMA组成:分解为AR(自回归)、MA(移动平均)和差分(I)三个核心组件,分别对应参数p、q、d。 参数确定: d通过平稳性检验确定为1(需一次差分) p和q通过AIC网格搜索自动选择(最优为4,1,1) 实战结果: 滚动预测评估显示ARIMA(4,1,1) MAE=1.534,优于Naive基准线1.670(提升约8%) 单次拟合仅需0.25秒,高效但领先幅度有限 模型验证:通过Ljun

2026-07-07 00:15:00 378

原创 2.时间序列预测入门到实战(二)· 数据的脾气:平稳性、季节性与分解

本文介绍了时间序列预测中数据预处理的核心方法,重点围绕平稳性检验、季节性分解和自相关分析三部分展开。首先,作者通过ADF检验和KPSS检验判断序列平稳性,并演示了差分和对数变换等平稳化处理技巧。其次,详细讲解了STL分解方法,将序列拆分为趋势、季节性和残差三个分量,并说明其在去季节化和异常检测中的应用。最后,阐述了如何通过ACF和PACF图分析自相关特性,为ARIMA模型定阶提供依据。文章强调这些预处理步骤是时间序列建模的基础,直接影响后续模型的预测效果。

2026-07-06 00:15:00 525

原创 01-开篇-时间序列预测到底难在哪

本文是《时间序列预测入门到实战》系列的首篇,重点剖析时间序列预测的独特挑战。与普通监督学习不同,时序数据具有自相关性、非平稳性和季节性三大特征:自相关导致误差累积,非平稳性使统计特性随时间变化,多种周期叠加增加分析难度。文章通过电力变压器温度数据集(ETT)的实例展示了这些特性,并强调时序预测必须按时间顺序切分数据集,避免数据泄露。此外,文章还明确了时序任务的三个关键维度(单步/多步、单变量/多变量、点/概率预测),并建立了贯穿全系列的评估框架,为后续模型比较奠定基础。

2026-07-05 01:45:00 325

原创 01-开篇-时间序列预测到底难在哪

时间序列预测的三大挑战与实战框架 本文是时间序列预测系列的开篇,重点剖析时序预测的核心难点并建立统一的评估框架。时序预测与普通回归的关键区别在于:数据存在时间依赖性,要求严格按时间顺序划分数据集,否则会导致数据泄露。时序预测面临三大核心挑战:(1)时间依赖性导致误差累积;(2)非平稳性使统计特性随时间变化;(3)多周期季节性使信号复杂纠缠。文章选用ETT电力变压器温度数据集作为基准,强调必须按时间顺序切分训练、验证和测试集(6:2:2比例)。后续系列将在此统一框架下对比16种预测方法,涵盖统计模型、机器学习

2026-07-05 00:15:00 545

原创 Ponytail:懒人开发者的代码简化工具和方法论

Ponytail 的核心不是鼓励你偷懒,而是教你聪明地工作在动手前思考:阶梯方法论是一个思维框架,确保你每次决策都经过验证删除比添加值钱:代码库的复杂度来自累积,最大的收益来自清理工具辅助决策:用和自动化检查灵活切换强度:根据场景和心态选择 Lite/Full/Ultra持续学习:每次简化都是一次学习,记录下来的模式会变成直觉一个 Ponytail 的开发者不是写最少代码的人,而是用最高效的方式交付最对的解决方案的人。如果你累得像狗一样在维护一个充满黑魔法的代码库,那不是努力,那是惩罚。

2026-07-02 00:15:00 199

原创 35.大模型安全:越狱、提示注入与防御 · 系列收官

摘要 《大模型安全:越狱、提示注入与防御》是大模型工程化系列的第35篇收官之作,聚焦AI安全这一关键但常被忽视的领域。文章系统剖析了大模型的五大安全威胁:越狱攻击、提示注入、数据泄漏、Agent滥用和模型窃取,其中提示注入被OWASP列为LLM应用头号风险。 在防御策略方面,作者提出三层防护体系:模型层(RLHF、宪法AI等训练技术)、系统层(输入输出过滤、多模型投票)和应用层(权限隔离、人工审核)。特别强调Agent时代的权限管控必须遵循"最小权限原则",高风险操作需人工确认。 文章指出,大模型安全本质是

2026-07-01 00:15:00 457

原创 34.开源 vs 闭源:Llama / Qwen / DeepSeek 生态博弈

系列前 33 篇我们讲的都是技术——架构、训练、部署、应用。这一篇换个视角,聊产业开源大模型 vs 闭源大模型,谁会赢?这个问题没有标准答案,但 2026 年的格局已经比 2023 年清晰得多。2022.11 ChatGPT ── 闭源开局2023.02 LLaMA-1 ── 开源被迫加入2023.07 Llama 2 ── 商用开源2024.03 Claude 3 / GPT-4 Turbo ── 闭源 SOTA2024.04 Llama 3 ── 开源追上 GPT-3.5。

2026-06-30 00:30:00 406

原创 33.端侧大模型:Phi、Gemma 与小模型逆袭

文章摘要 本文探讨了端侧大模型在2026年的发展趋势与应用前景。文章指出,2025-2026年是端侧LLM从实验走向产品的关键转折点,主要受三个因素驱动:小模型性能突破(如Phi-4-mini 3.8B接近Llama-2-70B)、推理蒸馏技术进步(R1-Distill-1.5B)和硬件升级(iPhone 17 Pro等设备的NPU算力提升)。作者分析了五大主流端侧模型系列(Phi、Gemma、Qwen等)的性能特点,并提供了跨平台部署方案(iOS/Android/Mac/Windows/浏览器)。文章强调

2026-06-29 01:30:00 394

原创 32.推理模型原理:o1 / R1 的 Test-Time Scaling 新范式

如果说 2017-2023 大模型的关键词是(参数和数据越多越好),那 2024-2026 就出现了一个全新关键词——Test-Time Scaling(推理时扩展)。这是和 MoE 并列的,过去三年大模型最重要的两大架构创新。让模型在回答前,先「思考很久」。简单一句话背后,是 OpenAI o1(2024.09)、DeepSeek R1(2025.01)、Claude 4 Thinking、Gemini 2.5、Qwen3 Thinking 等一系列"推理模型"的崛起。

2026-06-28 01:15:00 450

原创 31.MoE 架构深度解析:DeepSeek、Mixtral 背后的稀疏化魔法

文章摘要 本文深度解析MoE(混合专家)架构,揭示其在DeepSeek、Mixtral等模型中的关键作用。MoE通过稀疏激活机制实现高效计算:将FFN层拆分为多个专家,每个token仅激活部分专家(如DeepSeek V3激活9/256专家),从而以37B激活参数实现671B模型容量。相比Dense模型,MoE在训练/推理算力节省方面优势显著,但显存需求更高且复杂度提升。文章详细解析了路由机制、负载均衡方案(含DeepSeek创新的无辅助损失方法),并对比了不同MoE实现(Mixtral 8x7B专家粒度较

2026-06-27 00:15:00 463

原创 Prompt 工程方法论:从「玄学」到工程化

本文探讨了Prompt工程从"玄学"到工程化的演进历程,系统总结了Prompt设计的核心方法论。文章首先指出Prompt工程的重要性:同样的模型,优质Prompt可使准确率提升30-50%,显著影响成本和应用迭代效率。随后梳理了Prompt技术的五个发展阶段(从zero-shot到thinking模型),并预测2026年后Prompt将更加工程化和自动化。 核心内容包含两大部分: 设计原则:提出5大基础原则(角色明确、结构化输入、格式规范、正向引导、示例优先)和6大进阶技巧(思维链、自洽性、思维树、推理行动

2026-06-26 00:15:00 336

原创 29.多模态部署:VLM、语音、视频理解

多模态AI部署实践指南 本文系统介绍多模态AI(视觉、语音、视频)的部署技术要点,适合AI工程师和应用架构师。主要内容包括: 多模态应用版图:覆盖图文理解/生成、语音对话、视频理解等场景,分析GPT-4o、Claude、Gemini等模型的演进趋势。 核心挑战:输入预处理重、Token爆炸、显存压力、框架支持不均衡和延迟控制等工程难题。 视觉语言模型(VLM)部署: 详解ViT+Projector+LLM架构 主流VLM横评(Qwen3-VL、InternVL3等) 视觉Token消耗管理(单图可达4000

2026-06-25 00:15:00 415

原创 28.Agent 框架对比:LangChain / LlamaIndex / AutoGen / CrewAI

上一篇我们讲了 Tool Use——让 LLM 能「调工具」。让 LLM 自主完成多步任务——也就是Agent。2025-2026 业界普遍把这两年称为「Agent 元年」。Claude 4 / GPT-5 / o3 推理能力突破→ 多步规划可靠Tool Use 标准化(MCP)→ 工具生态成熟Cursor / Devin / Manus 等爆款→ 验证商业价值→ 突破纯文字交互但 Agent 应用的工程化复杂度极高。这就是 Agent 框架存在的意义——把"让 LLM 完成任务"这件事工程化。

2026-06-24 00:30:00 967

原创 警惕 Codex logs_2.sqlite 高频写盘:可能快速消耗 SSD 写入寿命

Codex 诊断日志高频写入 SSD 问题及解决方案 摘要:Codex 客户端存在一个严重问题,其诊断日志会持续高频写入本地 SQLite 数据库(logs_2.sqlite及相关文件),导致SSD写入量异常增大。有用户报告21天内产生约37TB写入,年化可达640TB,接近消费级SSD的寿命极限。该问题主要影响诊断日志而非用户对话历史。 解决方案: 检查是否受影响:查看日志文件大小及内容,确认TRACE级别日志占比 临时解决方案:通过创建SQLite触发器拦截新日志写入 提供Windows和Linux/m

2026-06-23 21:44:35 1823 1

原创 27.Function Calling 与 Tool Use:让大模型「动」起来

本文介绍了大模型的工具调用(Function Calling/Tool Use)能力,这是让大模型从"回答"到"行动"的关键技术。文章分为四个部分: Tool Use的重要性:它是AI Agent的核心能力,使大模型能查询、执行、计算和操作GUI,推动AI应用从问答到自主完成任务。 主流协议详解:重点解析OpenAI(JSON Schema+多轮调用)和Anthropic(混合内容块)的差异,包括工具定义、调用流程和并行调用实现。 模型能力对比:实测显示Claude Opus在多工具调用准确率领先(97%)

2026-06-23 00:15:00 386

原创 26.RAG 实战:从向量数据库到 GraphRAG

本文摘要(148字): 《大模型知识与部署》系列第26篇探讨RAG技术,作为大模型应用最普遍的形态(占比60%)。文章系统讲解RAG完整流程:从文档解析、切片策略、向量检索到生成优化,对比不同技术方案优劣。重点剖析文档处理的核心挑战(如PDF多栏布局解析),推荐层级切片等实用策略,并展望GraphRAG等进阶方向。通过技术栈对比和代码示例,帮助开发者构建召回率90%+的高效RAG系统,解决大模型知识时效性、私有化等关键问题。

2026-06-22 00:30:00 297

原创 25.TCO 成本测算:训练与推理的完整成本模型

文章摘要 本文深入探讨了大模型训练与推理的TCO(总拥有成本)计算模型,揭示实际成本常被低估3-5倍的行业现状。训练成本方面,以DeepSeek V3为例,分析其557万美元的"狭义训练成本"背后隐藏着50-100M+美元的完整TCO,并提供70B模型训练成本计算公式。推理成本部分,对比自部署与主流API价格,指出自部署Llama-3-70B成本仅16.3元/百万token,比Claude/GPT便宜10-30倍但比国产API贵2倍。最后提出关键决策模型:当月API账单超过自建TCO(如Claude Son

2026-06-21 02:15:00 844

原创 24.显存优化实战:从 OOM 到丝滑运行

第 3 篇我们讲过参数量与显存的关系第 11 篇讲了 KV Cache 显存膨胀第 12 篇讲了量化能省一半到 3/4 显存第 13 篇讲了 Flash Attention 把 attention 显存从 O(n²) 降到 O(n)第 15 篇讲了长上下文场景的显存优化第 20 篇讲了 TP 怎么把模型切到多卡但每一篇都是从自己的角度讲。这一篇我们做一次完整整合——把显存优化做成一个可操作的playbook。精确算出训练 / 推理任务的显存占用在不同硬件条件下设计最优显存方案。

2026-06-20 00:15:00 723

原创 23.模型权重管理:Safetensors 与私有化 Hub

几百 GB 的模型权重,怎么管理?这听起来像个"小事",但只要做大模型部署的人都知道,权重管理是个真坑。模型权重 140 GB,从 HuggingFace 下载要 8 小时,每次部署都重下太崩溃微调出了 50 个 LoRA,全堆在某台机器上,谁也不知道哪个是哪个推理服务想升级模型版本,发现没法平滑滚动——所有节点都要重新拉权重内网部署不能上 HuggingFace,怎么搭一个私有化的「HF Hub」?

2026-06-19 00:15:00 388

原创 22.集群运维:监控、调度、容灾全攻略

本文摘要: 《GPU集群运维全攻略》深入探讨了AI计算集群的监控、调度、容灾和告警四大核心运维环节。针对GPU集群与传统Web集群的三大差异(高故障率、长时任务、资源粒度特殊),文章提供了实用解决方案: 构建三层监控体系(业务/GPU/节点层),推荐Prometheus+DCGM+Grafana技术栈,详解关键指标配置与告警规则 对比K8s/Slurm/Ray三大调度方案,分析GPU共享与切分策略 训练容错设计(自动恢复checkpoint)和推理高可用方案 建立分级告警机制与应急响应流程 包含具体部署示例

2026-06-18 00:15:00 342

原创 21.GPU 选型指南:A100 / H100 / 4090 / 910B 性价比分析

文章摘要 本文是《大模型知识与部署》系列第21篇,聚焦AI硬件选型中的GPU选择策略。作者指出GPU采购占大模型团队70-90%的成本,错误决策可能导致百万级损失。文章系统分析了主流GPU(A100/H100/H200/B200/4090/910B等)在算力、显存、互联、功耗和价格五个维度的关键参数,并给出典型选型场景建议:H100当前性价比最优,H200适合长上下文推理,B200面向未来训练,4090仅限个人开发。针对国产GPU,详细评估了华为昇腾910B/910C等产品的实际可用性和生态适配情况。最后提

2026-06-17 00:15:00 739

原创 20.分布式推理:TP / PP / EP / CP 并行策略详解

本文详细介绍了大模型分布式推理中的五种并行策略:数据并行(DP)、张量并行(TP)、流水并行(PP)、专家并行(EP)和上下文并行(CP)。重点分析了各策略的核心思想、适用场景及通信开销: DP适合小模型高并发场景,但无法解决大模型显存问题 TP通过算子切分实现层内并行,需NVLink级高速互联 PP采用层间切分,适合跨机部署,但存在计算气泡 EP专为MoE模型设计,通过专家分布解决稀疏计算 CP针对长上下文场景切分KV Cache 文章提供了混合并行配置指南,建议TP≤8(单机)、PP用于跨机、EP适配M

2026-06-16 00:15:00 411

电力领域gis局部放电的PRPD图谱详解

内容概要:本文围绕局部放电(PD)监测中的PRPD图谱展开,详细介绍了PRPD图的生成原理及其在局放检测中的关键作用,强调良好的相位同步对数据质量的重要性。通过对比不同同步效果的图谱,说明高质量数据对准确识别局放信号的意义,并结合实际案例解析了内部空隙型放电源的诊断方法。同时,文章推荐了多篇关于GIS设备中PRPD/PRPS图谱原理与应用的技术博客,辅助深入理解分析算法的选择与应用。最后展示了GIS局放在线监测系统的前端Demo,涵盖实时数据、谱图展示、告警机制和诊断分析等功能,可作为中高端产品原型参考。; 适合人群:电力系统相关技术人员、从事高压设备状态监测的研发人员或工程师,具备一定电气知识和数据分析基础者更佳; 使用场景及目标:①用于理解PRPD/PRPS图谱的形成机制及其在GIS局部放电监测中的应用;②指导如何通过图谱进行局放类型识别与故障诊断;③为开发局放监测系统提供前端界面设计与功能实现参考; 阅读建议:建议结合文中提供的CSDN博客资源深入学习算法细节,并通过Demo系统实践图谱展示与分析流程,注重理论与实际工程应用的结合。

2025-09-12

svm-project-适用x86-64架构的dockerfile文件与完整镜像文件.7z

适用linux/amd64(x86_64)架构的机器上运行 Docker 容器,,而不是使用树莓派开发板 ARM64 架构的完整镜像。 文件,包含了完整的 Docker 镜像。可直接部署到其他系统上进行测试。注意适用的是x86_64架构上的不同系统。

2024-09-13

svm-fastapi-app.tar 一个名为 svm-fastapi-app.tar 的文件,包含了完整的 Docker

导出 Docker 镜像为 .tar 文件: 使用 docker save 命令将 Docker 镜像导出为一个 .tar 文件: docker save -o svm_fastapi_app.tar svm_fastapi_app 这会在当前目录下创建一个名为 svm_fastapi_app.tar 的文件,包含了完整的 Docker 镜像。 可直接部署到其他系统上进行测试。

2024-09-12

9-11-docker-svm-fastapi.zip

在树莓派5开发板-Ubuntu系统上安装docker容器测试项目 打包项目文件: 创建一个新文件夹(例如 svm_project),将所有项目文件放入其中,包括: main.py(主代码文件) templates 文件夹(包含 HTML 模板文件,如 index.html 和 result.html) static 文件夹(包含静态文件,如 CSS、JavaScript、上传目录等) 任何其他模型文件(例如 svm_model_noise.pkl、svm_scaler_noise.pkl、svm_pca_noise.pkl)

2024-09-12

LabelImg是目标检测数据标注工具,可以标注两种格式: VOC标签格式和YOLO标签格式

LabelImg是目标检测数据标注工具,可以标注两种格式: VOC标签格式,标注的标签存储在xml文件 YOLO标签格式,标注的标签存储在txt文件中

2024-06-26

车辆检测的视频,视频来自YouTube,Los Angeles Freeway I-101 HD 30fps traffic

2021年10月16日下午6:55,用iPhone SE 2在历史悠久的菲律宾小镇(加利福尼亚州洛杉矶)的贝尔蒙特大道上录制。 周六晚上,汽车在101路上缓慢行驶,没有人声。

2024-06-20

基于OpencvDNN和ONNXRuntime部署YOLOv7(源码+训练模型+说明文档+数据)包含C++和Python两个版本

1、包含C++和Python两个版本的程序 2、代码特点:参数化编程、参数可方便更改、代码编程思路清晰、注释明细。 3、适用对象:计算机,电子信息工程、数学等专业的大学生课程设计和毕业设计。

2024-06-14

高光谱数据集(.mat.csv)-科研学术

高光谱数据集包含后缀为(.csv.mat格式),主要先将.mat转成.csv,145x145x220,csv数据,每行代表一个数据,每行前220列是特征,最后1列是标签值,共17类

2024-05-29

movie-score-info.csv

这个movie_score_info文件是B站的一位昵称为“末末凉凉”的美女小姐姐做电影推荐系统所缺少的一个文件,文件字段为movieId,score,times,需要的话请自行下载

2020-05-15

卷积神经网络-源代码.rar

这是我的博客文章:基于深度学习的CIFAR10图像分类 的源代码。 本文实验基于Windows10系统,仿真软件用的是Anaconda下基于python编程的JupyterNotebook编辑器。通过利用Google的深度学习框架Tensorflow,搭建新的卷积网络结构,提出了基于卷积神经网络的CIFAR10图像分类识别算法,主要参照经典的卷积神经网络模型LeNet-5结构,提出新的卷积神经网络结构并对飞机、汽车、鸟类、猫、鹿、狗、蛙类、马、船和卡车10种事物进行分类,该模型构建了一个输入层、三个卷积层、三个池化层、一个全连接层和一个输出层。

2020-11-28

源码工程文件-libmodbus-test

源码工程文件-libmodbus-test

2024-05-15

libmodbus-3.1.4-源码与已编译好的

适用于Qt的libmodbus版本3.1.4源码与已编译好的

2024-05-15

Qt-libmodus

Qt-libmodus

2024-05-14

pip-script.zip

把这个压缩包解压后,放在anaconda安装路径的Scripts文件下, 然后打开cmd窗口,先pip install --upgrade pip 之后就可以像平时那样安装库了

2020-06-01

最新Landmark人脸68个关键点检测dat模型库-数据亲测真实可用.zip

dat文件,具体名称为shape_predictor_68_face_landmarks.dat 人脸68个关键点:嘴巴,鼻子,眼睛,眉毛,轮廓等 Landmark人脸68个关键点检测dat模型库

2020-04-07

Pillow-7.0.0-cp37-cp37m-win_适用于windows64和32位操作系统

适用于windows64位操作系统,下载后直接pip install Pillow-5.4.1-cp37-cp37m-win_amd64.whl 即可安装(注意文件路径要对).文件中也有Windows32位的whl

2020-04-07

波士顿房价预测 数据集data.rar

人工智能,机器学习最好的案例,数据集真实有效 波士顿房价预测 数据集 多元线性回归模型-最好的数据集

2019-10-20

ml-latest.zip

MovieLens最新数据集-完整版 完整版:280,000名用户将27,000,000个评级和1,100,000个标签应用程序应用于58,000部电影。包括在1,100个标签中具有1400万相关分数的标签基因组数据。上次更新时间9/2018。

2020-05-06

python-遗传算法求四元函数极值.zip

这个代码是在三元函数求极值上的代码上改写的,如果你看了我遗传算法求三元函数的代码,你就不用下了,代码大部分不变,改的不多,你基本自己就能改出来了。

2020-06-13

yolov5m.pt与yolo5s.pt预训练模型.zip

yoloV5预训练模型,官方给的是谷歌网盘下载地址,下载速度较慢,压缩包包含yolov5m.pt,yolov5s.pt

2021-08-12

cifar10数据集.rar

CIFAR-10(Canadian Institute for Advanced Research,CIFAR)是一个用于识别普适物体的小型数据集。由Hinton 的学生Alex Krizhevsky 和Ilya Sutskever 整理的一个用于识别普适物体的小型数据集。一共包含10个类别的RGB 彩色图片:飞机(airplane)、汽车(automobile)、鸟类(bird)、猫(cat)、鹿(deer)、狗(dog)、蛙类(frog)、马(horse)、船(ship)和卡车(truck)。

2020-05-05

GAN-fashion-mnist.zip

代码是实现利用GAN生成fashion-mnist图像 用TensorFlow深度学习框架 需要按照anaconda,jupyter

2020-11-29

python遗传算法旅行商代码.zip

这是完整代码,包括csv城市文件,python语言实现,是在别人的代码基础上改的,具体参考网址,在《遗传算法解决旅行商问题-Python》讲得很清楚。想知道更详细的朋友,请去看吧。

2020-06-22

遗传算法实现TSP的完整代码.zip

程序会动态的展示迭代过程,40以内城市大概迭代500次能收敛到最优; 这里是用中国城市地理坐标直接做欧式距离计算,实际上可以根据问题作出调整。

2020-05-05

opencv_python-3.4.7.28-cp37-cp37m-win_amd64.whl

机器学习-计算机视觉的库 opencv_python-3.4.7.28-cp37-cp37m-win_amd64.whl

2020-04-26

冠状病毒确诊数据.zip

国内各个省份冠状确诊数据,时间从2020-1月30日到2020-3月24日, 文件格式是CSV,具体字段为cityName,confirmedCount,suspectedCount,curedCount,deadCount,provinceName

2020-04-07

手写体识别数据集-mnist.rar

MNIST 数据集来自美国国家标准与技术研究所,National Institute of Standards and Technology(NIST). 数据集由来自250个不同人手写的数字构成,其中50%是高中学生,50%来自人口普查局(the Census Bureau)的工作人员 此数据集中,训练样本:共60000个,其中55000个用于训练,另外5000个用于验证 测试样本:共10000个 3、数据集中像素值 a)使用python读取二进制文件方法读取mnist数据集,则读进来的图像像素值为0-255之间;标签是0-9的数值。 b)采用TensorFlow的封装的函数读取mnist,则读进来的图像像素值为0-1之间;标签是0-1值组成的大小为1*10的行向量。

2020-05-07

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除