自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

博客

所有专栏都包含核心代码和详细步骤教程,助力您快速解决问题,欢迎订阅专栏。

  • 博客(1471)
  • 收藏
  • 关注

原创 基于Python的自动化测试框架设计与实现

本文深入探讨了如何使用Python搭建一个高效、可扩展的自动化测试框架。基础环境搭建:首先,安装了必要的库(如seleniumunittest和pytest),并配置了WebDriver,成功实现了基础的Web自动化测试。编写基本的测试用例:使用unittest编写了基础的单元测试,并引入了selenium进行网页自动化测试,演示了如何进行登录验证等操作。高级功能实现数据驱动测试:使用让同一个测试用例支持多组不同数据,提高测试效率。页面对象模型(POM)

2025-01-25 03:51:52 1010 3

原创 机器学习入门利用Python构建预测模型以实现房价预测

该模型的核心是建立一个多目标优化模型,通过平衡经济、环境和社会因素来实现可持续旅游。变量定义:明确影响旅游业的关键变量。目标函数:设定优化目标。约束条件:定义可行解空间。政策影响:引入不同的税收和政策对模型的反馈影响。敏感性分析:分析关键参数对模型输出的影响。VVV:每日游客数量(人)。RRR:每日旅游收入(美元)。EEE:每日碳排放量(吨)。CCC:每日基础设施维护成本(美元)。SSS:居民满意度(1-10 分)。

2025-01-25 03:48:49 1023 1

原创 【问题解决】Python 调用通义千问 / DeepSeek 报错:参数非法、返回空、格式解析失败

通过本文的方案,你可以彻底解决通义千问/DeepSeek API调用的各种问题,包括参数非法、返回空、格式解析失败等。记住,完善的参数验证和错误处理是保证API稳定调用的关键。

2025-01-10 02:22:38 710

原创 【问题解决】Hugging Face 模型下载失败、断连、缺少权重文件,本地手动加载修复

通过本文的方案,你可以彻底解决Hugging Face模型下载的各种问题,包括下载失败、断连、缺少权重文件等。记住,使用镜像和断点续传是提高下载成功率的关键。

2024-11-21 16:55:55 2138

原创 【问题解决】大模型 API 调用报错 429 请求超限、key 无效、跨域,通用兜底方案

通过本文的方案,你可以彻底解决大模型API调用的各种问题,包括429请求超限、key无效、跨域等。记住,合理的速率限制和重试机制是保证API稳定调用的关键。

2024-11-21 16:46:44 1343

原创 利用MATLAB进行高效图像处理-从图像增强到计算机视觉

图像处理是计算机科学和工程中一个重要的领域,广泛应用于医疗、工业、安防等多个行业。MATLAB作为一种强大的数学软件,提供了丰富的工具箱和函数,方便进行图像处理。本篇文章将介绍MATLAB图像处理的基础技术,并结合代码实例进行详细解析。

2024-11-21 16:30:56 796

原创 【问题解决】本地部署大模型报错:CUDA out of memory,低显存加载 4/8bit 量化方案

通过本文的方案,你可以彻底解决本地部署大模型的显存问题,包括CUDA out of memory、低显存加载、量化等。记住,量化是减少显存占用的最有效方法。

2024-11-21 16:07:59 637

原创 【问题解决】解决 Python `json.decoder.JSONDecodeError`,JSON 解析失败全场景处理

Python是一种高级编程语言,具有易读性和简单性。它被广泛用于数据分析、机器学习和科学计算等领域。通过其丰富的库和框架,Python为数据科学家提供了强大的工具集。在本节中,我们将通过一个实际案例,结合前面的知识,展示如何从头到尾完成数据分析流程。假设我们有一个关于电影评分的数据集,我们将对其进行分析,以了解影响电影评分的因素。在本文中,我们探讨了Python数据科学的基础知识和实用工具,帮助初学者掌握数据科学的核心概念与技能。Python基础知识。

2024-11-21 15:21:28 874

原创 【问题解决】Python 端口被占用 [Err 98/10048],Windows/Linux 一键杀死进程

通过本文的方案,你可以彻底解决Python端口占用的各种问题,包括Windows和Linux平台。记住,正确的进程管理和端口清理是系统稳定运行的关键。

2024-11-21 15:12:53 994

原创 Python 机器学习:Scikit-learn 核心算法实战【高级python篇】

本文介绍了Python机器学习库Scikit-learn的核心算法和实战应用。主要内容包括:1)监督学习(线性回归)和无监督学习(K均值聚类)的演示;2)分类算法(随机森林)和回归算法(梯度提升回归)的实现;3)机器学习全流程(数据收集到部署)和特征工程方法(标准化、编码、特征选择);4)模型评估指标(混淆矩阵、ROC曲线)和优化技术(网格搜索、交叉验证);5)模型持久化方法。通过代码示例展示了Scikit-learn的核心功能,帮助读者掌握机器学习的关键技术。

2024-09-05 20:38:48 1632

原创 Python 消息队列:RabbitMQ/Kafka 生产级实践【高级python篇】

本文介绍了Python中使用RabbitMQ和Kafka进行消息队列生产级实践的核心技术。主要内容包括:RabbitMQ基础操作(消息发送、消费、确认)、Kafka基础使用、消息持久化、路由机制、死信队列处理以及消息序列化方法。通过代码示例展示了如何实现消息的可靠传输、错误处理和对象序列化,为构建高可用分布式系统提供了实用参考。文章涵盖了从基础操作到高级特性的完整消息队列解决方案。

2024-09-04 13:10:42 3956

原创 编写函数fun,函数的功能是:根据以下公式计算s,计算结果作为函数值返回;n通过形参传入。

编写函数fun,函数的功能是:根据以下公式计算s,计算结果作为函数值返回;n通过形参传入。

2024-09-03 15:30:46 530 3

原创 Python 函数式编程:闭包、偏函数与惰性计算【高级python篇】

本文介绍了Python中的函数式编程核心概念,包括闭包、偏函数和高阶函数等特性。闭包允许函数访问外部作用域变量,偏函数通过固定参数简化调用,高阶函数支持函数作为参数或返回值。文章还演示了map、filter、reduce等内置函数的用法,以及惰性计算和生成器表达式如何提高性能。此外,介绍了装饰器模式和不可变数据在函数式编程中的应用,强调纯函数的重要性。这些特性使Python能够以声明式风格编写简洁高效的代码。

2024-08-03 16:45:00 1853

原创 面向对象高级:Python 接口、抽象类与多态【高级python篇】

本文深入探讨了Python面向对象编程中的高级概念,包括接口、抽象类和多态的实现与应用。文章首先介绍了通过抽象基类(ABC)实现接口的方法,展示了如何定义抽象方法和强制子类实现特定功能。接着详细讲解了抽象基类的特性,包括不能被实例化、可以包含部分实现等。在多态部分,文章通过几何图形示例演示了不同对象对相同方法的不同响应,并介绍了Python特有的鸭子类型特性。此外,还对比了接口与抽象类的区别,介绍了Python 3.8+的协议(Protocol)特性、抽象属性、运算符重载等高级用法,最后以抽象工厂模式作为综

2024-08-03 12:21:45 2673

原创 Python 设计模式实战:23 种模式场景化落地【高级python篇】

设计模式是软件工程中的最佳实践,Python 作为一门灵活的语言,为各种设计模式的实现提供了优雅的语法支持。本文将通过实际场景深入讲解 23 种设计模式在 Python 中的落地应用,帮助读者掌握设计模式的实际运用。

2024-08-02 13:30:36 1103

原创 异步任务调度:Python 定时任务高可用方案【高级python篇】

本文探讨了Python异步任务调度的高可用实现方案。首先介绍了基础定时任务使用asyncio的sleep函数实现简单调度,然后详细讲解了APScheduler异步调度库的使用方法。文章还提出了分布式任务调度架构,并介绍了Celery异步任务队列系统和Redis任务队列的实现。最后展示了任务优先级调度的实现方式,通过PriorityTaskScheduler类确保重要任务优先处理。这些方案从简单到复杂,覆盖了Python异步任务调度的主要应用场景,为构建高可用定时任务系统提供了多种选择。

2024-07-28 23:09:57 299

原创 爬虫高级与工程化:使用ELK分析爬虫日志【爬虫中级篇】

本文介绍了如何使用ELK(Elasticsearch、Logstash和Kibana)分析爬虫日志,提升爬虫系统的可观测性。ELK组合提供了完整的日志收集、存储和分析解决方案,支持实时处理、分布式架构和强大的可视化功能。文章详细讲解了两种ELK安装方式(Docker Compose和手动安装),并提供了Logstash配置示例和Python爬虫日志生成代码。此外,还介绍了两种日志收集方法(直接使用Logstash或通过Filebeat)以及如何在Kibana中查看和分析日志数据,为爬虫系统的监控和问题排查提

2024-07-24 23:09:45 908

原创 爬虫高级与工程化:使用Prometheus监控爬虫系统【爬虫中级篇】

本文介绍了如何使用Prometheus监控爬虫系统,主要内容包括:Prometheus的特点(多维度数据模型、灵活查询、高效存储等);安装配置方法;监控指标定义(请求数、响应时间、错误率等);告警规则设置;以及与爬虫系统的集成方案。文章提供了Python代码示例,展示如何暴露爬虫指标(请求计数、响应时间、错误统计等)并通过Prometheus进行收集和可视化,实现爬虫系统的实时监控和告警功能。

2024-07-24 23:08:11 673

原创 爬虫高级与工程化:使用Airflow调度爬虫任务【爬虫中级篇】

本文介绍了使用Airflow调度爬虫任务的方法。Airflow是一个Python编写的开源工作流管理平台,具有动态工作流、可扩展性、可视化界面等特性。文章详细讲解了Airflow的安装配置、基本操作(创建/运行/管理DAG)以及如何编写爬虫DAG,包括简单和复杂爬虫任务的实现示例。通过Airflow可以实现爬虫任务的自动化调度、监控和管理,提高爬虫系统的可靠性和可维护性。

2024-07-24 23:07:39 645

原创 爬虫高级与工程化:使用Kubernetes部署分布式爬虫【爬虫中级篇】

本文介绍了使用Kubernetes部署分布式爬虫的方法。Kubernetes作为容器编排平台,具备自动化部署、扩展和故障恢复等特性,适合构建高可用的爬虫系统。文章详细讲解了Kubernetes的基本操作,包括Pod、Deployment、Service等资源管理,并提供了完整的分布式爬虫架构设计方案。通过Redis作为中间件实现爬虫任务分发,使用YAML配置文件部署Redis StatefulSet和爬虫Deployment,实现爬虫的弹性扩展和高效管理。最后给出了部署命令和Python爬虫示例代码,为构建

2024-07-24 23:04:37 1092

原创 爬虫高级与工程化:使用Docker Swarm部署分布式爬虫【爬虫中级篇】

本文介绍了使用Docker Swarm部署分布式爬虫的方法。首先概述了Docker Swarm作为Docker原生集群管理工具的特点和优势,包括高可用性、可扩展性和安全性。然后详细讲解了Docker Swarm的基本操作,包括节点管理、服务部署、网络和存储配置。重点阐述了如何通过Docker Swarm架构设计分布式爬虫系统,包括创建Dockerfile、docker-compose.yml文件以及配置基于Redis的Scrapy爬虫。最后提供了一个电商爬虫的实战示例,展示完整的项目结构和部署流程。通过Do

2024-07-24 23:02:50 1446

原创 爬虫与数据分析/可视化:使用Matplotlib进行数据可视化【爬虫中级篇】

本文介绍了如何使用Matplotlib进行爬虫数据分析可视化。主要内容包括:Matplotlib的基本功能与安装方法,绘制折线图、散点图、直方图等常见图表,以及图表定制技巧(颜色、线型、标题等)。特别针对爬虫数据分析场景,演示了时间序列分析(响应时间变化)、分布分析(响应时间分布、状态码分布)等实用可视化方法,并提供了保存图表的技巧。文章通过Python代码示例展示了如何将爬虫获取的数据转化为直观的可视化图表,帮助开发者更好地理解和分析爬虫数据。

2024-07-21 21:32:17 1005

原创 开源监控神器WGCLOUD体验:服务器、Docker、数据库统一监控全攻略

WGCLOUD 是一款由国人开发、完全开源免费的高性能 IT 基础设施监控系统,专注于对服务器、网络、应用及中间件等资源进行实时、全面的监控与告警。它以轻量、易用、功能强大和对国产化环境友好而著称,被誉为“国产开源监控之光”。全栈监控能力主机监控:CPU、内存、磁盘、网络、负载、进程、温度等。服务/应用监控:HTTP、Ping、端口存活、数据库(MySQL、PostgreSQL、Oracle 等)、Redis、MongoDB、FTP、SMTP 等。

2026-07-28 11:55:05 11459

原创 我给企业招了个健康数字员工:她不是聊天框,而是能上岗的具身交互 Agent

本文介绍了一款名为"小慧"的企业健康数字员工,她不是传统聊天机器人,而是具备具身交互能力的智能体。通过三个典型场景(上岗自我介绍、午餐营养咨询、加班健康指导),文章展示了数字员工如何以拟人化服务角色融入企业环境,包括主动问候、专业边界控制和7×24小时待机等特性。技术实现上结合了魔珐星云的3D数字人渲染、Qwen向量知识库和状态机管理,重点解决了企业场景中的岗位身份认同、服务边界定义和成本控制问题,为AI服务提供了"拟人岗位感"的新范式。

2026-07-28 10:46:49 13969

原创 【Bug已解决】[Bug]: kv_cache_offloadig crashes on 0.21.0 - KeyError in self._block_id_to_pending_jobs[bid

bid。

2026-07-28 10:46:18 422

原创 【Bug已解决】[Bug]: DeepSeek-V4-Flash for L20,RuntimeError: Worker failed with error ‘AssertionError: aut

DeepSeek-V4-Flash 的某个融合层(推测是 MoE 路由里的 in-place 写)调用了。

2026-07-28 10:45:47 262

原创 【Bug已解决】[Bug]: POST /wake_up causes vLLM process to crash. 500 Internal Server Error 解决方案

vLLM 启用了 sleep 模式(用/sleep把显存释放、模型卸载,省电省卡)后,调用/wake_up把服务唤醒时,HTTP 接口直接返回,而且更严重的是——,不只是接口报错。最坑的地方在于:这个问题不是 100% 复现。冷静期长一点(sleep 后等几十秒再 wake_up)往往能成功;但 sleep 后wake_up,或者 wake_up 过程中,就大概率崩。于是测试环境「没问题」,压测或生产环境「时灵时不灵」,极难定位。

2026-07-28 10:45:16 158

原创 【Bug已解决】[Bug]: vllm0.19.1 with llmcache with qwen3.6-27B-FP8 failed 解决方案

在 vLLM 0.19.1 上挂载 LLMCache(外接 KV 缓存层,把前缀 KV 缓存从显存搬到本地磁盘 / 共享内存 / 远端存储)去服务最让人困惑的是:单独用不带 LLMCache 完全正常;单独用 LLMCache 配一个 bf16 模型也完全正常。两者一组合就炸,而且报错信息指向的是「缓存」,不是「模型权重」,很容易让人误以为是磁盘或网络问题,来回换存储后端浪费大量时间。

2026-07-28 10:44:44 162

原创 【Bug已解决】[Bug]: ValueError: No user query found in messages QWEN 3.5 27B VLLM 0.16.0 NIGHTLY 解决方案

用 vLLM 0.16.0 nightly 给发聊天请求时,服务端在处理消息时抛ValueError,请求失败。

2026-07-28 10:44:13 189

原创 【Bug已解决】[Bug]: CUDA error: an illegal memory access was encountered when using turboquant and cuda g

在 GB200(Blackwell)上,对模型启用并开启时,运行期报非法内存访问,进程崩溃。

2026-07-28 10:43:42 178

原创 【Bug已解决】[Bug]: Qwen3-Coder-Next-FP8 start error wifh tp=8 on H100 解决方案

在 H100 上加载,并设张量并行tp=8启动时,进程在启动阶段报错退出。或者更笼统(保留原始标题里的wifhtp=8scalingscaleper-tensorper-block。

2026-07-28 10:43:11 207

原创 【Bug已解决】[Bug]: raise error when setting --pipeline_parallel_size > 3 in ray cluster 解决方案

在 Ray 集群上部署 vLLM,设置时,启动即报错退出。

2026-07-28 10:42:40 243

原创 【Bug已解决】sm110: torch.AcceleratorError: CUDA error: an illegal instruction was encountered 解决方案

在(Blackwell 架构,如 B200 / B300 的 compute capability 12.0/12.1 相关代号)设备上运行 CUDA 相关代码(模型加载、推理、或某个自定义 kernel)时,进程崩溃,报非法指令错误。

2026-07-27 12:14:13 117

原创 【Bug已解决】Partial LoRA on Qwen3.5/Qwen3.6 GatedDeltaNet (in_proj_qkv without in_proj_z) crashes in exp

在 Qwen3.5 / Qwen3.6 的(门控线性注意力/线性 RNN 类模型)上加载一个——即只训练了部分投影、没有覆盖全部 packed 投影——时,加载阶段在这一步崩溃。in_proj_z。

2026-07-27 12:13:41 171

原创 【Bug已解决】Qwen3.5 397B model occurs assertion error during allocating new blocks 解决方案

在给 Qwen3.5-397B 这种超大模型分配 KV 缓存块(allocating new blocks)时,引擎初始化或运行时分配阶段抛出断言错误,进程崩溃。

2026-07-27 12:13:10 155

原创 【Bug已解决】[Bug][ROCm]: Step3.5 Flash MTP init error 解决方案

在 AMD ROCm(如 MI200 / MI300 系列)环境下,给 Step-3.5 这类模型启用(基于 FlashAttention 的 Multi-Token Prediction,多 token 预测,常用于投机解码/spec decode 加速)时,模型初始化阶段直接报错退出。

2026-07-27 12:12:39 112

原创 【Bug已解决】tool_choice=‘required‘+PD disaggregation; internal server error for GLM-5 解决方案

用 GLM-5 做工具调用(function calling),当请求里同时设置(强制模型必须调用工具)开启 PD 分离部署(Prefill 与 Decode 拆成两个独立实例:prefill 实例负责把 prompt 算到第一个 token,decode 实例负责后续自回归生成)时,服务端返回 500 Internal Server Error。

2026-07-27 12:12:08 197

原创 【Bug已解决】[v0.22] Crash when calling API to inference to a GGUF model 解决方案

用 vLLM v0.22 加载一个(llama.cpp 格式的.gguf模型文件)后,通过 HTTP API 发起推理请求,服务端进程直接崩溃(crash),而不是返回正常的错误响应。

2026-07-27 12:11:37 176

原创 【Bug已解决】Qwen 3.6 awq can‘t load, always OOM error 解决方案

还有一层:vLLM 在「估算能否加载」时,有时只按「最终量化权重体积」估算,没把「加载期的反量化临时副本」算进去。这解释了为什么「调低 utilization 也没用」——因为利用率调低只会缩小 KV 缓存池,而 OOM 来自权重加载峰值,与 KV 缓存无关。同时 AWQ 加载器在「先反量化再量化」的实现里,瞬时 fp16 峰值 ≈ 整个模型 bf16 大小——也就是说,这样:换模型/换卡/换量化参数时,规划器先算「真实峰值」判断能不能启动,而不是被「最终量化体积」误导。AWQ 对它的量化,如果。

2026-07-27 12:11:05 140

原创 【Bug已解决】+rotary_embedding error with DeepSeek-V3.2-NVFP4 解决方案

在加载 DeepSeek-V3.2 的 NVFP4(4 位浮点量化)版本时,只要你在启动配置里额外追加了相关的覆盖项(比如通过这类「加号前缀」的额外配置,或 config 里出现字段),就会报错退出。

2026-07-27 12:10:34 203

空空如也

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除