自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+

郑恩赐,厦门工学院软件工程AI方向本科在读。专注AI全栈应用开发,熟练Vue3、Spring Boot、PyTorch等技术栈,正在探索多模态大模型应用。拥有多个全栈项目和AI应用开发经验,获国家级大创立项和发明专利,掘金优质作者榜第2名。

专注AI全栈开发技术分享,涵盖Vue3、Spring Boot、PyTorch等技术栈实践。深入探索多模态大模型应用,分享深度学习模型设计、目标检测、行为识别等AI技术。结合实战项目经验,提供从理论到落地的完整技术解决方案。

  • 博客(164)
  • 收藏
  • 关注

原创 DeepSeek V4 Flash Vision Exp 全面调研:好不好用、值不值得用、性价比高不高

2026 年 8 月 21 日,DeepSeek 上线了实验性多模态视觉模型 deepseek-v4-flash-vision-exp。这是 DeepSeek Flash 系列首次具备图片理解能力,标志着 DeepSeek 正式进入 multimodal(多模态)赛道。本文从 model overview(模型概况)、pricing mechanism(定价机制)、benchmark performance(性能表现)、competitive analysis(竞品对比)、integration compa

2026-08-24 15:12:07 313

原创 LLM13-2026年8月国内AI大模型性价比排行榜:DeepSeek涨价之后

2026 年 8 月 17 日,DeepSeek 一纸公告让整个开发者圈 sub 了一下——V4 系列告别「白菜价」,正式引入峰谷定价(Peak/Off-peak Pricing)⏰。曾经以 1 元/2 元横扫市场的 V4-Flash,一夜之间变成 1.5 元/4.5 元起,输出价格最高涨了 3.5 倍 💸。那个「无脑选 DeepSeek」的时代,结束了。所以问题来了:涨价之后,国内大模型性价比之王还是它吗? 本文基于 8 月 14 日更新的 AA Intelligence Index(AA 智能指数)

2026-08-21 10:16:25 373

原创 什么是 SFT 监督微调:大模型从只会续写到会听话的关键一步

刚预训练完的大模型只会做一件事——预测下一个字,也就是不停地续写。而可以在产品里用的聊天模型,得听懂你的指令、按格式回答、该拒绝还得拒绝。从「不会续写」到「会听话」,中间这关键一步最常用的技术之一,就叫 SFT(Supervised Fine-Tuning,监督微调)。本文带你拆解 SFT 的定义、数据、机制与能力边界。

2026-08-13 17:24:35 220

原创 为什么 DeepSeek V4 Flash 可以超过 V4 Pro Preview

2026 年 7 月 31 日,DeepSeek 发布了 V4-Flash-0731 正式版。令人震惊的是,这个仅 284B 总参数(13B 激活)的轻量模型,在 Agentic(智能体)基准测试上全面超越了自家 1.6T 总参数(49B 激活)的 V4-Pro-Preview。本文深入分析这一「以下克上」现象背后的技术原因。

2026-08-11 14:04:18 365

原创 AI Agent 在 Windows 执行命令不熟练:是 PowerShell 还是 cmd 的锅?

本文剖析 Trae、Qoder、Cursor、Claude Code、Codex 等 AI Agent 在 Windows 上执行命令行频繁失败的现象,从训练数据 bias、shell 语法差异、shell 检测 bug 三个维度定位根因,并给出 Git Bash、WSL2、PowerShell 7+、cmd 的选择建议与实战配置

2026-08-07 15:17:24 243

原创     MoE(Mixture of Experts,混合专家模型)深度解析:从路由机制到专家专业化的迷思

本文深入剖析 MoE(Mixture of Experts,混合专家模型)架构的核心机制,厘清「专家专业化」的常见误解,并探讨角色扮演提示词与 MoE(Mixture of Experts,混合专家模型) 专家激活之间的真实关系

2026-08-04 21:53:36 226

原创 AI Agent(AI智能体) 记忆管理系统设计 — 从向量库边界到生产级 Memory(记忆) 架构

本文深入剖析 AI Agent(AI智能体) 记忆管理的生产级设计方案。从 Vector DB(向量数据库)的三大边界问题(精确查询失效、语义噪声污染、时间盲区)出发,提出平行记忆架构(精确通道 + 摘要通道 + Sliding Window(滑动窗口)),引入双时间戳状态管理(Valid Time(有效时间) + Transaction Time(记录时间))解决状态错乱,最后通过 Workflow Memory(工作流记忆)机制实现经验固化与自进化,形成一整套让 Agent(智能体)具备可靠记忆与持续进

2026-07-30 18:15:56 195

原创 Pi Agent 深度解析:最小化编码 Agent 的哲学、争议与未来

本文档深入解析 Pi Agent——一个由 Mario Zechner 开发的最小化编码 Agent,也是 OpenClaw(曾被称作 ClawdBot / MoltBot)的底层引擎。文章涵盖 Pi 的核心设计哲学、架构特点、与主流 AI 编码工具的对比,以及围绕它的社区争议和前景分析,帮助读者客观判断这一新兴工具的定位与价值。

2026-07-27 13:05:36 459

原创 什么是 Luke(循环工程)

一句话总结:Luke(Loop)是 AI 开发的第四代 paradigm——从「写提示词」进化到「设计循环」。你不是再在一轮轮对话中指挥 AI,而是设定一个 Goal,设计一套系统,让 AI 自己循环执行、自主纠错、独立验证,直到目标达成交付验收。

2026-07-26 14:46:44 390

原创 长上下文时代,RAG 还有必要吗?— 从企业级实践出发的深度分析

本文探讨在大模型上下文窗口不断扩展的背景下(2026 年主流模型已支持 128K-1M token),RAG(检索增强生成)是否仍有存在价值。文章从企业级知识库的真实痛点出发,分析长上下文模型的固有限制,拆解 RAG 在 precision、cost、compliance 等方面的不可替代性,并给出「检索-压缩-读取」的混合架构实践路径。核心结论:放得下不等于找得准,长上下文不会取代 RAG,而是重新定义 RAG 的分工边界 🔍

2026-07-26 14:25:33 182

原创 LLM02-Context Priming:利用强模型上下文提升弱模型能力的策略

本文探讨一种实用的 LLM cost optimization 策略——Context Priming:在一轮新对话中先用强(昂贵)模型建立高质量的 interaction context,然后切换至弱(廉价)模型继续对话。由于 conversation history 充当了 implicit prompt,弱模型会模仿强模型的 reasoning pattern、response format 和 behavior,从而显著提升其 output quality。本文涵盖核心概念、技术原理、实现策略、效果

2026-07-17 21:57:31 294

原创 S02-SpringBoot实体类新增字段对已有数据的影响及自动DDL同步机制详解

本文档深入分析 SpringBoot + JPA 项目在已有数据的情况下,修改 Entity 类(新增字段)对数据库表和已有数据的影响。核心聚焦 spring.jpa.hibernate.ddl-auto 配置的四种模式,解析「数据会不会丢失」「SpringBoot 如何同步实体结构到数据库表」等关键问题,并提供生产环境的安全操作指南

2026-07-11 17:12:23 207

原创 N3A-一个端口只能给一个程序使用吗?[特殊字符]

本文档深入探讨端口绑定的核心机制,解析「一个端口对应一个程序」这一常见认知的适用边界和重要例外。涵盖端口的基本概念、默认独占规则的原因、不同协议层面的端口独立性、端口复用/共享技术(SO_REUSEADDR / SO_REUSEPORT)、反向代理与虚拟主机的端口共享方案,以及容器化环境下的端口映射策略。通过理论与实践结合,帮助读者全面理解端口使用的灵活性与限制

2026-07-09 11:19:42 220

原创 LLM01-大模型API调用平台性价比深度分析

本文档基于 2026 年最新市场数据,从价格、模型能力、平台稳定性、合规性等多个维度,深度分析国内外主流大模型 API 调用平台的性价比表现,为个人开发者提供科学的选型指南

2026-07-08 16:06:42 228

原创 Q06-导航按钮高级拟态玻璃效果构建完全指南

本文档详细讲解如何在没有背景图片的导航页面上,通过纯 CSS 技术为每个导航按钮构建高级拟态玻璃(Glassmorphism)效果。涵盖从基础原理到 Apple Liquid Glass、Honor MagicOS 风格的完整实现方案,以及交互状态增强和完整可运行示例

2026-06-30 15:01:20 3187

原创 P2M-Matplotlib折线图完全指南-从数据可视化到趋势分析的Python绘图利器

本文档详细介绍了如何使用Matplotlib绘制折线图,从环境准备到核心参数解析,再到完整代码实现。主要内容包括: 环境配置:确保Matplotlib安装并正确设置中文字体显示 折线图基础:定义、适用场景(时间序列分析、趋势对比等)和注意事项 核心参数详解: 线型(linestyle):实线、虚线等样式 颜色(color):支持名称、十六进制等格式 标记(marker):数据点形状设置 线宽(linewidth):控制线条粗细 完整案例:通过2026年两款产品月销售额对比的实例,展示完整代码实现和逐行解析,

2026-06-29 10:54:36 287

原创 P2L-Matplotlib饼图完全指南-从数据可视化到图表定制的Python绘图利器

文章摘要 本文是一份Matplotlib饼图绘制完整指南,涵盖从基础概念到高级定制的全流程。主要内容包括: 环境配置:安装Matplotlib并设置中文字体支持 饼图基础:解释饼图定义、适用场景和核心术语(Wedges、explode等) 核心参数详解:深入解析plt.pie()的关键参数,包括x、explode、labels等 完整实现:通过电商销售渠道占比案例,提供可运行的完整代码 代码解析:对每行代码进行详细注释说明 可视化效果:展示最终生成的饼图示例 特别强调实际应用中参数配置技巧和常见注意事项,如

2026-06-29 10:11:09 233

原创 Q04-Vite禁用CSS代码分割-解决生产环境样式加载顺序混乱问题

摘要:解决Vite生产环境CSS加载顺序问题 当使用Vite构建项目时,默认的CSS代码分割(CSS Code Splitting)功能可能导致生产环境样式加载顺序混乱,特别是当ElementPlus等UI库的默认样式意外覆盖自定义样式时。本文分析了该问题的根源:Vite会将异步组件的CSS提取为独立文件,这些CSS文件的加载顺序不可控,可能破坏CSS层叠规则。解决方案是在vite.config.mjs中设置cssCodeSplit: false,强制将所有CSS合并为单个文件,确保样式按预期顺序加载。文中

2026-06-28 22:34:03 367

原创 J7A-高级Java工程师面试三道灵魂拷问-深度广度与工程素养的终极检验

高级Java工程师面试核心能力指南 摘要 本文针对高级Java工程师面试中的三大核心能力进行剖析: 线上问题排查 - 展示结构化分析流程,从链路追踪到JVM诊断(P99延迟/CPU飙升场景) 高并发架构设计 - 解析秒杀系统关键设计,涵盖限流/熔断/缓存一致性等核心技术 遗留系统重构 - 提出渐进式重构策略(绞杀者模式),平衡业务需求与技术债务 关键亮点 深度诊断工具链:集成SkyWalking APM、Arthas诊断、GC日志分析等工具 架构设计权衡:揭示高并发场景下的CAP原则实践与一致性保障方案 工

2026-06-28 12:37:28 350

原创 Q03-UI设计进阶技巧-让界面更高级的7个核心原则

本文档系统讲解7个让UI界面更高级的设计原则,涵盖IP形象品牌记忆、拟物化卡片设计、视觉降噪与信息重组、拟态玻璃样式、标签色彩克制、卡片信息聚焦等核心技巧,帮助设计师打造高质感界面

2026-06-27 19:17:46 218

原创 Q01-高并发点赞系统架构设计

本文档基于抖音面试案例视频,深入解析高并发点赞系统的四层架构设计。从数据库行级锁的串行化瓶颈出发,逐层讲解前端批量合并、Redis 原子计数器、异步持久化到分库分表打散热点的完整解决方案,揭示如何在性能与一致性之间取得务实平衡 🎯

2026-06-27 13:09:52 205

原创 Q02-Vue-React-index.html完全指南

许多 Vue/React 初学者对 index.html 的作用认知模糊,仅把它当作"一个空的 HTML 文件",却不知道它能控制 SEO、性能优化、CDN 加载、多环境变量等关键能力。本文档系统讲解 index.html 的本质、功能、配置方法和最佳实践,帮助开发者充分挖掘这个"被低估的入口文件"的潜力

2026-06-26 10:49:06 437

原创 09e-斯坦福CS336作业四:大规模语言模型训练数据收集与处理

本文档详细讲解斯坦福 CS336 课程作业四的核心内容,涵盖从 Common Crawl 原始网页数据到高质量预训练数据集的完整处理流程,包括 HTML 转纯文本、内容过滤策略、大规模数据去重算法,以及高效数据流水线构建

2026-06-23 11:17:37 317

原创 09d-斯坦福 CS336 作业三:缩放定律(Scaling Laws)

本文档详解斯坦福 CS336 课程的作业三,聚焦语言模型的缩放定律(Scaling Laws)。通过理论与实践相结合的方式,帮助读者理解如何在给定计算预算下最优地分配模型大小和训练 token 数,以及如何拟合缩放曲线预测模型性能 🎯

2026-06-23 09:48:43 458

原创 09c-斯坦福CS336作业二:系统与分布式训练

本文档详细解析斯坦福 CS336 课程 Assignment 2 的核心内容,涵盖单 GPU 性能分析与优化(基准测试、混合精度、内存分析)、FlashAttention-2 的 Triton 内核实现、分布式数据并行训练(DDP)的渐进式优化,以及优化器状态分片(ZeRO-1)技术。通过理论与实践相结合,帮助读者深入理解大模型训练中的系统工程问题 🔧

2026-06-22 23:15:00 420

原创 09bad-斯坦福CS336作业一-构建优化器

本文档基于斯坦福 CS336 作业一,从零构建 AdamW 优化器,涵盖优化器的核心作用、SGD 与动量法、Adam 的自适应矩估计、AdamW 解耦权重衰减的数学原理与手动实现,以及 PyTorch 原生优化函数的对比使用

2026-06-21 22:46:40 219

原创 09bac-斯坦福CS336作业一-实现训练损失计算

本文档基于斯坦福 CS336 作业一,从零实现语言模型的训练损失计算(交叉熵损失),涵盖核心公式推导、数值稳定技巧、手动实现完整代码及逐行解析、PyTorch 原生优化函数的使用,以及完整可运行的综合示例 🛠️

2026-06-21 22:19:52 173

原创 09bab-斯坦福CS336作业一-Xavier初始化

本文档深入讲解 Xavier 初始化(又称 Glorot 初始化)的原理、数学推导与代码实现。Xavier 初始化通过精心设计的权重方差,使信号在深度神经网络的前向传播和反向传播中保持稳定,有效解决梯度消失和梯度爆炸问题 🛠️

2026-06-16 10:51:54 291

原创 09ba-斯坦福CS336作业一-前馈网络

本文档基于斯坦福 CS336 作业一,从零实现 Transformer 的位置级前馈网络(Position-wise FFN),涵盖核心原理、标准 FFN 实现、SwiGLU 门控变体、代码逐行解析,以及完整可运行的综合示例

2026-06-15 17:16:15 372

原创 O08-单写线程与单读线程冲突分析

本文档深入分析单写线程与单读线程场景下的冲突问题,涵盖竞态条件产生原理、数据一致性风险、无锁队列实现机制、环形缓冲区设计方案,以及基于原子操作的线程安全解决方案。通过理论与实践相结合的方式,帮助读者理解单写单读并发编程的核心要点

2026-06-03 12:09:52 362

原创 O07- 银行家算法

本文档系统介绍银行家算法的核心原理、数据结构、安全性检查机制和完整的 Python 实现。通过理论与实践相结合的方式,帮助读者深入理解操作系统中死锁避免的经典算法

2026-06-02 16:17:31 185

原创 O06-缺页中断与一般中断的主要区别

本文档详细对比缺页中断与一般中断的核心区别,涵盖触发时机、处理流程、硬件响应、可屏蔽性等维度,并深入讲解软缺页与硬缺页的分类、缺页中断的三大特性,以及完整的处理流程

2026-06-02 11:17:56 256

原创 O05-分时操作系统和实时操作系统区别

本文档从定义、核心机制、调度策略、应用场景等多个维度,系统对比分时操作系统与实时操作系统的本质区别,帮助读者深入理解两类操作系统的设计哲学与适用场景

2026-06-02 10:38:02 211

原创 09b-斯坦福CS336作业一-Transformer语言模型

本文档详细解析斯坦福CS336课程作业一的第二部分:Transformer语言模型架构(Decoder-Only Transformer),涵盖多头注意力、RoPE、RMSNorm、SwiGLU等核心组件的从零实现

2026-06-01 15:59:10 286

原创 09abb-SwiGLU激活函数

本文档深入讲解 SwiGLU 激活函数的核心原理,涵盖从 GLU 到 Swish 再到 SwiGLU 的演进历程、数学公式解析、门控机制工作原理、与传统激活函数的对比分析、在 LLaMA 等主流大模型中的应用,以及参数量设计原理。帮助读者深入理解 SwiGLU 为何成为现代大语言模型的标准选择

2026-06-01 15:41:41 426

原创 09aba-将离散的 token ID 映射为连续的稠密向量

本文档深入讲解 Token Embedding 的核心原理,涵盖从离散符号到稠密向量的映射机制、Embedding 层与查找表的等价关系、PyTorch 从零实现完整代码及逐行解析、为什么要用稠密向量而非 One-Hot,以及一个完整可运行的示例。帮助读者彻底理解 Embedding 层的运行机制

2026-06-01 12:27:06 259

原创 01-如何监听接口调用情况?

本文档介绍在 SpringBoot 项目中监听每个接口的调用次数、传入参数、返回参数、响应耗时的多种实现方案

2026-05-28 21:24:40 234

原创 09ab-无偏置线性层是什么?

本文档详细解释无偏置线性层(bias-free linear layer)的概念与核心特性,涵盖数学定义(y=xWTy=xW T )、与带偏置线性层的本质区别、输出恒过原点的几何含义,以及需要零中心输入的前提条件,帮助读者深入理解这一线性变换的核心原理

2026-05-28 18:27:39 404

原创 09aaac-RMSNorm是什么?

本文档深入讲解 RMSNorm(Root Mean Square Normalization,均方根归一化)的核心概念。RMSNorm 是一种轻量级的归一化方法,通过去除 LayerNorm 中的均值中心化步骤来降低计算开销。本文从归一化的背景动机出发,逐步推导 RMSNorm 的数学原理,并通过 PyTorch 代码实现帮助读者直观理解其工作机制,最后探讨 RMSNorm 在现代大语言模型(如 Llama、Gemma)中的广泛应用。

2026-05-28 13:28:10 445

原创 09aaaba-LayerNorm中心化操作是什么?

本文档深入解释 LayerNorm 中"减去均值"这一中心化操作的核心概念,涵盖数学定义与计算步骤、几何意义(正交投影)、为什么需要中心化,以及 RMSNorm 为何能去掉中心化仍保持性能

2026-05-28 12:30:59 365

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除