大模型开发实验
文章平均质量分 88
大模型
网络工程小王
这个作者很懒,什么都没留下…
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
【大模型vLLM 使用】学习笔记
微调不是为了训练,是为了用。LLaMA-Factory 给你一个补丁,vLLM 把你的补丁变成服务。原创 2026-05-17 11:26:20 · 383 阅读 · 0 评论 -
[大模型LoRA微调]学习笔记
LLaMA-Factory 基本都收录了这些新方法,学会它之后改一行配置就能试用。微调 = 好基座 + 好数据 + QLoRA + 迭代评估不需要理解梯度下降、反向传播,也能做出有效的微调模型。原创 2026-05-17 10:41:54 · 642 阅读 · 0 评论 -
还是搞不懂Anaconda是什么?读这一篇文章就够了
Anaconda是专为数据科学设计的Python发行版,它预装了180+常用科学计算库(如NumPy、Pandas),省去手动安装的麻烦。其核心优势在于强大的环境管理功能,可创建隔离的Python环境解决版本冲突问题,并自带Conda包管理器自动处理复杂依赖关系。相比原生Python,Anaconda更适合数据分析和AI领域使用,提供开箱即用的体验。另有轻量版Miniconda供高级用户选择。总体而言,Anaconda极大简化了Python环境配置,让开发者能专注于数据分析而非环境搭建。原创 2026-03-28 09:19:10 · 469 阅读 · 0 评论 -
【Python数据分析基础】
如果你要处理Excel、CSV 文件,或者需要列名、行索引,请务必使用Pandas (df。如果你要做复杂的矩阵运算、图像处理,或者追求极致速度,请使用NumPy。最佳实践:通常流程是读取数据(Pandas)->清洗数据(Pandas)->数值计算(NumPy)->结果展示(Pandas)。原创 2026-03-28 15:35:21 · 343 阅读 · 0 评论 -
【提示词工程和思维链的讲解】学习笔记
摘要: 提示词工程是优化大语言模型(LLM)输出的关键技术,通过结构化提示词(角色、上下文、指示、输入、示例、输出)提升结果质量。思维链(CoT)技术模拟人类逐步推理过程,显著提高复杂任务的准确性,实现方式包括零样本指令(如“Let's think step by step”)和少样本示例。自洽性通过多路径推理投票增强答案可靠性,而LtM(问题拆解与顺序解答)进一步优化复杂问题处理。这些方法共同提升LLM的逻辑性和可解释性。原创 2026-04-06 17:35:56 · 467 阅读 · 0 评论 -
【Transformer架构详解】(学习笔记)
Transformer是一种基于注意力机制的序列建模架构,克服了传统RNN/LSTM的并行计算和长距离依赖问题。其核心包括:1)自注意力机制通过Q/K/V矩阵计算全局依赖关系;2)位置编码解决词序问题;3)编码器-解码器结构实现序列转换;4)残差连接和层归一化稳定深层网络训练。优势在于高效并行计算和全局信息捕捉能力,但存在计算复杂度高和位置编码局限性。多头注意力机制通过多组并行计算进一步提升模型性能,广泛应用于机器翻译等序列任务。原创 2026-04-06 17:20:21 · 1022 阅读 · 0 评论 -
【大模型基础部署】(学习笔记)
《大模型部署全流程指南:从压缩到应用开发》系统介绍了2026年主流的大模型部署技术。在模型压缩方面,重点探讨了量化、剪枝和知识蒸馏三大技术,其中量化可将显存占用减少4-8倍,AWQ等新方法能在INT4精度下实现无损压缩。部署工具部分对比了vLLM、Ollama和Triton等框架,特别介绍了vLLM的PagedAttention技术如何提升显存利用率。推理加速章节详细分析了MoE架构和连续批处理等优化手段,指出这些技术可显著提升吞吐量。最后,文章提出了应用开发的层级化范式,从基础预训练到行业微调再到任务适配原创 2026-04-12 11:05:37 · 847 阅读 · 0 评论 -
强化学习(Reinforcement Learning, RL)就是机器的“大脑决策中枢”。
强化学习(RL)是机器学习的重要分支,通过"试错"机制让智能体在环境中学习最优决策策略。其核心五要素包括智能体、环境、状态、动作和奖励,通过Q-Learning等算法实现决策优化。RL区别于监督学习和无监督学习,不需要标注数据而是依靠奖励信号。里程碑包括2013年DeepMind的DQN突破和2016年AlphaGo战胜人类。应用场景涵盖游戏AI、推荐系统、机器人控制等领域。Q-Learning作为经典算法,通过Q表记录状态-动作价值,但面临维度灾难问题,后续发展出结合深度学习的DQN等原创 2026-03-29 15:52:36 · 422 阅读 · 0 评论 -
【AI技术应用工具详解】(学习笔记)
本文系统介绍了大模型应用的核心技术框架及企业级实现方案。主要内容包括: 核心技术理论: Prompt工程:结构化输入设计原则 CoT链式思考:分步推理机制 RAG检索增强:实时知识补充 Agent智能体:自主任务执行 MCP协议:标准化工具连接 企业采购助手实验: 通过五步流程演示技术协同: Prompt定义角色边界 Agent+CoT进行任务拆解 RAG查询采购政策 MCP调用ERP系统 闭环反馈执行结果 技术实现方案: 提供基于LangChain的完整Python代码,集成GPT-4、FAISS等工具,原创 2026-03-28 15:42:34 · 920 阅读 · 0 评论 -
【监督学习范式】 技术详解(学习笔记)
模型在训练集上表现尚可,但在实际的测试集(另外50张医生标注的图)上,准确率很低,且出现了严重的过拟合现象。模型仿佛只是“背诵”了那500张图的纹理,一旦遇到不同医院、不同机器拍摄的CT,或者结节形态稍有变化,就无法识别。这相当于让模型先“博览群书”(看了近10万张无标签图),再“精读教材”(学习500张标注图),效果立竿见影,测试准确率提升了约8%。我们引入了半监督学习,特别是将S-S-GANs的思想与一致性正则化相结合,构建了最终的解决方案。这丰富了数据的多样性,让模型见识到更多形态的结节。原创 2026-03-29 11:28:12 · 508 阅读 · 0 评论 -
【大模型(LLM)的业务开发】学习笔记
在大模型(LLM)的业务开发中,构建一个高性能、懂指令且符合人类价值观的模型,通常遵循一个经典的“四步走”流水线。这四个阶段层层递进,分别解决了模型“懂知识”、“懂指令”、“懂好坏”和“懂对齐”的问题。原创 2026-04-12 13:12:54 · 382 阅读 · 0 评论 -
【Function Calling详解】(学习笔记)
Function Calling是扩展大语言模型能力的核心技术,让AI不仅能对话还能执行操作。它通过四步流程实现:识别用户意图→匹配工具并生成参数→外部执行→整合结果反馈。这种机制突破了模型的知识时效性限制和计算能力边界,避免了"幻觉"答案,可广泛应用于客服、数据分析、个人助理等场景。就像智能助手一样,用户只需表达需求,AI就能自动调用API完成复杂任务,实现从"会说话"到"能办事"的进化,成为构建智能体的关键技术基础。原创 2026-04-12 11:07:42 · 341 阅读 · 0 评论
分享