AI及算法
文章平均质量分 82
fpcc
行之苟有恒,久久自芬芳!
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
AI和大模型—codex的应用
总之,使用Codex是一个需要循徐渐进的过程。先学会处理简单的本地任务处理如阅读和分析项目;其次再进行基础的项目修改和迭代;直到最后完成复杂的任务。在此基础上,在进行更高级的Codex应用,综合实现达到中大型项目的开发和处理。会使用各种工具和规则、Skills的编写等。这就需要开发者自身不断的应用Codex,在实践中不断的总结经验并结合自身的项目特点提炼出适合于自身的一套Codex的开发能力。原创 2026-10-03 10:38:05 · 20 阅读 · 0 评论 -
AI和大模型—张量计算
张量是高维空间中的数据表示,可统一标量、向量、矩阵等概念。在大模型中,文本经Token化后转化为高维向量,通过张量形式组织,实现多维数据的高效处理。核心运算为矩阵乘法与累加,支撑注意力机制与多层网络的正反向传播。张量计算加速了神经网络、NLP及图像处理中的参数优化与梯度更新,是大模型底层运行的关键技术。原创 2026-10-01 09:31:40 · 146 阅读 · 1 评论 -
AI和大模型—维度的处理
本文系统阐述了矩阵降维在大模型中的核心作用,重点解析低秩矩阵与满秩矩阵的差异,引入奇异值分解(SVD)理论:任何矩阵可分解为多个秩为1矩阵之和,按重要性保留前几项即可实现高效降维与数据压缩。结合低秩矩阵分解(LRMF),该方法广泛应用于图像压缩、主成分分析及大模型参数优化(如LoRA)。相较精确但计算昂贵的SVD,LRMF更适用于稀疏、海量数据场景,是实现大模型高效微调的关键技术。理解矩阵降维机制,对掌握大模型底层原理至关重要。原创 2026-09-27 10:04:41 · 174 阅读 · 0 评论 -
AI和大模型—向量数据库
向量数据库通过将图片等非结构化数据转化为高维向量,实现基于语义相似度的高效检索,解决了传统数据库无法按内容查找图片的难题。它利用HNSW、IVF-PQ等近似最近邻算法,在精度与速度间平衡,支持毫秒级响应。广泛应用于AI中的RAG、推荐系统、多模态搜索等领域,弥补大模型“幻觉”问题。虽不能替代传统数据库,但作为新兴技术,正推动智能应用发展,其在整合性、更新维护等方面仍有提升空间。原创 2026-09-26 16:33:12 · 205 阅读 · 2 评论 -
AI和大模型—导数和积分
在很早以前学习线性代数时,就发现这东西太枯燥了。学了就忘。直到看到了西电的那本从几何角度学线代后的书籍后,才豁然开朗。每个人的学习的潜质不同,但每个人都要善于找到自己学习的突破点。不能拘泥于教材或学校提供的机制一种情况。打仗要防止思想僵化和教条主义,学习更是如此!原创 2026-09-25 09:57:46 · 285 阅读 · 4 评论 -
AI和大模型—归一化
归一化是深度学习中稳定训练的关键技术,通过调整激活值分布缓解梯度消失/爆炸、提升收敛速度与精度。从早期的LRN到BN、LN、RMSNorm,再到专为大模型设计的QK-Norm、DeepNorm等,归一化机制不断演进,适应不同架构需求。当前大模型普遍采用RMSNorm或LayerNorm,兼顾效率与稳定性。未来趋势向“无归一化”范式发展,探索自适应、可学习的归一化方式,如AdaLN、FiLM等,以实现更灵活高效的模型训练。原创 2026-09-20 10:40:12 · 329 阅读 · 0 评论 -
AI和大模型—生产级别的Memory设计
本文探讨了生产级Agent记忆系统的设计思路,指出传统RAG向量库在精确匹配与状态管理上的局限。针对数据安全、状态控制与流程复用三大核心需求,提出分层架构:通过缓存层实现短期记忆,状态管理层结合KV数据库与摘要机制保障状态一致性,数据层采用MVC模式实现敏感数据脱敏与可控访问。最终构建可复用、可扩展的智能记忆体系,强调将传统软件设计经验与大模型特性融合,方能实现高效可靠的生产级应用。原创 2026-09-19 09:42:11 · 221 阅读 · 1 评论 -
AI和大模型—矩阵浅析
矩阵是AI与大模型的基础数学工具,可从数表、线性方程组系数、函数、几何变换、坐标系描述及张量等多个维度理解。它不仅是数值的排列,更是线性映射的载体,广泛应用于旋转、缩放、应力分析等场景。掌握矩阵的本质有助于深入理解算法底层逻辑,但应用层面可根据需求选择掌握深度。原创 2026-09-19 09:38:16 · 256 阅读 · 0 评论 -
AI和大模型——Graph engineering
Graph Engineering是应对AI智能体协作复杂化的系统化设计范式,源于对提示词、上下文、循环等工程的演进与抽象。它借鉴并行图计算思想,通过动态、可变的图结构实现任务的并行与协调,是Workflow在复杂场景下的高级形态。虽无统一标准,但其核心在于解决多Agent协同中的接口与调度问题。实际应用中应基于并行性与结果可验证性判断是否采用,强调从单点串行(Loop)到多点并行的渐进抽象,避免无效成本。本质是面向复杂任务的更高阶架构能力,体现AI工程从“点”到“面”的演进逻辑。原创 2026-09-12 10:44:28 · 120 阅读 · 2 评论 -
AI和大模型——扰动秩不等式
<think>我们只需要根据内容生成≤150字摘要。内容讲扰动秩不等式:图像加噪、矩阵秩变化、上下界、AI应用。摘要要简洁。</think>扰动秩不等式揭示矩阵秩在扰动下的变化边界:噪声虽能提高矩阵秩,但新秩受原秩之和限制,主要信息仍由少数奇异值控制。该不等式与Weyl定理共同约束数据维度变化,为降噪提供依据。在AI中,它支撑低秩压缩、LoRA高效微调、增强泛化稳健性及动态秩调整,并作为量化扰动、监控误差的理论工具。原创 2026-09-05 09:44:43 · 228 阅读 · 0 评论 -
AI和大模型—Weyl不等式
对Weyl不等式在大模型中的应用进行分析原创 2026-08-30 10:26:50 · 165 阅读 · 0 评论 -
AI和大模型——PageRank
对PageRank在AI和大模型中的应用进行分析说明原创 2026-08-22 14:26:51 · 205 阅读 · 0 评论 -
AI和大模型—Agent的Skills实践
本文探讨了接口数据对象处理的多种方法及其适用场景。文章指出,开发者往往忽视对接口数据对象的深入处理,但在复杂场景下需考虑效率、扩展性等因素。常见处理方式包括继承、容器、共用体/Variant、类型擦除和函数对象,各有优缺点:继承便于扩展但性能开销大;容器方便但可能浪费资源;共用体灵活但需手动管理;类型擦除灵活但性能低;函数对象高效但复杂。文中提供了C++示例代码,展示函数对象、Lambda和类型擦除的实现方式。最后强调理论需结合实践,开发者应灵活选择适合场景的方法。原创 2026-08-20 11:01:27 · 392 阅读 · 0 评论 -
AI和大模型——PageIndex
本文介绍了传统检索增强生成(RAG)技术的局限性及新型PageIndex技术的优势与应用。传统RAG依赖向量数据库进行语义相似性检索,但在强结构化场景(如法律、金融等)中容易因上下文割裂而失效。PageIndex采用无向量架构,通过树状结构组织数据,模拟人类推理思维实现内容导航,具有可解释性强、上下文感知等优势,尤其适合需要逻辑严谨的领域。但其也存在检索效率低、依赖大模型、成本高等缺点。目前PageIndex主要适用于单一结构化文档处理,是传统RAG的有益补充而非替代。该技术在法律、金融、学术等强调准确性与原创 2026-08-16 10:05:23 · 167 阅读 · 0 评论 -
并行编程实战—CUDA Tile编程入门之二创建和应用
本文介绍了CUDA Tile编程的基本概念和使用方法。Tile是用于处理多维数据块的机制,其形状和元素类型需在编译时确定,且每个维度必须是2的幂次方。文章详细讲解了两种创建Tile的方式:从数组加载数据和通过工厂函数生成。还介绍了Tile的控制方法,包括查询块索引、使用编译时常量以及控制流处理。最后通过一个Python示例展示了Tile的实际应用,并指出Python是学习Tile编程的良好入门途径。Tile编程能高效处理数据块,适合CUDA并行计算场景。原创 2026-08-15 09:38:59 · 222 阅读 · 0 评论 -
Token的说明
本文系统梳理了Token在不同领域的多义性应用:1)安全认证中作为身份"令牌";2)编译原理中作为语法"标记";3)区块链中兼具"代币"的金融属性和"通证"的权益属性;4)AI领域作为文本处理的"词元"和计费单位。文章指出Token本质是象征性符号,其含义随应用场景变化,强调理解时需结合具体语境,避免概念混淆,并提醒在实际应用中要注意场景限定、合规性及术语规范。最终建议以开放思维看待这一多义词,通过实践深化理解。原创 2026-08-10 10:49:12 · 248 阅读 · 0 评论 -
AI和大模型——残差连接和残差网络
本文介绍了残差网络(ResNet)的发展与应用。随着深度学习层数增加,网络性能不升反降,出现"退化问题"。2015年何恺明提出的ResNet通过残差连接(跳跃连接)解决了这一难题,其核心思想是让网络学习残差F(x)=H(x)-x而非直接映射,大幅降低了深层网络训练难度。文章回顾了残差思想从1991年RNN到2015年ResNet的演进历程,分析了残差网络解决梯度消失、参数更新等问题的机制,并对比了ResNet-18/34/50等不同版本。尽管残差网络存在对BN依赖、架构灵活性不足等问题,但通过Pre-act原创 2026-08-09 10:32:55 · 199 阅读 · 0 评论 -
并行编程实践—cuda Tile及相关安装后续
本文记录了在Anaconda虚拟环境中使用CUDA Tile时遇到的PTX版本不兼容问题。作者在运行Numba矩阵乘法测试程序时,出现"CUDA_ERROR_UNSUPPORTED_PTX_VERSION"错误,原因是conda自动安装了最新版CUDA 13.3(支持PTX 9.3),而系统驱动仅支持PTX 9.2。通过分析环境依赖关系,发现是安装cuda-tileiras时未指定版本导致。文章详细探讨了三种解决方案:升级驱动(因硬件限制失败)、临时修改环境变量(无效)和降级CUDA版本。最终采用conda原创 2026-08-08 10:04:20 · 219 阅读 · 0 评论 -
AI和大模型——多头注意力
本文探讨了多头注意力机制与单头注意力机制的关系及其底层原理。单头注意力机制在处理单一任务时具有优势,但面对复杂现实问题时存在局限性。多头注意力通过将高维任务拆解为多个低秩子任务(如Transformer采用的8×64分块),实现了并行处理不同语义空间信息的能力,既提高了模型表现力,又通过低秩正则化减少了冗余参数。其数学原理包含线性投影、缩放点积注意力和拼接再投影三个关键步骤。这种设计体现了深度学习中的"分治"思想,在模型复杂度与计算效率间取得了平衡,使Transformer能够更全面地捕捉数据关联性,同时避原创 2026-07-26 08:11:11 · 229 阅读 · 0 评论 -
AI和大模型——对称矩阵
本文介绍了对称矩阵的定义、性质及其在AI与大模型中的应用。对称矩阵满足转置等于自身(A=A^T),具有存储高效、特征值为实数、可正交对角化等特性。其应用包括无向图表示、距离计算及二次型处理等。在AI领域,对称矩阵优化了Transformer的自注意力机制、模型微调策略(如LoRA)及训练效率,同时增强模型可解释性。文末提供了C++实现对称矩阵存储的示例,强调数学理论结合实际应用的价值,指出对称矩阵是大模型技术的重要数学基础。原创 2026-07-22 11:06:07 · 182 阅读 · 0 评论 -
AI和大模型——梯度散度和旋度
本文介绍了标量、向量及其函数的基本概念,以及偏导数、梯度、散度和旋度等数学工具。标量只有大小,向量兼具大小和方向;标量场和向量场分别由标量函数和向量函数描述。梯度(∇f)将标量场转为向量场。散度(∇⋅v)通过点积运算衡量扩散程度,应用于AI的概率分布差异分析;旋度(∇×v)通过叉积运算描述旋转程度,用于非梯度学习等新领域。理解这些数学概念对深入AI技术至关重要。原创 2026-07-19 07:44:02 · 210 阅读 · 0 评论 -
AI和大模型——扩展模型
本文介绍了AI生成内容(AIGC)的核心技术扩散模型。AIGC主要依靠生成对抗网络、扩散模型和大语言模型等技术实现内容创作。扩散模型通过正向扩散(逐步加噪)和反向去噪(还原数据)的过程生成高质量内容,适用于图像、视频、音频及3D建模等多个领域。虽然扩散模型具有生成质量高、可控性强等优点,但也存在计算成本高、随机性影响等缺点。主流工具包括Hugging Face Diffusers和ComfyUI等。随着AI技术普及,开发者需要深入理解底层技术,为用户提供更便捷的AIGC应用。原创 2026-07-14 08:38:35 · 235 阅读 · 0 评论 -
AI和大模型——AI应用发展过程
在前面介绍了很多AI大模型相关的知识点和概念,那么如何正确的理解它们并把它们整合起来从而更容易的理解其在应用中的作用呢?在前面已经对它们进行了横向的说明和分析,下面就对AI大模型的应用纵向发展综合分析一下。通过上面的分析,有过编程经验的会不会发现,它和编程语言如展过程中的单体程序到库到框架、各种数据接口和访问标准、状态机和自动机等有着类似的发展经历。也就是说,不管技术如何进步,技术处理人类问题的思想始终保持着同一个流程,这就明白为什么总是反复强调编程思想重要的原因了吧。原创 2026-07-11 08:16:32 · 202 阅读 · 0 评论 -
AI和大模型——稀疏矩阵
摘要: 稀疏矩阵是指非零元素占比极低(通常<5%)的矩阵,其在AI和大模型中应用广泛。其特点包括数据分布稀疏、存储空间高效(需专用压缩格式)、计算复杂度低(可忽略零元素)以及适合并行计算。常见的存储格式有COO(坐标列表)、CSR(压缩稀疏行)、CSC(压缩稀疏列)和LIL(列表格式),分别适用于不同场景(如CSR适合科学计算,COO便于构建)。在AI领域,稀疏矩阵用于图像处理、自然语言表示(如邻接矩阵)和模型运算(如LoRA降维)。文中还提供了C++实现的COO格式稀疏矩阵示例,支持添加、转置和矩阵相加等原创 2026-07-09 10:30:20 · 154 阅读 · 0 评论 -
AI和大模型——Skills如何使用
本文探讨了AI Agent中Skill的概念与应用。Skill是为Agent提供标准化程序化控制的功能模块,包含元数据、指令和资源三要素。文章指出Skill调用的关键在于完善描述信息,包括精准匹配AI需求、控制描述长度和明确资源路径。在编写Skill方面,重点列举了9类适用场景,如API调用、自动化流程和运维管理等,强调应避免简单重复内容。高级应用技巧包括状态保持、脚本调用和钩子机制。最后提醒开发者应合理利用现有Skill资源,避免过度开发造成浪费。原创 2026-07-07 10:44:08 · 747 阅读 · 0 评论 -
数据结构—表
本文探讨了数据结构的发展与应用,指出随着编程技术的进步,数据结构虽不断创新但本质仍是数据关系的抽象。文章重点分析了表结构,将其分为线性表(如链表、数组)、哈希表(通过哈希函数映射)和广义表(线性表的递归扩展),并强调数据结构分类应注重特性而非严格划分。线性表广泛应用于基础结构(如队列、栈)和复杂结构(如哈希表冲突处理、B+树存储)。最后通过C++广义表示例说明实现方式,并总结体系化整理基础知识有助于技术组合创新。原创 2026-07-06 10:45:49 · 287 阅读 · 0 评论 -
AI和大模型——Agent的memory
本文探讨了AI系统中记忆机制的重要性及其实现方式。文章首先类比人脑记忆功能,指出记忆是AI学习与交互的基础。针对大模型无状态机制的局限性,提出由Agent管理上下文记忆,并借鉴人类记忆分类(感觉记忆、短时记忆和长时记忆),将Agent记忆分为短期记忆、长期记忆和程序记忆三种类型。处理方式包括滑动窗口、摘要压缩和RAG向量数据库等技术组合,结合反思机制优化记忆管理。重点介绍了Mem0三层框架(智能处理层、混合存储层、精准检索层),通过动态记忆操作实现类人记忆功能。最后指出AI记忆管理仍处于发展初期,存在广阔探原创 2026-07-05 09:21:33 · 189 阅读 · 0 评论 -
数据结构——图
本文对图数据结构进行了概述,分析了图的数学定义和常见分类方式,并列举了实际应用场景。文章首先说明图的二元组定义(顶点集和边集),指出环和多重图等特殊情况。图的分类包括按方向(有向/无向)、权重(有权/无权)、连通性、顶点规模等标准。应用场景涵盖图数据库、路径规划、AI图神经网络等,但开发者实际接触较少。最后给出C++实现Dijkstra最短路径算法的示例代码,展示有向赋权图的应用。文章强调图结构虽然复杂且应用专业,但在底层算法和框架中广泛存在。原创 2026-07-02 10:56:54 · 302 阅读 · 0 评论 -
AI和大模型——AI大模型应用的整体框架
本文系统梳理了AI大模型应用开发的技术演进与框架体系。从简单的提示词工程起步,发展到包含上下文管理、工具调用、安全机制等功能的完整Agent系统,再通过任务编排实现复杂任务处理。文章重点解析了Agent框架的核心构成(如ReAct循环、RAG技术)和新兴的Harness Engineering(即Agent去除大模型后的控制部分)。当前主流开发框架已原生支持这些功能,开发者更需关注需求分析、任务拆解和规则设计。建议结合具体技术文章对比学习,全面掌握AI应用开发从底层技术到整体框架的知识体系。原创 2026-06-27 08:37:23 · 189 阅读 · 0 评论 -
AI和大模型——loop engineering
本文介绍了AI编程领域的新概念"循环工程"(loop engineering),它标志着AI编程从辅助向自主演进的关键转折。循环工程通过构建自动化工作系统,使开发者角色转变为代码架构管理者。文章分析了其核心组件:自动化处理、工作树隔离、技能库、插件连接器、多Agent协作和记忆机制。尽管循环工程能显著提升效率,但也存在开发者边缘化、任务偏离、代码质量风险和高成本等挑战。作者指出,AI编程范式仍在快速演进,开发者应保持开放思维,关注技术思想而非具体概念,以应对未来的技术变革。原创 2026-06-21 07:33:44 · 203 阅读 · 0 评论 -
AI和大模型——优化器
本文系统介绍了大模型训练中的优化器技术。首先解析了优化器的核心机制:动量(一阶矩)减少梯度震荡,自适应学习率(二阶矩)为不同参数设置个性化更新步长,权重衰减防止过拟合。重点分析了Adam和AdamW优化器,它们融合动量和自适应学习率,成为主流选择,但在训练后期可能需切换至SGD进行精细调优。文章还对比了SGD的随机梯度下降特性及优缺点,并概述了二阶方法、符号搜索、内存高效和基于矩阵的新型优化器。整体呈现了大模型优化技术的发展脉络和关键权衡,为理解这一复杂领域提供了清晰框架。原创 2026-06-20 07:42:52 · 180 阅读 · 0 评论 -
AI和大模型——上下文工程
本文探讨了上下文工程(Context Engineering)在大模型应用中的关键作用。上下文指执行任务的所有环境条件,而上下文窗口限制要求动态管理相关信息以避免腐化。文章区分了静态上下文(系统提示、知识库等)和动态上下文(实时交互处理),后者通过数据获取、压缩和打包三步优化输入。上下文工程与提示词工程紧密相关但可独立实现,能显著提升AI的准确性、智能性和可靠性。该技术为不同应用场景提供了专业化的解决方案。原创 2026-06-19 09:16:08 · 221 阅读 · 0 评论 -
AI和大模型——提示词工程
本文探讨了提示词(Prompt)在大模型交互中的核心作用及其优化方法。提示词是与AI交互的指令,条件越具体,输出结果越准确。提示词工程旨在优化输入信息的设计,使其清晰、具体且可执行,以提高大模型响应的精准度。随着AI发展,提示词工程正朝着集成化、后台化演进,逐渐成为幕后技术,通过工具封装提升交互效率。尽管用户对其感知有限,但其重要性日益凸显,成为优化大模型应用的关键环节。未来,提示词工程可能实现自动化交互和个性化处理,进一步推动AI普及。原创 2026-06-13 08:46:32 · 213 阅读 · 0 评论 -
AI和大模型——数据预处理
本文探讨了AI大模型数据预处理的关键要点。文章指出,大模型应用的核心在于高质量数据,而非底层技术复杂度。数据预处理需要根据数据类型采用针对性方法,包括序列、文本、表格、音频、图像等10类数据的不同处理技术。作者强调应分类处理训练集、验证集和测试集以防止数据泄露,并推荐使用Pandas、Matplotlib等工具提升效率。最后提出要灵活运用预处理方法,避免僵化套用,才能真正发挥大模型的潜力。全文着重强调数据质量对大模型效果的决定性作用,为实践者提供了系统化的数据处理思路。原创 2026-06-06 09:41:47 · 229 阅读 · 0 评论 -
AI和大模型——激活函数
本文介绍了神经网络中激活函数的概念、作用及常见类型。激活函数通过引入非线性、限制输出范围和便于梯度处理,对神经网络性能至关重要。常见的激活函数包括Sigmoid(适合二分类但易梯度消失)、ReLU及其变体(计算简单但可能神经元死亡)、GeLU(解决神经元死亡问题)和Softmax(多分类任务)。选择激活函数需考虑数据特点(如正负值、对称性)和训练问题(如神经元死亡)。大模型常用GeLU和SwiGLU。理解激活函数原理有助于优化神经网络应用。原创 2026-05-30 08:31:42 · 189 阅读 · 0 评论 -
AI和大模型——梯度消失和梯度爆炸
本文探讨了深度学习中梯度消失和梯度爆炸两大核心问题。梯度消失指反向传播时梯度趋近于零,导致权重无法更新;梯度爆炸则是梯度无限增大,造成网络震荡。两者都会阻碍神经网络的有效学习。文章分析了问题成因:梯度消失多由激活函数选择不当或网络过深导致,梯度爆炸常因权重初始值过大或RNN结构引起。针对这些问题,提出了多种解决方案:更换激活函数、权重初始化、归一化技术、残差连接等通用方法,以及梯度裁剪、正则化等特定措施。最后强调理解基本原理的重要性,建议工程师根据实际需求灵活应用这些技术。原创 2026-05-23 07:02:49 · 359 阅读 · 0 评论 -
AI和大模型——梯度和梯度下降
本文介绍了梯度下降在大模型训练中的数学原理与应用。首先回顾了导数和偏导数的概念,说明如何通过调整参数最小化损失函数。接着从几何角度分析梯度方向代表函数变化最快的方向,梯度下降即沿负梯度方向小步更新参数以寻找极小值。文章详细讲解了梯度下降的三种类型(批量、随机、小批量)及常见优化器(Momentum、Adam等)的作用,指出学习率选择的重要性。最后强调数学基础对理解大模型底层机制的关键作用,梯度下降虽可能陷入局部最优等问题,但仍是训练神经网络的核心方法。原创 2026-05-16 08:24:38 · 428 阅读 · 0 评论 -
AI和大模型——Agent和函数调用
本文探讨了Agent与普通函数调用的异同。Agent作为智能代理工具,通过大模型动态调用函数,能自动推理参数和处理异常,但效率较低且难以调试;普通函数调用则固定明确,易于跟踪但灵活性不足。两者本质相同,区别在于调用方式:Agent是智能动态代理,普通函数是静态代码执行。理解其定位差异有助于正确运用这些技术,避免被表象迷惑。关键在于把握技术本质,而非被表面差异误导。原创 2026-05-13 10:43:52 · 297 阅读 · 0 评论 -
AI和大模型——拟合
本文系统阐述了机器学习中的拟合概念及其常见问题。拟合指模型通过学习数据规律实现预测或映射的能力,其质量直接影响模型泛化性能。文章重点分析了欠拟合(模型未能充分学习数据规律)和过拟合(模型过度学习噪声数据)两种现象,并分别提出解决方案:欠拟合可通过增强模型复杂度、增加训练数据等方法改善;过拟合则需采用正则化、简化模型、Dropout等技术控制。理想的"合适拟合"应达到训练集与测试集性能的平衡,表现为验证误差最低且与训练误差相近的状态。文章强调拟合是一个动态优化过程,需要根据具体场景调整模型原创 2026-05-11 07:58:33 · 376 阅读 · 0 评论 -
AI和大模型——上下文腐坏
随着AI技术的发展,提示词的重要性逐渐被更全面的"上下文"概念取代。上下文包括提示词和相关资料,理论上越详细越好,但受限于模型处理能力,过长会导致"上下文腐坏"——关键信息丢失。应对方法包括:设计固定工作流、客户端主动处理对话、拆分复杂任务、使用外部数据库等。虽然这些可能是过渡技术,但在当前阶段仍需掌握。技术发展迅速,但实用主义学习仍是必要的。原创 2026-05-05 08:27:55 · 283 阅读 · 0 评论
分享