AI大模型
文章平均质量分 84
guslegend
后端的学习者,可以加我的微信guslegend_,进入我的后端交流群,我们大家一起共同进步!
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
DeepSeek-OCR-2快速入门
OCR技术演进与多模态应用:从传统字符识别到结构化文档理解 本文系统梳理了OCR技术从传统字符识别到多模态理解的演进历程。传统OCR(1.0)基于CNN+LSTM架构,专注于文字检测与识别;而现代OCR(2.0)融合视觉Transformer、布局分析和视觉语言对齐技术,实现了语义理解和结构化输出。以GPT-4V、Gemini等为代表的多模态大模型(VLM)进一步推动了OCR向文档理解发展,使其具备解析表格、公式、图表关系等能力。文章详细对比了主流开源模型(InternVL3.5、Qwen3-VL等)的特点原创 2026-03-18 19:50:35 · 1001 阅读 · 0 评论 -
智能体Agent开发
本文介绍了智能体开发中的关键概念与技术实现。主要内容包括:1)静态模型与动态模型的区别与应用场景,静态模型适用于稳定任务,动态模型可根据上下文灵活切换;2)工具定义规范,通过@tool装饰器创建可交互功能模块;3)异常处理机制,统一拦截工具调用错误;4)提示词设计,静态提示词保持一致性,动态提示词适配不同用户需求;5)invoke方法的三种核心调用方式,支持单次任务、多轮对话和带上下文的任务执行。文章通过代码示例展示了如何在LangChain框架中实现这些功能,为构建灵活可靠的智能体系统提供了实用指导。原创 2026-01-31 15:41:34 · 1041 阅读 · 0 评论 -
LangChain提示词
摘要:本文介绍了四种LangChain提示词模板的使用方法,包括基本PromptTemplate(用于标准化文本生成)、Placeholder(处理多轮对话历史)、FewShot(通过示例引导模型输出)和FewShotChat(对话风格示例)。这些模板能有效提升开发效率,适用于产品描述、客服回复、分类任务等场景。文中提供了每种模板的代码示例和注意事项,强调变量命名一致性、特殊字符转义、示例简洁性等关键点,帮助开发者规范使用大语言模型的输入输出。原创 2026-01-30 16:47:53 · 385 阅读 · 0 评论 -
LangChain使用
本文介绍了本地和云端大模型的调用方法及选择策略。首先详细说明了如何通过Ollama和LangChain调用DeepSeek本地模型,以及如何通过API调用DeepSeek和阿里云大模型。文章对比了基础LLMs和ChatModel的特点及适用场景,LLMs适合简单问答,ChatModel支持多轮对话。同时讲解了消息格式规范、流式输出实现方法,以及如何通过工具调用扩展大模型能力。最后演示了如何定义并绑定工具函数,使大模型能够执行外部计算任务。原创 2026-01-30 12:28:08 · 1357 阅读 · 0 评论 -
Vllm框架入门与本地私有化部署
摘要:本文对比分析了三种主流大模型部署框架llama.cpp、Ollama和Vllm的特点与适用场景。Ollama凭借简易部署和跨平台支持获得最高关注度;llama.cpp以C/C++实现高性能但上手难度大;Vllm专注于GPU优化和生产环境部署,支持高效内存管理和批处理功能。文章详细介绍了Vllm的Linux部署流程,包括环境配置、模型下载方法(推荐使用ModelScope镜像源),以及离线/在线两种推理模式的具体实现方式,特别说明了远程服务器部署时的JupyterLab配置方案。原创 2026-01-27 10:30:14 · 689 阅读 · 0 评论 -
Deepseek模型在线API调用
本文介绍了如何调用DeepSeek API的详细步骤:首先需要在DeepSeek官网注册并创建API Key,然后配置系统环境变量。文章说明DeepSeek API与OpenAI兼容,只需替换base_url为DeepSeek的endpoint,并将model名称改为"deepseek-chat"。最后提供了Python代码示例,展示如何使用OpenAI SDK调用DeepSeek API获取聊天回复。整个过程包括安装依赖、初始化客户端和发送请求等关键环节。原创 2026-01-26 11:09:17 · 159 阅读 · 0 评论 -
Ollama REST API - OpenAI Compatibility
摘要:本节介绍了Ollama对OpenAI API接口的兼容实现,主要包括chat/completions、completions等核心接口。Ollama的/api/generate和/api/chat分别对应OpenAI的completions和chat/completions接口。文章展示了如何使用Python客户端进行非流式和流式调用,并详细列出了支持的API功能(如流媒体、JSON模式)和请求参数(model、messages、temperature等)。通过兼容OpenAI接口规范,Ollama简原创 2026-01-26 09:56:19 · 398 阅读 · 0 评论 -
Ollama REST API - api/chat 接口详解
例如,p=0.05 时,最可能的标记概率为 0.9,值小于 0.045 的 logits 会被过滤掉。较高的值(例如 0.95)会导致更具多样性的文本,而较低的值(例如 0.5)会生成更集中和保守的文本。较高的值(例如 100)会给出更多样化的答案,而较低的值(例如 10)会更保守。较高的值(例如 1.5)会更强烈地惩罚重复,而较低的值(例如 0.9)会更宽松。(默认:2048), 影响的是模型可以一次记住的最大 token 数量。(默认:-1,无限生成),影响模型最大可以生成的 token 数量。原创 2026-01-26 09:38:31 · 1394 阅读 · 0 评论 -
2. Ollama REST API - api/generate 接口详
摘要:本文介绍了Ollama服务的REST API端点及其使用方法,重点解析了/api/generate接口的参数配置和响应处理。文章详细说明了model、prompt等必需参数及format、stream等可选参数的设置方法,并提供了Python代码示例演示如何通过requests库调用API。同时探讨了num_ctx/num_predict参数对上下文长度和输出token数量的控制、流式输出功能的实现方式,以及通过keep_alive参数管理模型生命周期的策略。这些内容为开发者提供了与Ollama大模型原创 2026-01-25 21:53:23 · 816 阅读 · 0 评论 -
ollama本地安装与大模型与DeepSeek模型调用
Ollama本地部署DeepSeek R1模型指南 Ollama是一个开源的大模型本地运行框架,支持主流LLaMA架构模型。本文介绍了如何在Linux系统安装Ollama,并部署DeepSeek R1模型(1.5B版本)。主要内容包括:Ollama的安装方法、DeepSeek模型下载和运行命令、多GPU负载均衡配置技巧,以及REST API服务的启动和调用方式。文章还提供了解决常见问题的实用技巧,如处理模型返回结果中的<think>标签问题,以及局域网环境下的API访问配置。最后列出了常用的Ol原创 2026-01-25 21:22:41 · 1145 阅读 · 0 评论 -
第2章:提示工程特训和实战
本文系统介绍了提示词工程在大模型应用中的关键作用与实践方法。主要内容包括:1)提示词的基础概念及其重要性,指出提示词质量直接影响模型输出效果;2)专业化提示词构建方法,提出包含角色、任务、要求等要素的5层结构模型;3)多种提示调优技巧,如零样本提示、少样本提示、链式思考(CoT)和自我一致性方法;4)Prompt攻击防范措施;5)实战案例展示,包括小红书文案策划和学员辅导系统开发。文章强调通过工程化方法设计提示词可显著提升大模型性能,为AI应用开发提供实用指导。原创 2025-12-23 13:09:35 · 783 阅读 · 0 评论 -
第1章:大模型基础认知
AI 即人工智能,是模拟人类智能、让机器自主执行任务的交叉学科。大语言模型(LLM)作为 AI 核心方向,依托机器学习和深度学习,因硬件进步、算法优化等因素兴起,具备数据、规模、算力、参数量大等特点,分为开源和闭源两类,各有透明度、定制化等维度的优劣。常见大模型有 DeepSeek、通义千问、GPT 等,版本编号、参数量(如 72B)、上下文窗口(如 1M)等是其核心区分标识。大模型已赋能金融、政务等多行业,发展趋势为技术更优、应用更垂直普惠,但也面临安全、资源均衡等挑战,还可通过调用 API 实现 。原创 2025-12-22 14:04:31 · 1348 阅读 · 0 评论 -
使用DeepSeek开发小红书文案助手
本文介绍了AIAgent的理论基础与开发实践。首先对比了LLM(擅长一次性文本生成)和Agent(具备自主规划、工具使用和环境反馈能力)的区别,阐述了Agent的自主性、感知能力、行动力和目标导向特性。文章重点讲解了Agent开发流程,包括目标定义、LLM选择、架构设计、工具集成、提示词工程和记忆机制等环节。随后详细演示了基于DeepSeek平台开发Agent的具体方法,包括工具调用和ReAct范式应用,并提供了一个完整的小红书文案智能助手实现案例。该案例展示了如何通过系统提示词设计、工具定义(搜索、查询、原创 2025-12-13 15:45:56 · 625 阅读 · 0 评论 -
使用DeepSeek开发第一个RAG
本文介绍了基于DeepSeek API和RAG技术构建智能问答机器人的完整流程。主要内容包括:1) DeepSeek API开发环境的搭建,包括Python虚拟环境配置和API调用方法;2) 向量数据库原理与Milvus实战,详细讲解RAG技术中向量数据库的核心作用;3) RAG技术全流程实现,从数据预处理、嵌入模型选择到检索策略和提示工程;4) 完整的代码示例,展示如何结合DeepSeek API与Milvus向量数据库构建问答系统。文章特别强调了RAG技术在减少大模型幻觉、使用最新知识等方面的优势,并提原创 2025-12-11 18:23:49 · 795 阅读 · 0 评论
分享