AI大模型
文章平均质量分 74
java1234_小锋
14年Java,Python,深度学习,大数据,机器学习,AI大模型技术专家,高级讲师。南通小锋网络科技创始人,Java1234网站创始人。
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
【免费】AI智能医疗问诊平台系统(RAG+Spring AI2.0+Neo4j知识图谱+SpringBoot4+Vue3) 锋哥原创出品,必属精品
本文介绍了一个基于AI技术的智能医疗问诊平台系统,采用RAG+SpringAI2.0+Neo4j知识图谱+SpringBoot4+Vue3技术栈。系统支持患者、医生和管理员三端功能,包括AI多轮问诊、症状图谱推理、预约挂号等。后端使用Java17与SpringBoot4构建RESTful服务,前端采用Vue3实现。数据存储结合MySQL8、Neo4j知识图谱和本地向量库,形成混合知识底座。系统通过SSE流式输出问诊结果,并附带知识库引用和图谱候选疾病,同时提示"仅供参考"。项目源码已提供原创 2026-08-13 19:53:47 · 388 阅读 · 0 评论 -
【免费】AI智能医疗问诊平台系统((RAG+LangChain+Neo4j知识图谱+FastAPI+Vue3) 锋哥原创出品,必属精品
摘要: Java1234_小锋老师分享的“AI智能医疗问诊平台系统”基于RAG+LangChain+Neo4j+FastAPI+Vue3技术栈开发,旨在解决基层医疗资源不足问题。系统采用前后端分离架构,后端通过FastAPI提供异步接口,前端使用Vue3实现患者、医生和管理端功能。核心技术包括:MySQL存储业务数据,LangChain处理非结构化医疗文档(存储于Chroma向量库),Neo4j构建疾病-症状-药品知识图谱,通义千问大模型生成流式对话。核心功能涵盖AI问诊、症状自查、预约挂号等,支持知识库文原创 2026-08-12 22:07:00 · 1069 阅读 · 0 评论 -
分享一套锋哥原创的AI大模型微调训练 微博舆情分析可视化系统(pytorch2+基于BERT大模型训练微调+flask+pandas+echarts),非常Nice,界面非常好看
本文介绍了一个基于BERT大模型微调训练的微博舆情分析可视化系统。系统采用PyTorch2.x框架微调BERT-base-chinese模型实现文本情感二分类,结合Flask后端和ECharts前端进行数据可视化展示。主要功能包括:微博数据爬取、中文分词处理、基于BERT的情感分析模块,以及多维度可视化图表展示。系统实现了从数据采集、处理到舆情分析和可视化的完整流程,为微博舆情监测提供了有效解决方案。源码已开源分享。原创 2026-02-24 19:10:58 · 1214 阅读 · 0 评论 -
【AI大模型舆情分析】微博舆情分析可视化系统(pytorch2+基于BERT大模型训练微调+flask+pandas+echarts) 实战(下)
本教程详细介绍了基于BERT大模型的微博舆情分析系统开发过程。主要内容包括:1)使用8000条训练数据和2000条测试数据构建自定义数据集;2)通过BERT分词器对文本进行编码处理;3)在BERT模型基础上添加全连接层实现二分类任务;4)采用3轮训练微调模型,准确率从78%提升至92%;5)将训练好的模型封装成接口,替换原有snowNLP分析模块;6)优化批量处理逻辑提高系统响应速度。实验表明,基于BERT微调的方法显著提升了舆情分析的准确性。教程提供了完整代码实现和训练评估过程。原创 2026-02-02 16:50:01 · 1544 阅读 · 0 评论 -
【AI大模型舆情分析】微博舆情分析可视化系统(pytorch2+基于BERT大模型训练微调+flask+pandas+echarts) 实战(上)
本文介绍了基于BERT大模型的微博舆情分析可视化系统开发实战。系统采用PyTorch2+Flask+Pandas+Echarts技术栈,将原有基于SnowNLP的舆情分析升级为基于BERT微调的二分类模型,显著提升分析准确率。主要内容包括:BERT模型环境配置(PyTorch、transformers库)、情感分析功能封装、绝对路径配置优化、以及可视化模块改造。通过AutoModel自动模型方式实现微博内容和热词的情感分析,并集成到原有系统的柱状图、树形图和饼状图可视化展示中。项目提供了完整视频教程和源码下原创 2026-02-01 18:29:10 · 861 阅读 · 0 评论 -
【AI大模型面试题】假设你需要为一个资源有限的场景(如单张消费级GPU)部署一个百亿参数的大模型,你会考虑哪些技术来使其可行且高效?
摘要:在单张消费级GPU上部署百亿参数大模型需采用多种优化技术,包括:1)模型压缩(剪枝、量化和知识蒸馏);2)分层分拆与稀疏表示;3)混合精度训练和算子融合;4)动态计算图与增量学习;5)选用高效模型架构。这些方法通过减少计算量、优化存储和提升计算效率,使大模型在资源受限环境下保持可行性。关键在于根据实际需求灵活组合技术方案,在性能和资源消耗间取得平衡。原创 2026-01-23 22:11:06 · 327 阅读 · 0 评论 -
【AI大模型面试题】在训练超大规模语言模型(如千亿参数级别)时,除了显存限制,最主要的训练挑战是什么?
训练千亿参数级语言模型面临多重挑战:计算资源管理需优化GPU/TPU集群效率并降低通信开销;海量数据处理要求保障数据质量与加载速度;分布式训练涉及复杂的同步机制和网络优化;模型优化需解决超大参数空间的收敛问题;硬件与框架兼容性、超参调优及增量学习都增加复杂度;此外还需考虑能源消耗等可持续发展问题。这些挑战共同构成了超大规模模型训练的技术壁垒。原创 2026-01-23 22:09:05 · 305 阅读 · 0 评论 -
基于GPT-2通用文本模型全量微调训练
本课程介绍如何基于HuggingFace Transformers进行GPT-2中文模型的全量微调训练。使用60万条对联数据集,通过自定义Dataset类加载数据,利用AutoTokenizer进行文本编码。采用AutoModelForCausalLM加载预训练模型,在3轮训练中优化模型参数,实现对联生成功能。训练过程中监控损失和准确率,每1000批次保存模型权重。测试结果显示模型已初步具备对联生成能力,但存在生僻词处理问题。课程涵盖从数据准备、模型训练到评估的完整流程,是AI大模型应用开发的实用入门指南。原创 2026-01-22 22:52:16 · 1634 阅读 · 0 评论 -
基于GPT-2文本生成模型微调 - GPT-2中文文本生成模型实例
本文介绍了基于GPT-2中文文本生成模型的多种应用实例,包括通用文本、古文、对联、古典诗词和歌词创作生成。通过HuggingFace的Transformers库,详细展示了加载预训练模型、设置生成参数(如max_length、temperature等)以及解码输出的完整流程。每个实例都提供了可运行的Python代码示例,演示了如何针对不同场景(如输入"床前明月光"生成古诗)进行文本生成。这些示例涵盖了从基础文本生成到特定领域(如对联、歌词)的应用,展示了GPT-2模型在中文文本生成方面的原创 2026-01-21 21:47:26 · 269 阅读 · 0 评论 -
基于GPT-2文本生成模型微调 - GPT-2模型简介
《AI大模型应用开发入门》课程介绍HuggingFace与Transformers生态,重点讲解GPT-2模型的应用。GPT-2是OpenAI基于Transformer架构开发的文本生成模型,具有15亿参数,支持无监督预训练和微调。课程涵盖5个中文GPT-2变体:通用文本(gpt2-chinese-cluecorpus)、古文(gpt2-chinese-ancient)、对联(gpt2-chinese-couplet)、歌词(gpt2-chinese-lyric)和诗词(gpt2-chinese-poem)原创 2026-01-21 21:42:06 · 475 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 基于BERT文本分类模型微调
本文介绍了基于BERT模型进行文本分类任务的微调方法。主要内容包括:1)模型微调的概念,即在预训练模型基础上使用特定领域数据进行针对性训练;2)具体实现步骤:准备自定义数据集(8k训练+2k测试数据)、文本编码处理、定义下游任务(在BERT后添加全连接层)、模型训练和评估;3)关键技术点:冻结BERT参数、获取[CLS]标记特征、批量数据处理等。实验结果显示,经过3轮训练后模型在测试集上达到97.5%的准确率。该方法有效降低了训练成本,提升了特定任务性能,是AI大模型应用开发的实用技术。原创 2026-01-20 21:10:00 · 1465 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用datasets库加载Huggingface数据集
《HuggingFace与Transformers生态入门教程》介绍了AI大模型开发的基础知识,包括预训练模型加载、数据集处理、模型微调等。重点讲解了使用datasets库加载HuggingFace数据集的方法,演示了IMDb电影评论数据集和微博评论数据集的加载过程。教程还介绍了Parquet列式存储格式的特点,包括高效压缩、查询优化等优势。通过代码示例展示了如何从本地文件和CSV格式加载数据集,为开发者提供了AI应用开发的实用入门指导。原创 2026-01-20 20:57:48 · 362 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用Transformers加载预训练模型 - 使用AutoModel自动模式方式调用gpt2预训练模型
本文介绍了《AI大模型应用开发入门》课程内容,重点讲解HuggingFace和Transformers生态。课程涵盖预训练模型加载、自定义数据集、模型微调与评估等核心知识。以GPT-2中文模型为例,展示了文本生成任务的实现代码,包括模型加载、参数设置和结果输出。该模型基于Transformer架构,具有强大的语言生成能力,适用于多种自然语言处理任务。原创 2026-01-19 21:09:08 · 357 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用Transformers加载预训练模型 - 使用AutoModel自动模型方式调用Bert预训练模型
《HuggingFace Transformers入门:AutoModel与Tokenizer详解》 摘要:本文介绍了HuggingFace Transformers库的核心组件AutoModel和AutoTokenizer的使用方法。AutoModel可自动加载预训练模型,支持细粒度操作,适合研究人员和开发者;而pipeline则更适合快速应用。通过文本分类示例,展示了从加载模型、处理输入到获取预测结果的全流程。重点解析了AutoTokenizer.encode的关键参数,包括文本处理、长度控制、张量转换原创 2026-01-19 20:38:19 · 1106 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用Transformers加载预训练模型 - 预训练模型结构文件介绍
《AI大模型应用开发入门教程》介绍了HuggingFace与Transformers生态的核心内容,包括预训练模型加载、微调、评估等关键技术。重点解析了模型文件结构:.gitattributes确保跨平台一致性;README.md提供项目说明;config.json定义模型架构参数;pytorch_model.bin/tf_model.h5存储权重;tokenizer相关文件处理文本分词。特别讲解了BERT配置参数和特殊标记(如[CLS]、[SEP])的作用,以及子词分词技术中"好"与&原创 2026-01-18 19:52:02 · 668 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用Transformers加载预训练模型 - 加载和使用预训练模型实例
《HuggingFace与Transformers入门指南》介绍了AI大模型应用开发的基础知识,重点讲解如何使用HuggingFace生态中的Transformers库。课程内容包括预训练模型加载(如Google BERT)、自定义数据集处理、模型推理与微调等核心内容。通过Pipeline API可快速实现文本分类、情感分析、命名实体识别等常见NLP任务,并详细解析了pipeline方法的各项参数配置。该课程适合开发者快速掌握Transformer模型的应用开发技能。原创 2026-01-18 19:49:03 · 891 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - 使用Transformers加载预训练模型 - cuda,cudnn,Pytorch安装
《AI大模型应用开发入门》课程介绍了HuggingFace与Transformers生态,涵盖预训练模型加载、数据集处理、模型微调与评估等内容。课程强调GPU加速的重要性,详细讲解了CUDA、cuDNN和PyTorch的安装步骤:首先通过nvidia-smi查看CUDA版本,从官网下载对应版本;然后安装匹配的cuDNN库;最后安装支持特定CUDA版本的PyTorch。安装完成后可通过torch.cuda.is_available()验证GPU加速是否可用。该课程为AI大模型开发提供了必要的环境配置指导。原创 2026-01-17 17:41:57 · 296 阅读 · 0 评论 -
【专辑】AI大模型应用开发入门-拥抱Hugging Face与Transformers生态 - Huggingface与Transformers简介
《AI大模型开发入门:HuggingFace与Transformers生态解析》 摘要: 本文系统介绍了HuggingFace及其核心产品Transformers库的开源生态。HuggingFace作为"AI界的GitHub",提供超200万预训练模型和60万数据集,通过Transformers库简化NLP/CV/语音等多模态开发流程。文章详解其核心功能:Pipeline推理、训练器微调、文本生成等,并对比阿里巴巴ModelScope平台的中文特色。课程涵盖从模型加载、微调到部署的全流程原创 2026-01-17 17:34:58 · 1737 阅读 · 0 评论
分享