大模型
文章平均质量分 69
fly-iot
没什么大不了,一直写代码。
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
给大家推荐一个京东的智能编码工具JoyCode,免费试用,全方位提升开发效率,可以使用MinMax2.7/Kimi2.6/GLM5.1大模型,演示快速开发一个wxWidgets的计算器工具
JoyCode是一款面向企业级开发的智能编码工具,通过AI技术实现代码仓库的深度解析和业务需求理解。其核心功能包括上下文引擎、规约编程和多智能体协同,支持复杂业务场景开发。工具提供免费试用,兼容主流大模型,并能自动生成完整项目代码(如wxWidgets计算器应用)及技术文档。典型应用案例展示了从需求分析到代码实现的完整流程,支持C++17、跨平台开发,包含详细的构建说明和项目结构规范。该工具显著提升了企业级软件开发的效率和质量。原创 2026-05-07 16:26:18 · 1172 阅读 · 0 评论 -
【MiniMax】超级简单!使用MiniMax2.7运行Claude Code不用登陆,创建一个wxWidgets实现的c++计算器,支持国产大模型速度快还稳定
摘要:本文介绍了MiniMax大模型的技术优势及一个基于wxWidgets的计算器项目。MiniMax M2采用MoE架构,激活100亿参数,价格仅为Claude Sonnet 4.5的8%,在多模态任务中表现优异。计算器项目使用C++17和wxWidgets框架,实现了四则运算、平方开方等功能,采用GTK3界面,包含完整的UI设计、状态管理和错误处理。项目通过CMake构建,代码结构清晰,详细说明了环境配置、编译步骤和关键技术实现。相关资源链接和演示视频已提供。原创 2026-05-06 00:08:40 · 1229 阅读 · 0 评论 -
【DeepSeek-V4+claude】AI太厉害了,使用DeepSeek-V4+claude开发一个简单的浏览器,使用webkit+wxWidgets框架C++代码实现,通过实战项目掌握claude
wxBrowser是一款基于wxWidgets 3.2和WebKit2的C++浏览器应用。采用GTK3界面框架,支持现代网页浏览功能,包括导航按钮、地址栏输入、开发者工具等核心功能。项目通过CMake构建,主要依赖wxWidgets、webkit2gtk等库。技术亮点包括WebKit2设置初始化、新窗口处理机制和开发者工具集成,通过wxWebView封装WebKitWebView实现跨平台网页渲染。该浏览器支持动态和静态两种编译方式,适合作为轻量级浏览器开发参考。原创 2026-04-25 23:48:39 · 485 阅读 · 0 评论 -
【deepseek-v4+Claude Code】,使用最新的deepseek-v4-pro运行Claude Code不用登陆,直接用,创建一个c++demo,速度快还更加方便。支持国产大模型快还稳定
本文档介绍DeepSeek Coding Agents的接入方法,支持Claude Code和OpenCode两种方式。配置步骤包括:1)获取DeepSeek API Key;2)对于Claude Code,需安装npm包并设置环境变量;3)对于OpenCode,需升级到v1.14.24+版本后配置DeepSeek连接。文档提供了详细的环境变量设置示例和操作命令,并强调了使用最新版本和正确API Key的重要性。两种方式最终都能接入DeepSeek-V4-Pro模型进行开发。原创 2026-04-25 21:27:53 · 2373 阅读 · 0 评论 -
【TradingAgents-CN】(1):基于多智能体LLM的中文金融交易框架 - TradingAgents中文增强版,演示docker-compose启动,配置deepseek模型,超级推荐!!
本文介绍了一个基于多智能体LLM的中文金融交易学习框架TradingAgents中文增强版。该项目采用混合许可证模式,核心功能包括多智能体分析、A股支持、专业报告导出等,定位为AI金融技术的学习研究平台。项目通过Docker容器化部署,提供完整的中文本地化支持,并包含学习中心帮助用户掌握多智能体交易框架。文章展示了系统配置界面、股票分析报告示例及可视化图表功能,同时说明每次股票分析约消耗0.18元。该项目基于Tauric Research团队的开源框架开发,强调合规使用,禁止未经授权的商业用途。原创 2026-04-23 01:36:02 · 867 阅读 · 0 评论 -
【AI开源助手】使用golang开源的项目PicoClaw,支持本地运行启动快,占用资超级少,支持各种Linux开发板子,可以做成个人家庭助手
PicoClaw项目发布:超轻量级AI助手 PicoClaw是一款开源AI助手项目,核心优势在于极致的轻量化设计:内存占用<10MB,成本低至10美元硬件即可运行,1秒内闪电启动。支持跨平台单二进制运行,95%核心代码由AI生成并人工优化。相比同类产品OpenClaw和NanoBot,PicoClaw在资源占用和性价比方面优势显著。 项目提供多平台支持,内置丰富的领域服务,用户可通过简单配置连接包括GLM4.7在内的多种大模型API。开发者可快速部署体验,项目地址:https://github.com原创 2026-03-04 08:07:35 · 1176 阅读 · 0 评论 -
发现一个大模型股票分析软件,AlphaBot - 你的智能股票分析助手,也是开源项目
AlphaBot是一款AI股票分析软件,提供开源代码和在线演示。项目采用Docker-Compose快速部署方案,包含后端API服务(FastAPI)、Redis缓存、Celery任务队列和Next.js前端四个容器。用户可通过Docker一键搭建完整环境,实现股票数据的智能分析和可视化展示。该项目具有模块化架构、AI任务队列等亮点,适合开发者学习金融科技与人工智能的融合应用。原创 2025-06-05 06:40:07 · 1808 阅读 · 0 评论 -
【股票系统】使用deepseek运行ai-hedge-fund人工智能的对冲基金的开源项目,有了GUI界面,可以支持拖拽展示了,还是非常方便的
《AI量化对冲基金开源项目实践》介绍了基于人工智能的对冲基金开源项目ai-hedge-fund。该项目采用15个智能体协同工作,包括价值投资、增长投资、逆向投资等策略智能体,以及估值、情绪、技术分析等分析模块。文章详细说明了项目部署过程,包括Docker容器启动、前端文件大小写问题修复等解决方案。通过NVIDIA股票分析案例展示了多策略并行研判功能,可视化界面可清晰查看各智能体的分析结论。该项目作为教育用途的AI金融实验平台,虽不适合实际交易,但为量化投资策略研究提供了有价值的参考框架,体现了AI在金融分析原创 2025-06-05 05:57:49 · 2531 阅读 · 1 评论 -
【股票系统】deepseek运行ai-hedge-fund人工智能的对冲基金的开源项目,系统汉化,分析A股改造,API替换成akshare库,实现A股的股票分析需要6个函数
该项目是一个基于人工智能的对冲基金系统,旨在通过多个智能体协同工作,模拟不同投资策略进行股票交易决策。系统包含15个智能体,分别代表不同的投资理念,如价值投资、增长投资、逆向投资等。项目目前处于教育用途,不适用于实际交易。为了适应A股市场,需要对系统进行汉化和API改造,主要涉及汉化核心文件和替换8个数据获取方法,如获取价格数据、财务指标、内幕交易等。改造后的系统将使用A股数据源,如akshare库,以支持A股市场的分析和交易模拟。原创 2025-05-11 16:52:25 · 4304 阅读 · 0 评论 -
【股票系统】使用docker本地构建ai-hedge-fund项目,模拟大师炒股进行分析。人工智能的对冲基金的开源项目
目前项目依赖金融数据,只能分析美股。可以使用 deepseek 大模型。原创 2025-04-26 22:22:32 · 2678 阅读 · 0 评论 -
在autodl上使用,通义千问2-VL-7B-Instruct,识别图片,比第一代识别的内容更加详细了,还可以识别到背景中的文字了。
默认上 xinf 也支持。但是运行报错。其实也可以按照官方文档的方式去研究部署。估计是代码中参数没有配置对:内存不够造成的了。原创 2024-12-09 08:18:48 · 912 阅读 · 0 评论 -
【xinference】(19):在L40设备上通过Xinference框架,快速部署CogVideoX-5b模型,可以生成6秒视频,速度比409D快一点
速度不算太快,也需要快6分钟了。比4090D要快一点点。原创 2024-09-08 16:39:54 · 1050 阅读 · 0 评论 -
【xinference】(18):在autodl上使用4090设备,通过Xinference框架,快速部署CogVideoX-5b模型,可以生成6秒视频,效果还可以,只支持英文。速度6分钟
开源的模型发展的速度还是挺快的。还是可以做制作一些有意思的视频的。原创 2024-09-08 09:50:54 · 1511 阅读 · 0 评论 -
【xinference】(14):在compshare上,安装nvidia-docker工具,成功启动推理框架xinference-gpu的docker镜像,并运行大模型,非常简单方便!
Compshare GPU算力平台隶属于UCloud,专注于提供高性价4090算力资源,配备独立IP,支持按时、按天、按月灵活计费,支持github、huggingface访问加速。【xinference】(14):在compshare上,使用nvidia-docker方式,成功启动推理框架xinference,并运行大模型,非常简单方便。然后就可以通过界面启动模型了,支持大语言模型,embedding模型,rerank等。UCloud(优刻得)是中国知名的中立云计算服务商,科创板上市,中国云计算第一股。原创 2024-07-06 22:06:16 · 2914 阅读 · 0 评论 -
【LocalAI】(13):LocalAI最新版本支持Stable diffusion 3,20亿参数图像更加细腻了,可以继续研究下
SD3 Medium 可以根据用户输入的文本描述,重点克服了文生图模型中手部和脸部的挑战,生成足以乱真的的图像。SD3 Medium 还利用其底层的 Diffusion Transformer 架构,高精度地整合了文字元素。根据介绍,Stable Diffusion 3 Medium 模型规格参数达到了 20 亿,可以给用户带来更真实的图片体验。目前用户可以从 Hugging Face 上下载该模型。Stable Diffusion 3 Medium 正式开源。原创 2024-06-23 22:41:03 · 909 阅读 · 0 评论 -
【xinference】(12):目前最全大模型推理框架xinference,发布0.12.2版本,支持qwen2,glm4等主流大模型推理运行,可以对外提供标准的openai的API接口做服务
可用于大语言模型(LLM),语音识别模型,多模态模型等各种模型的推理。无论你是研究者,开发者,或是数据科学家,都可以通过 Xorbits Inference 与最前沿的 AI 模型,发掘更多可能。进行推理,降低延迟,提高吞吐!🌟 模型推理,轻而易举:大语言模型,语音识别模型,多模态模型的部署流程被大大简化。支持分布式部署,通过内置的资源调度器,让不同大小的模型按需调度到不同机器,充分使用集群资源。前沿模型,应有尽有:框架内置众多中英文的前沿大语言模型,包括 baichuan,chatglm2。原创 2024-06-23 22:22:12 · 1975 阅读 · 0 评论 -
【xinference】(11):在compshare上使用4090D运行xinf和chatgpt-web,部署大模型GLM-4-9B大模型,占用显存18G,速度不错,也挺智能的。
GLM-4-9B 是智谱 AI 推出的最新一代预训练模型 GLM-4 系列中的开源版本。在语义、数学、推理、代码和知识等多方面的数据集测评中,GLM-4-9B 及其人类偏好对齐的版本 GLM-4-9B-Chat 均表现出较高的性能。本代模型增加了多语言支持,支持包括日语,韩语,德语在内的 26 种语言。【xinference】(11):在compshare上使用4090D运行xinf和chatgpt-web,部署大模型glm4-9B-chat大模型,显存18G。是python3.12 版本造成的。原创 2024-06-07 08:55:56 · 1941 阅读 · 0 评论 -
【compshare】(4):使用UCloud(优刻得)的compshare算力平台,新增加Llama-factory镜像,可以快速启动,非常方便,部署特别简单,效果不错,不用担心HF网络问题
库少了几个,可以向 compshare 反馈下。可以选择中文,进行参数修改。安装完成缺少的 包之后,就可以启动成功了。原创 2024-06-05 22:28:11 · 748 阅读 · 0 评论 -
【compshare】(3):使用UCloud(优刻得)的compshare算力平台,新增加SD-webui和大模型镜像,可以快速启动,非常方便,部署特别简单...
新的镜像不错,简化了部署使用,更加的方便了。可以很快的搭建SD和大模型的平台了。原创 2024-06-05 09:40:25 · 1009 阅读 · 0 评论 -
【xinference】(10):在autodl上运行xinf和chatgpt-web配置联动,xinf运行qwen-1.5大模型做api后端,使用国内源解决nodejs安装问题。本地运行大模型方法
【xinference】(10):在autodl上运行xinf和chatgpt-web配置联动,xinf运行qwen-1.5大模型做api后端。前端使用chatgpt-web,后端使用xinference 项目做api。第二个是 service ,里面有nodejs的服务接口。配置好环境变量就可以使用 npm 安装了。第一个是web 在当前目录。然后就可以启动成功了。原创 2024-05-31 07:20:39 · 953 阅读 · 0 评论 -
特别推荐!在modelscope上可以使用免费的CPU和限时的GPU啦,成功安装xinference框架,并部署qwen-1.5大模型,速度7 tokens/s
在modelscope上可以使用免费的CPU和限时的GPU啦,成功安装xinference框架,并部署qwen-1.5大模型,速度7 tokens/s空闲的时候,会被删除掉。数据不会被保存!单次最长10个小时使用!!原创 2024-05-29 09:02:15 · 1705 阅读 · 0 评论 -
【compshare】(1):推荐UCloud(优刻得)一个GPU按小时租的平台,使用实体机部署,可以方便快速的部署xinf推理框架并提供web展示,部署qwen大模型,特别方便
专注于提供高性价比算力资源,海量GPU,一键部署,即算即用,让AI训练、深度学习、科研计算效率翻倍。需要选择 ubuntu 版本,可以支持最高 12.4 的cuda驱动。测试qwen 大模型速度。因为运行的方式不一样,不使用了需要删除应用。但是界面启动后需要等待下驱动安装。模型之能运行一个,重启再运行即可。下载速度还是非常快的。否则还是会产生费用。是独享的模型创建的。原创 2024-05-26 20:40:08 · 1684 阅读 · 0 评论 -
【LocalAI】(12):本地使用CPU运行LocalAI,测试研究,语音模型已经切换到了hugging faces上了,测试zh_CN-huayan-medium.onnx中文合成成功!!
【代码】【LocalAI】(12):本地使用CPU运行LocalAI,一次运行5个能力,embedding模型,qwen-1.5-05b模型,生成图模型,语音转文字模型,文字转语音(只支持英文)原创 2024-05-18 22:06:00 · 2121 阅读 · 0 评论 -
【LocalAI】(11):本地使用CPU运行LocalAI,一次运行5个能力,embedding模型,qwen-1.5-05b模型,生成图模型,语音转文字模型,文字转语音(只支持英文)
【代码】【LocalAI】(11):本地使用CPU运行LocalAI,一次运行4个大模型,embedding模型,qwen-1.5-05b模型,生成图模型,语音转文字模型。原创 2024-05-18 16:57:49 · 1473 阅读 · 0 评论 -
【OrangePi】(1):香橙派联合华为精心打造OrangePi AIpro(8T)的硬件,搭载昇腾AI芯片,8TOPS算力...
树莓派4,上面的ollama qwen 大模型测速,0.5b速度 9.6 words/s,1.8b速度 2.8 words/s。硬件还是不错的,也是arm的芯片。理论上可以支持 localai的代码运行。不知道 OrangePi AIpro(8T) 的性能咋样了。香橙派联合华为精心打造,建设人工智能新生态。ubuntu使用的是22.03 的镜像。原创 2024-05-07 23:26:33 · 660 阅读 · 0 评论 -
【LocalAI】(10):在autodl上编译embeddings.cpp项目,转换bge-base-zh-v1.5模型成ggml格式,本地运行main成功
LocalAI的项目里面的embedding 是 bert embedding.不支持BGE 模型,有大神给改造支持了BGE的模型了。原创 2024-05-01 13:27:47 · 955 阅读 · 0 评论 -
【LocalAI】(9):本地使用CPU运行LocalAI,一次运行4个大模型,embedding模型,qwen-1.5-05b模型,生成图模型,语音转文字模型
【LocalAI】(9):本地使用CPU运行LocalAI,一次运行4个大模型,embedding模型,qwen-1.5-05b模型,生成图模型,语音转文字模型。它允许您在本地使用消费级硬件运行 LLM(不仅如此),支持与 ggml 格式兼容的多个模型系列。支持CPU硬件/GPU硬件。LocalAI 是一个用于本地推理的,与 OpenAI API 规范兼容的 REST API。替换了镜像里面的aio 文件夹。把模型都使用国内镜像进行下载地址替换了。使用了modescope 下载地址。原创 2024-05-01 12:44:21 · 2622 阅读 · 0 评论 -
【LocalAI】(6):在autodl上使用4090部署LocalAIGPU版本,成功运行qwen-1.5-32b大模型,占用显存18G,速度 84 tokens / s
【LocalAI】(6):在autodl上使用4090部署LocalAIGPU版本,成功运行qwen-1.5-32b大模型,占用显存18G,速度 84t/s。它允许您在本地使用消费级硬件运行 LLM(不仅如此),支持与 ggml 格式兼容的多个模型系列。支持CPU硬件/GPU硬件。LocalAI 是一个用于本地推理的,与 OpenAI API 规范兼容的 REST API。24G的显存占用了 18G,同时速度还可以。配置成功之后就可以启动了。原创 2024-04-20 23:55:23 · 2895 阅读 · 1 评论 -
【LocalAI】(5):在autodl上使用4090Ti部署LocalAIGPU版本,成功运行qwen-1.5-14b大模型,占用显存8G,原来是cuda-11版本的原因
cuda的硬件版本是 12.4 比如 4090D 的,可以使用local-ai-cuda12-Linux-x86_64 版本。其他的情况,比如 cuda 是12.2 或这 11.8 的情况。就只能使用local-ai-cuda11-Linux-x86_64 的版本了。原创 2024-04-20 16:45:49 · 1102 阅读 · 0 评论 -
【LocalAI】(3):LocalAI本地使用Model gallery,对qwen模型进行配置,使用modescope源下载,本地运行速度快。特别简单!
在linux上使用一个二进制文件,成功运行embeddings和qwen-1.5大模型,速度特别快,有gitee配置说明。它允许您在本地使用消费级硬件运行 LLM(不仅如此),支持与 ggml 格式兼容的多个模型系列。支持CPU硬件/GPU硬件。LocalAI 是一个用于本地推理的,与 OpenAI API 规范兼容的 REST API。本身localai的后端实现就是 llama.cpp ,所以也可以支持qwen大模型。modelscope.cn 进行下载,速度会更快。支持gguf的量化版本。原创 2024-04-09 09:07:38 · 2465 阅读 · 0 评论 -
【LocalAI】(3):终于研究明白了!超级简单!在linux上使用一个二进制文件LocalAI,成功运行embeddings和qwen-1.5大模型,速度特别快,有gitee配置说明
【LocalAI】(3):超级简单!在linux上使用一个二进制文件,成功运行embeddings和qwen-1.5大模型,速度特别快,有gitee配置说明。它允许您在本地使用消费级硬件运行 LLM(不仅如此),支持与 ggml 格式兼容的多个模型系列。支持CPU硬件/GPU硬件。LocalAI 是一个用于本地推理的,与 OpenAI API 规范兼容的 REST API。原创 2024-04-09 09:00:21 · 1982 阅读 · 0 评论 -
【xinference】(8):在autodl上,使用xinference部署qwen1.5大模型,速度特别快,同时还支持函数调用,测试成功!
可用于大语言模型(LLM),语音识别模型,多模态模型等各种模型的推理。通过 Xorbits Inference,你可以轻松地一键部署你自己的模型或内置的前沿开源模型。无论你是研究者,开发者,或是数据科学家,都可以通过 Xorbits Inference 与最前沿的 AI 模型,发掘更多可能。借助 Xinference,您可以使用任何开源 LLM、嵌入模型和多模态模型在云端或本地环境中运行推理,并创建强大的 AI 应用。然后就可以查看全部支持的模型进行启动。启动Xinference服务。原创 2024-04-02 23:00:42 · 2431 阅读 · 1 评论 -
【xinference】(7):在autodl上,使用xinference一次部署embedding,rerank,qwen多个大模型,兼容openai的接口协议,超级棒的方案
Xorbits Inference (Xinference) 是一个开源平台,用于简化各种 AI 模型的运行和集成。借助 Xinference,您可以使用任何开源 LLM、嵌入模型和多模态模型在云端或本地环境中运行推理,并创建强大的 AI 应用。【xinference】(7):在autodl上,使用xinference一次部署embedding,rerank,qwen多个大模型,兼容openai的接口协。在autodl上下载项目主要是安装。启动访问之后可以进行安装各种软件了。启动Xinference服务。原创 2024-04-02 22:36:55 · 8443 阅读 · 2 评论 -
【ai技术】(4):在树莓派上,使用qwen0.5b大模型+chatgptweb,搭建本地大模型聊天环境,速度飞快,非常不错!
特别注意是 docker-compose-linux-armv7 版本,linux版本。安装docker 和 docker-compose 命令。原创 2024-03-23 12:40:30 · 3707 阅读 · 0 评论 -
【ai技术】(3):使用脚本对树莓派4,上面的ollama qwen 大模型测速,0.5b速度 9.6 words/s,1.8b速度 2.8 words/s,也是非常不错了。
【代码】【ai技术】(3):使用脚本对树莓派4,上面的ollama qwen 大模型测速,0.5b速度 9.6 words/s,1.8b速度 2.8 words/s,也是非常不错了。原创 2024-03-21 22:58:45 · 2522 阅读 · 0 评论 -
【ai技术】(2):树莓派3,使用的是armv7的版本,不支持ollama安装,内存1G,推荐使用命令行界面安装,使用raspi-config配置wifi,老设备了运行不了图形界面
树莓派3,安装ollama本地运行ollama大模型,测试速度。原创 2024-03-18 09:04:09 · 1205 阅读 · 0 评论 -
【ai技术】(1):发现一个大模型可视化项目,使用nodejs编写的,llm-viz,可以本地运行展示大模型结构。
https://github.com/bbycroft/llm-viz或者镜像:https://gitcode.com/bbycroft/llm-viz.git项目 主要项目有:LLM 可视化:运行推理的 GPT 风格 LLM 网络的 3D 互动模型。 [WIP] CPU 模拟:一个带有完整执行模型的 2D 数字电路图编辑器,展示了一个简单的基于 RISC-V 的 CPU。LLM 可视化 这个项目显示了一个 GPT 风格网络的工作实现的三维模型。也就是说,这是 OpenAI 的 GPT-2、GPT-原创 2024-03-18 08:28:49 · 1402 阅读 · 0 评论 -
【ollama】(8):nvidia-docker在Nvidia Jetson Nano设备,对接chatgpt-web服务,配置成功,可以进行web聊天了,给ollama增加web界面
特别注意是 docker-compose-linux-armv7 版本,linux版本。然后安装docker 执行脚本即可。原创 2024-03-16 23:41:36 · 869 阅读 · 0 评论 -
【ollama】(7):使用Nvidia Jetson Nano设备,成功运行ollama,运行qwen:0.5b-chat,速度还可以,可以做创新项目了
【代码】【无标题】在jetson上安装 ollama。原创 2024-03-16 22:31:43 · 2870 阅读 · 2 评论 -
【ollama】(6):在本地使用docker-compose启动ollama镜像,对接chatgpt-web服务,配置成功,可以进行web聊天了,给ollama增加web界面
Ollama 是一个强大的框架,设计用于在 Docker 容器中部署 LLM。Ollama 的主要功能是在 Docker 容器内部署和管理 LLM 的促进者,它使该过程变得非常简单。它帮助用户快速在本地运行大模型,通过简单的安装指令,可以让用户执行一条命令就在本地运行开源大型语言模型,例如 Llama 2。使用ollama + chatgpt-web 实现本地大模型执行。然后访问:http://localhost:3002/ 即可。CPU 推荐使用 7b及以下版本。原创 2024-03-14 23:28:11 · 2711 阅读 · 0 评论
分享