Ollama+GGUF离线加载本地模型

丹牛Daniel

已于 2024-10-20 09:58:46 修改

阅读量8.6k

点赞数 22

分类专栏： Python实战人工智能教程文章标签：语言模型 nlp 机器学习 python llama

于 2024-07-30 09:59:01 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/danielxinhj/article/details/140788351

版权

Python实战人工智能教程专栏收录该内容

11 篇文章

订阅专栏

一般在使用Ollama下载模型时，都是从Ollama官方仓库下载（使用ollama run命令），但一些环境下，受限于网速等原因使用这种方式可能会非常慢甚至无法下载，所以我们可以选择使用Huggingface上的GGUF文件，在Ollama仓库里的模型都可以在Huggingface上找到，因此我们可以使用Ollama+GGUF文件离线加载模型。

目录

一、获取GGUF模型文件

二、创建Modelfile文件

三、Ollama创建模型

四、Ollama运行模型

一、获取GGUF模型文件

GGUF文件是大模型训练的结果文件，在Huggingface上有官方或个人上传，我们可以登录到Huggingface进行搜索，例如搜索Qwen2，可以在Files and versions栏看到许多版本的gguf文件，它们大小不同，说明对应的模型效果也不同，一般会在README.md中有对各个版本的解释。

上述gguf文件列表中，选择其中一个自己想要的文件下载即可。文件越小，运行时，响应速度越快，精度也就越低。

二、创建Modelfile文件

下载好gguf文件后，再自己创建一个Modelfile文件，文件内容写一句话即可，主要为表示gguf模型文件的路径，路径根据自己的实际情况写。

FROM ./your-model-path.gguf

比如我放在了同一个文件夹内，写成下面这样即可

三、Ollama创建模型

进行完上面的配置，就可以再Ollama中创建本地模型了，可以打开终端运行下面命令，model-name自行决定，-f后指定刚刚创建Modelfile的路径

ollama create model-name -f Modelfile

创建成功后可以使用下面命令检查Ollama中是否已有模型。

Ollama list

四、Ollama运行模型

创建模型成功后就可以在运行起来了

ollama run model-name

评论 6

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

打赏作者

丹牛Daniel 你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20

扫码支付：¥1

获取中

扫码支付

您的余额不足，请更换扫码支付或充值

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。