Ollama+GGUF离线加载本地模型

一般在使用Ollama下载模型时,都是从Ollama官方仓库下载(使用ollama run命令),但一些环境下,受限于网速等原因使用这种方式可能会非常慢甚至无法下载,所以我们可以选择使用Huggingface上的GGUF文件,在Ollama仓库里的模型都可以在Huggingface上找到,因此我们可以使用Ollama+GGUF文件离线加载模型。

目录

一、获取GGUF模型文件

二、创建Modelfile文件

三、Ollama创建模型

四、Ollama运行模型


一、获取GGUF模型文件

GGUF文件是大模型训练的结果文件,在Huggingface上有官方或个人上传,我们可以登录到Huggingface进行搜索,例如搜索Qwen2,可以在Files and versions栏看到许多版本的gguf文件,它们大小不同,说明对应的模型效果也不同,一般会在README.md中有对各个版本的解释。

上述gguf文件列表中,选择其中一个自己想要的文件下载即可。文件越小,运行时,响应速度越快,精度也就越低。

二、创建Modelfile文件

下载好gguf文件后,再自己创建一个Modelfile文件,文件内容写一句话即可,主要为表示gguf模型文件的路径,路径根据自己的实际情况写。

FROM ./your-model-path.gguf 

比如我放在了同一个文件夹内,写成下面这样即可

 

三、Ollama创建模型

进行完上面的配置,就可以再Ollama中创建本地模型了,可以打开终端运行下面命令,model-name自行决定,-f后指定刚刚创建Modelfile的路径

ollama create model-name -f Modelfile

创建成功后可以使用下面命令检查Ollama中是否已有模型。

Ollama list

四、Ollama运行模型

创建模型成功后就可以在运行起来了

ollama run model-name

  • 6
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

丹牛Daniel

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值