如何把GPT本地化,建立个人和小企业的知识库

 

 

本文阅读约需要5分钟,新手跟着实操过程约15分钟。

本文章将教大家如何建立本地的GPT,它的内核是meta不是openAI的。该模型对电脑配置需求不高,因此能力天花板也较低,但是完全能为小企业和个人所用了。学会后甚至可以直接对接小型企业,为他们打造内部知识库赚钱钱,具体对接实操容我先试试水,先和大家分享一下想法。

模型的终极能力

  1. 只要放入高质量的企业产品信息,就可以打造成小企业的知识库,该知识库可以赋予给AI客服,让AI高水平地回答咨询者的任何问题,从而降本增效。另一方面,AI回答的水平取决于知识库的丰富程度。

实操最低配置

  1. 一台运行内存至少是4G的电脑,纯看CPU。
  2. 不需要API,因为是部署在本地的,电脑上限就是模型的上限。

本地化布置过程

  1. 直接下载“软件包”:链接
  2. 下载完成后,压缩包解压到当前文件夹内,见下图。

v2-e633fd65d1bf596764c0da6ef2b5c528_1440w.webp

 

  1. 软件包内的是“7b”模型,如果想要“13b”模型,请下载这个

跑13b模型需要至少8G的运行内存,但功能会比7b更强大。

7b是70亿个参数

13b是130亿个参数

  1. 试运行模型。如果没有“终端”两字,可以到WindowStore或者网上下载一个。

v2-dec3f7033b948a1f3c778e252c5a7a6d_1440w.webp

 

  1. 终端打开后的页面如下

v2-cdb3b461dfaf8c1c3c74382b6aae3b4a_1440w.webp

 

  1. 输入“命令”到“终端”。命令格式如下:

无提示词:./main -m ggml-model-q4_0.bin --color -ins -c 2048 --temp 0.2 -n 256 --repeat_penalty 1.3 -t (此处删掉括号填你的CPU线程数)

有提示词:./main -m ggml-model-q4_0.bin --color -f chat.txt -ins -c 2048 --temp 0.2 -n 256 --repeat_penalty 1.3 -t (此处删掉括号填你的CPU线程数)

  1. 命令示范(无提示词):

v2-f8d5f56aac56007c50ee6035f4be2bec_1440w.webp

v2-88c06a64bfc9903e2356bbf9b255bad6_1440w.webp

 

  1. 【重点】⭐命令示范(有提示词):(演示用的是7b模型)

v2-0fdaed8c00bb76b34ad8fcd30b24b646_1440w.webp

 

  1. 喂内容!例如我需要输入《财务管理办法》里的内容,则需要手动复制粘贴进“chat.txt”里面保存。

v2-389d4aa93b1fc7fa5e1c0d601f61b9dd_1440w.webp

 

  1. 输入完毕后,让我们再来打开终端,输入“命令”来问问他。看起来还可以。

v2-bd5ca7e28c6f1018ce3a1576d390df17_1440w.webp

 

  1. 存在缺陷:答非所问,可能是模型参数太少的缘故。

v2-c81e55b4451545e95922cc930f6dc1dd_1440w.webp

 

  1. 缺陷二:初次进入,模型需要遍历一遍你的知识库,换而言之,知识库越大,读取时间越长。
  2. 缺陷三:毕竟是本地模型,理解能力有限,需要较高的prompt水平才能较好的驾驭模型

“命令”里可携带的参数

命令指的是

无提示词:./main -m ggml-model-q4_0.bin --color -ins -c 2048 --temp 0.2 -n 256 --repeat_penalty 1.3 -t (此处删掉括号填你的CPU线程数)

有提示词:./main -m ggml-model-q4_0.bin --color -f chat.txt -ins -c 2048 --temp 0.2 -n 256 --repeat_penalty 1.3 -t (此处删掉括号填你的CPU线程数)

-ins 启动类ChatGPT对话交流的运行模式

-f 指定prompt模板,alpaca模型请加载prompts/alpaca.txt

-c 控制上下文的长度,值越大越能参考更长的对话历史(默认:512)

-n 控制回复生成的最大长度(默认:128)

-b 控制batch size(默认:8),可适当增加

-t 控制线程数量(默认:4),可适当增加

--repeat_penalty 控制生成回复中对重复文本的惩罚力度

--temp 温度系数,值越低回复的随机性越小,反之越大

--top_p, top_k 控制解码采样的相关参数

关于线程

  1. 怎么查看电脑内存:电脑内存怎么看?查看内存的详细图文教程
  2. 怎么查看电脑线程请点击:怎么查看电脑cpu核心数,线程数

往期文章回顾:

  1. AI自动帮你完成任务——小白也能实操的AgentGPT

欢迎交流!


参考文献:

  1. johnlui/chinese-alpaca-7b-and-13b-quantized at main

编辑于 2023-05-18 21:10・IP 属地安徽

 

  • 2
    点赞
  • 24
    收藏
    觉得还不错? 一键收藏
  • 1
    评论
方案是为解决特定问题或达成特定目标而制定的一系列计划或步骤。它的作用是提供一种系统性的方法,以有效地应对挑战、优化流程或实现目标。以下是方案的主要作用: 问题解决: 方案的核心目标是解决问题。通过系统性的规划和执行,方案能够分析问题的根本原因,提供可行的解决方案,并引导实施过程,确保问题得到合理解决。 目标达成: 方案通常与明确的目标相关联,它提供了一种达成这些目标的计划。无论是企业战略、项目管理还是个人发展,方案的制定都有助于明确目标并提供达成目标的路径。 资源优化: 方案在设计时考虑了可用资源,以最大化其效用。通过明智的资源分配,方案可以在有限的资源条件下实现最大的效益,提高效率并减少浪费。 风险管理: 方案通常会对潜在的风险进行评估,并制定相应的风险管理策略。这有助于减轻潜在问题的影响,提高方案的可行性和可持续性。 决策支持: 方案提供了决策者所需的信息和数据,以便做出明智的决策。这种数据驱动的方法有助于减少不确定性,提高决策的准确性。 团队协作: 复杂的问题通常需要多个人的协同努力。方案提供了一个共同的框架,帮助团队成员理解各自的职责和任务,促进协作并确保整个团队朝着共同的目标努力。 监控与评估: 方案通常包括监控和评估的机制,以确保实施的有效性。通过定期的评估,可以及时调整方案,以适应变化的环境或新的挑战。 总体而言,方案的作用在于提供一种有序、有计划的方法,以解决问题、实现目标,并在实施过程中最大化资源利用和风险管理。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值