虎博开源大模型Tigerbot-13B 发布

虎博发布TigerBot-13B大模型,基于Llama-2继续训练,中文能力显著增强,超过Llama-2的49%。模型在英文和中文任务中表现出色,开源并免费商用。包括TigerBot-13B-base和TigerBot-13B-chat两个版本,分别针对基础和对话能力进行优化。采用holistic training和rejection sampling fine-tune等技术,提高模型性能和训练效率。
摘要由CSDN通过智能技术生成

虎博很高兴的发布TigerBot-13B大模型,在Llama-2的基础上以虎博积累的技术和数据继续训练,不但保持了Llama-2出色的英文能力,更是在中文能力填补了Llama-2的不足,各项主流中文任务中超过Llama-2 的49%,在开源同类模型中具有竞争力。我们的理论和实验探索表明,TigerBot的训练方法,计算效率和数据达到世界上SOTA水平,本着open innovation的精神,我们将这些成果分享给大模型社区,继续开源和免费商用TigerBot-13B大模型。本次发布包括:

  • TigerBot-13B-base: 基于Llama-2-13B继续预训练300B tokens,扩充了中文词表到60K vocabulary, 并采用holistic training在预训练中直接使模型具有9成的指令完成能力。在主流英文基准测试中超过Llama-2-13B-base的7%,在中文测试中综合能力超过Llama-2-13B-base的49%,在国内主流开源基座模型中处于领先位置。

  • TigerBot-13B-chat: 基于TigerBot-13B-base用5M指令数据微调,并采用rejection sampling fine-tune对齐人类需求。在主流英文基准测试中达到Llama-2-13B-chat的 101%,在中文测试中综合能力超过Llama-2-13B-chat的47%,在国内主流开源模型中亦处于领先位置。

  • TigerBot-API: chat和summarization api 将自动升级到TigerBot-13B-chat,对科研教育用户免费,对商用开发者保持价格不变。

训练数据

为了补充Llama在中文上的不足,我们继续预训练了1TB数据,约300B tokens&#

  • 2
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

Tigerbot

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值