Bilibili首次发布 Index 系列模型中的轻量版本:Index-1.9B 系列
本次开源的 Index-1.9B系列包含以下模型:
Index-1.9Bbase:基座模型,具有 19 亿 非词嵌入参数量,在 2.8T 中英文为主的语料上预训练,多个评测基准上与同级别模型比处于领先.
Index-1.9Bpure:基座模型的对照组,与 base 具有相同的参数和训练策略,不同之处在于我们严格过滤了该版本语料中所有指令相关的数据,
以此来验证指令对 benchmark 的影响
Index-1.9Bchat:基于 index-1.9B base 通过 SFT 和 DPO 对齐后的对话模型,我们发现由于预训练中引入了较多定向清洗对话类语料,聊天的趣味性明显更强
Index-1.9Bcharacter :在 SFT 和 DPO 的基础上引入了 RAG 来实现 fewshots 角色扮演定制
目前,我们已在 HuggingFace 和 ModelScope 上同步开源。期待听到你们的使用反馈!
开源网址,模型下载请到喜好儿网查看