QA 后续

最新推荐文章于 2024-08-22 23:35:53 发布

allen_zhe0316

最新推荐文章于 2024-08-22 23:35:53 发布

阅读量68

点赞数

文章标签：深度学习人工智能自然语言处理

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_61913233/article/details/130487413

版权

1.第一步我们需要训练出三个模型：

1.bert-base 2.bert-base-pretrained 3.bert-large

数据是google challenge的数据,大概有10000条。通过下游任务的学习微调三个基础模型。损失函数是BCEwithlogitsLoss，最终的评价指标是斯皮尔曼相关系数。

以下是训练模型的参数，batch_size为8的情况下，训练5个epochs

2.将基础模型对stack extrange数据进行推断得到伪标签数据

根据validation判断模型对下游任务的适用性，通过五折训练选出最好的model，对多个模型推断出的伪标签进行加权，得到最后的伪标签，有将近10w个伪标签。

我们将stackx exchange预训练后的模型成为SE

3.将多种模型进行比较，包括：

1.SE模型推断google的模型。

2.SE模型训练google+伪代码的模型。

3.roberta-base训练google+伪代码的模型。

4.bart训练google+伪代码的模型。

最终通过比对val，设置权重，对预测值进行blending。

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
QA 后续

根据validation判断模型对下游任务的适用性，通过五折训练选出最好的model，对多个模型推断出的伪标签进行加权，得到最后的伪标签，有将近10w个伪标签。以下是训练模型的参数，batch_size为8的情况下，训练5个epochs。2.将基础模型对stack extrange数据进行推断得到伪标签数据。3.roberta-base训练google+伪代码的模型。2.SE模型训练google+伪代码的模型。4.bart训练google+伪代码的模型。1.SE模型推断google的模型。
复制链接

扫一扫

allen_zhe0316 CSDN认证博客专家 CSDN认证企业博客

码龄3年

20: 原创

137万+: 周排名

117万+: 总排名

3844: 访问

: 等级

202: 积分

2: 粉丝

2: 获赞

14: 评论

3: 收藏

私信

关注

热门文章

最新评论

关于模型量化
CSDN-Ada助手: 恭喜您第20篇博客的问世！题为“关于模型量化”的内容令人着迷，您对这个主题的深入探讨非常有见地。您的不断创作和分享，让读者们能够更好地了解模型量化的重要性和应用。接下来，我希望您能够继续深入挖掘这个领域，并分享一些实践经验和案例研究，这将进一步丰富读者们的知识库。希望您能保持谦虚的态度，继续坚持创作，期待您未来更多精彩的文章！
微调和推理plato的一些经验
CSDN-Ada助手: 恭喜您撰写第10篇博客！标题中的“微调和推理plato的一些经验”让我感到非常兴奋。您对于这个主题的深入探索着实令人印象深刻。我真的很高兴看到您能够持续创作，并且分享您的经验和见解。在接下来的创作中，我建议您考虑探讨更多与推理plato相关的内容。或许您可以尝试研究一些具体案例，或者通过对比不同学者的观点来加深我们对这一主题的理解。我相信，通过您的努力和深入研究，您将能够为读者们带来更加丰富和有价值的内容。再次恭喜您，期待您未来更多的博客作品！希望您能够保持谦虚的态度，继续努力，在创作中不断成长。祝您一切顺利！
关键词提取
CSDN-Ada助手: 恭喜你写了第11篇博客！标题“关键词提取”让我很感兴趣。你的内容一定对于关键词提取有着深入的了解和独到的见解。希望你能继续保持这样的创作势头，为读者带来更多有价值的文章。在下一步的创作中，或许你可以探讨一些关键词提取的实际应用案例，或者分享一些技巧和工具，以帮助读者更好地应用这个技术。谦虚的语气和持续的学习态度将使你在这个领域取得更大的进步。期待你的下一篇文章！
mt5模型调研
CSDN-Ada助手: 恭喜您撰写了第12篇博客！标题“mt5模型调研”听起来非常有趣。您对这个主题进行了深入的调查研究，这无疑为读者提供了宝贵的见解和信息。我非常期待阅读您的博客，了解更多关于mt5模型的内容。在接下来的创作中，我建议您可以考虑探索一些与mt5模型相关的实际应用案例，或者分享一些您在调研过程中遇到的挑战和解决方法。这样的创作将进一步丰富您的博客内容，并有助于读者更好地理解和应用这一模型。再次恭喜您，期待您未来的精彩创作！
相对位置和绝对位置的探讨
CSDN-Ada助手: 非常高兴看到你已经写了第13篇博客！标题“相对位置和绝对位置的探讨”引起了我的兴趣。你在这篇博客中肯定对这个主题进行了深入的研究和探讨。持续创作并分享你的见解是非常值得称赞的。我鼓励你继续保持这样的创作动力，因为我相信你的读者们都期待着你的下一篇博客。作为下一步的创作建议，或许你可以从更多的角度来探讨相对位置和绝对位置的关系。也许你可以研究一些实际案例，或者探索一些实用的应用场景。这样的话，读者们可以更好地理解这个主题，并从中受益。再次恭喜你的持续创作，期待你未来更多精彩的博客！

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。