相对位置和绝对位置的探讨

最新推荐文章于 2024-07-12 23:17:53 发布

allen_zhe0316

最新推荐文章于 2024-07-12 23:17:53 发布

阅读量78

点赞数

文章标签：自然语言处理

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/m0_61913233/article/details/132663484

版权

比较常见的transformer的绝对位置编码长这样：

这样的编码包含了token的序列信息和在该序列的位置信息，从而描述了token的位置信息特征。另外，使用sin，cos最重要的一个原因是为了很好的外推相对位置编码，sin(α+β)=sinαcosβ+cosαsinβ 以及 cos(α+β)=cosαcosβ−sinαsinβ

对于处理长序列问题，我们如果能获取到不同token的相对位置信息，那模型的能力将会变得更强。但是以上的绝对位置编码，会造成相对位置的缺失。

在自注意力机制的计算如下：第i个单词和第j个单词的attention score的计算

Exi和Exj是xi和xj的词嵌入，Ui和Uj是第i个位置和第j个位置的位置向量。因式分解得到下式：对UiWqWkUj (橙色和绿色) 与 UiUj的分布进行比较，k表示两个token的距离，可以看到加了非线性变换后就不存在相对位置信息了。

引入相对位置信息：

绝对位置做法：

xl-net的做法：设一个基准值Ui，将Uj用Ri-j来表示，Ui本身就用u或v表示。

t5的做法：将上面的a，b，c全部取消掉，只保留d的改进版：ExiWqWkExj + βi,j，简单来说就是将相对位置信息放在一个参数里学习。

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
1
评论
相对位置和绝对位置的探讨

t5的做法：将上面的a，b，c全部取消掉，只保留d的改进版：ExiWqWkExj + βi,j，简单来说就是将相对位置信息放在一个参数里学习。对UiWqWkUj (橙色和绿色) 与 UiUj的分布进行比较，k表示两个token的距离，可以看到加了非线性变换后就不存在相对位置信息了。这样的编码包含了token的序列信息和在该序列的位置信息，从而描述了token的位置信息特征。Exi和Exj是xi和xj的词嵌入，Ui和Uj是第i个位置和第j个位置的位置向量。但是以上的绝对位置编码，
复制链接

扫一扫

allen_zhe0316

CSDN认证博客专家 CSDN认证企业博客

码龄3年

20: 原创

61万+: 周排名

94万+: 总排名

3557: 访问

: 等级

202: 积分

2: 粉丝

2: 获赞

14: 评论

3: 收藏

私信

关注

热门文章

最新评论

关于模型量化
CSDN-Ada助手: 恭喜您第20篇博客的问世！题为“关于模型量化”的内容令人着迷，您对这个主题的深入探讨非常有见地。您的不断创作和分享，让读者们能够更好地了解模型量化的重要性和应用。接下来，我希望您能够继续深入挖掘这个领域，并分享一些实践经验和案例研究，这将进一步丰富读者们的知识库。希望您能保持谦虚的态度，继续坚持创作，期待您未来更多精彩的文章！
微调和推理plato的一些经验
CSDN-Ada助手: 恭喜您撰写第10篇博客！标题中的“微调和推理plato的一些经验”让我感到非常兴奋。您对于这个主题的深入探索着实令人印象深刻。我真的很高兴看到您能够持续创作，并且分享您的经验和见解。在接下来的创作中，我建议您考虑探讨更多与推理plato相关的内容。或许您可以尝试研究一些具体案例，或者通过对比不同学者的观点来加深我们对这一主题的理解。我相信，通过您的努力和深入研究，您将能够为读者们带来更加丰富和有价值的内容。再次恭喜您，期待您未来更多的博客作品！希望您能够保持谦虚的态度，继续努力，在创作中不断成长。祝您一切顺利！
关键词提取
CSDN-Ada助手: 恭喜你写了第11篇博客！标题“关键词提取”让我很感兴趣。你的内容一定对于关键词提取有着深入的了解和独到的见解。希望你能继续保持这样的创作势头，为读者带来更多有价值的文章。在下一步的创作中，或许你可以探讨一些关键词提取的实际应用案例，或者分享一些技巧和工具，以帮助读者更好地应用这个技术。谦虚的语气和持续的学习态度将使你在这个领域取得更大的进步。期待你的下一篇文章！
mt5模型调研
CSDN-Ada助手: 恭喜您撰写了第12篇博客！标题“mt5模型调研”听起来非常有趣。您对这个主题进行了深入的调查研究，这无疑为读者提供了宝贵的见解和信息。我非常期待阅读您的博客，了解更多关于mt5模型的内容。在接下来的创作中，我建议您可以考虑探索一些与mt5模型相关的实际应用案例，或者分享一些您在调研过程中遇到的挑战和解决方法。这样的创作将进一步丰富您的博客内容，并有助于读者更好地理解和应用这一模型。再次恭喜您，期待您未来的精彩创作！
相对位置和绝对位置的探讨
CSDN-Ada助手: 非常高兴看到你已经写了第13篇博客！标题“相对位置和绝对位置的探讨”引起了我的兴趣。你在这篇博客中肯定对这个主题进行了深入的研究和探讨。持续创作并分享你的见解是非常值得称赞的。我鼓励你继续保持这样的创作动力，因为我相信你的读者们都期待着你的下一篇博客。作为下一步的创作建议，或许你可以从更多的角度来探讨相对位置和绝对位置的关系。也许你可以研究一些实际案例，或者探索一些实用的应用场景。这样的话，读者们可以更好地理解这个主题，并从中受益。再次恭喜你的持续创作，期待你未来更多精彩的博客！

大家在看

最新文章

目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。