CTC损失函数 Transformer用的

最新推荐文章于 2023-05-04 16:48:38 发布

火星种萝卜

最新推荐文章于 2023-05-04 16:48:38 发布

阅读量1.2k

点赞数

分类专栏： NLP

原文链接：https://blog.csdn.net/weixin_43886056/article/details/107960402

版权

NLP 专栏收录该内容

247 篇文章 4 订阅

订阅专栏

CTC损失函数 Transformer用的

https://zhuanlan.zhihu.com/p/42719047

下面这篇论文中提到的

BERT应用的四个场景：

语句对分类，如语句相似度任务，语句蕴含判断等
单语句分类，如情感分类
QA任务，如阅读理解，将question和document构建为语句对，输出start和end的位置即可
序列标注，如NER，从每个位置得到类别即可。
对于NSP任务来说，其条件概率表示为P = s o f t m a x ( C W T ) P=softmax(CW^T)P=softmax(CW
T
)，其中C CC是BERT输出中的[CLS]符号，W WW是可学习的权值矩阵。对于其它任务来说，可以根据BERT的输出信息作出对应的预测，在BERT的基础上再添加一个输出层便可以完成对特定任务的微调。

其中Tok表示不同的Token，E EE表示嵌入向量，T i T_iT
i

表示第i ii个Token在经过BERT处理之后得到的特征向量。

https://blog.csdn.net/weixin_43886056/article/details/107960402

火星种萝卜

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
CTC损失函数 Transformer用的

CTC损失函数 Transformer用的https://zhuanlan.zhihu.com/p/42719047下面这篇论文中提到的预训练BERT学习笔记https://blog.csdn.net/weixin_43886056/article/details/107960402
复制链接

扫一扫

专栏目录

火星种萝卜 CSDN认证博客专家 CSDN认证企业博客

码龄17年

303: 原创

2万+: 周排名

207万+: 总排名

428万+: 访问

: 等级

3万+: 积分

425: 粉丝

732: 获赞

322: 评论

2007: 收藏

私信

关注

热门文章

分类专栏

最新评论

tensorflow1.0代码迁移到2.0官方指导
ivy__w: 请问下把代码改为您文中写的之后报错 tensorflow 中的 disable_resource_variables 函数（位于 D:\Users\anaconda\envs\randlanet\lib\site-packages\tensorflow\python\compat\v2_compat.py 文件的第 96 行）已被弃用，将来会被移除，并给出了更新的指导说明，即长期来看不支持非资源变量。是为什么呀？要怎么解决才行？
假设训练数据集中有10万个词，四元语法需要存储多少词频和多词相邻频率？《动手学深度学习李沐》转
Laughing Man.: 个人见解是：计算机在最开始计算多词相邻概率（包括 n=2 ,n = 3 ,n = 4）的过程是相互独立的，就是计算机分别及计算以上三者并存储，这样考虑根据排列组合的理解就变成了 10万*10万， 10万*10万*10万，10万* 10万*10万*10万(因为可能存在相同的词语相邻) ，所以最后的大小就是 10**2 + 10**3 +10**4 你的理解是在语料库已经建立完毕的情况下，对一条特定的语句需要用到的相邻概率的数量（只有在这种情况下，才会考虑词语已经使用过的情况）
如何理解：先减1后取反和先取反后加1得到的结果是一样的，故仍可采用取反加1的方法，即对于机器数为负数，则有［X］原=［［X］补］补。
做而论道_CS: 求负数 (X < 0) 的 n 位补码，公式是：　[ X ]补＝ 2^n － | X | －－－－－－－－－－－－－－－－－－－－－按照公式来求补码，是非常简单的事。　根本也不涉及什么：符号位原码反码取反加一。例：－31 的八位补码是多少？解： 2^8 － |－31 | 　= 256 － 31 = 225 = 1110 0001 (二进制) 这不就求出来了嘛！但是，有人偏要找麻烦，鼓吹什么 “取反加一” ！那就慢慢算吧。－－－－－－－－－－－－－－－－－－－－－先看，2^n 的二进制，是多少呢？　是：111 ... 1 + 1。（共有 n 个 1，后面再加上一个 1。）再看，| X | 的二进制，又是多少呢？取绝对值后，就是 n 位的正数。可写成：| X | = 0xx ... x。　（共有 n－1 个 x 。）其中的 x，是一位二进制数，即 0 或 1。－－－－－－－－－－－－－－－－－－－－－所以，公式 2^n － | X | 的二进制形式，就是：　　111 ... 1 ＋ 1 － 0xx ... x 。此公式，还可以改写为以下两种形式：　（111 ... 1 － 0xx ... x）＋ 1　　　（1）　　111 ... 1 －（0xx ... x － 1）　　（2）由小学所学的知识，可知：　方程(1) 和方程(2)，是等效的。－－－－－－－－－－－－－－－－－－－－－另外：1 － 0 ＝ 1、1 － 1 ＝ 0。因此：1 － x，　就是对 x 取反。－－－－－－－－－－－－－－－－－－－－－那么，方程 (1)，就是：先取反、后加一；　而，方程 (2)，就是：先减一、后取反。至此，就证明了：　取反加一、减一取反，功能是相同的。证明这个命题，只需用到小学的知识。　根本就不用：原码反码这些乱七八糟的事！
如何理解：先减1后取反和先取反后加1得到的结果是一样的，故仍可采用取反加1的方法，即对于机器数为负数，则有［X］原=［［X］补］补。
做而论道_CS: 先减1后取反、先取反后加1，确实是一样的。但是，证明方法、过程，却不是你写的这些。
如何理解：先减1后取反和先取反后加1得到的结果是一样的，故仍可采用取反加1的方法，即对于机器数为负数，则有［X］原=［［X］补］补。
做而论道_CS: 则有［X］原=［［X］补］补－－－－－－－－－－－－－－－补码的补码，就是原码！你这么说，就表现出：　你的基本概念，不清！给定一个数值（X = ± N），才能求其补码：[X]补。给你一个补码，也没有正负号了，你怎么能求补码！如果说：　取反加一，再取反加一，可得到原来的代码。这还有点靠谱。

您愿意向朋友推荐“博客详情页”吗？

强烈不推荐
不推荐
一般般
推荐
强烈推荐

提交

最新文章

目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。