思维链COT原理探究

AI-智能

已于 2024-01-25 21:50:24 修改

阅读量846

点赞数 25

文章标签：人工智能机器学习大模型

于 2024-01-23 13:30:00 首次发布

本文链接：https://blog.csdn.net/2401_82469710/article/details/135747182

版权

COT元素

论文把影响元素拆分成了Text，Symbol和Pattern三个部分, 如下

论文给出了symbol和pattern的定义，剩下的token全是Text

symbol:是数据集的核心主体，数学问题就是数字,SPORT数据集就是运动员和运动项目, DATE数据集就是时间，这里的symbol类似实体的概念
pattern: 可以是symbol的组合，连接符(公式)或者帮助模型理解任务的表述结构。这里允许pattern和symbol重合，也就是整个公式是pattern，但公式中的数字同样是symbol。但在非数学问题上我个人觉得pattern的定义有点迷幻...

实验

论文针对以上3个元素分别进行了实验，通过改变COT few-shot prompt中特定元素的取值，来分析该元素对COT效果的贡献

观点1.Symbol的形式和取值本身对COT影响不大

这里论文用了两种控制变量的方式：symbol随机采样和特殊符号替换

特殊符号替换(symb_abs)

abstract symbol就是用特殊符号来替换symbol，这里作者同时替换了question，prompt和answer里面的symbol如下

随机替换(symb_ood)

OOD类似随机替换，不过论文的替换方式有些迷幻。对于GSM8k数学问题，作者用一一对应的数学数字替换了文字数字;对于体育常识问题的替换比较常规作者用随机的人名和赛事进行替换;对于时间常识问题作者用未来时间替换了当前时间?? 注意这里的替换作者保证了推理逻辑的一致性，包括同一数字用同一symbol替换，替换实体也符合推理逻辑，以及对问题中的答案也进行了替换。所以这里纯纯只能论证symbol本身的取值和类型(例如数字1和一)是否对COT有影响

abstract symbol就是用特殊符号来替换symbol，这里作者同时替换了question，prompt和answer里面的symbol如下

这种替换方式下的实验结果如下，除了体育问题中的随机实体替换，其余symbol的替换对COT的效果影响都非常有限。这让我想到了一篇关于NER模型的泛化性主要来自模型学会了不同类型的实体会出现在哪些上下文中，而不仅是对实体本身的形式进行了记忆。他们的实验方式和作者替换symbol的操作其实很类似，这种替换并不大幅影响下文对上文的Attention。

观点2. pattern是COT生效的必要不充分条件

对于Pattern作者更换了实验方式，控制变量采用了只保留pattern，和只剔除pattern这两种实验类型。

以数学问题为例，只保留pattern就是推理过程只保留数学公式，只剔除pattern就是整个推理过程只把公式剔除。其余问题类型，考虑在前面的pattern定义阶段个人就感觉有些迷幻，... 所以我们直接跳到实验结论吧

只有pattern的COT效果很差，和直接推理差不多，说明只有patten肯定是不够的，这和上一篇博客提到COT小王子尝试过的只有数学公式的COT效果不好的结论是一致的。
剔除pattern的COT效果受到影响，因此pattern对COT有显著影响，但很显然还有别的因素

观点3. 推理出现问题中的关键实体且和问题保持格式一致很重要

最后针对Text部分，作者采用了实体替换和语法替换

实体替换(text_diff_entities)：把推理中的实体随机替换成和问题中不一样的实体，包括数学问题中的数字，常识问题中的时间，地点和任务。个人感觉这应该是symbol的实验？？

- 语法替换(text_yoda_thought): 把常规的英文表达改成了Yoda的说法风格。Yoda是按照名词-形容词-动词顺序来说话的。例如常规是This is my home，Yoda会说My home this is。只对thought进行语法替换，question保持正常的英文表达。

效果上，随机实体替换对所有任务的COT效果影响非常大, 所以在推理阶段使用Question中的核心实体很重要。其次推理和question在语法上的不一致会影响COT在部分任务上的表现。

Towards Understanding Chain-of-Thought Prompting: An Empirical Study of What Matters

测试模型：text-davinci-002， text-davinci-003

整体上第二篇论文的思路更简单清晰，在拆解元素的同时还定义了关系。

在线教程

麻省理工学院人工智能视频教程 – 麻省理工人工智能课程
人工智能入门 – 人工智能基础学习。Peter Norvig举办的课程
EdX 人工智能 – 此课程讲授人工智能计算机系统设计的基本概念和技术。
人工智能中的计划 – 计划是人工智能系统的基础部分之一。在这个课程中，你将会学习到让机器人执行一系列动作所需要的基本算法。
机器人人工智能 – 这个课程将会教授你实现人工智能的基本方法，包括：概率推算，计划和搜索，本地化，跟踪和控制，全部都是围绕有关机器人设计。
机器学习 – 有指导和无指导情况下的基本机器学习算法
机器学习中的神经网络 – 智能神经网络上的算法和实践经验
斯坦福统计学习

有需要的小伙伴，可以点击下方链接免费领取或者V扫描下方二维码免费领取🆓

请添加图片描述

人工智能书籍

第一阶段：零基础入门（3-6个月）

新手应首先通过少而精的学习，看到全景图，建立大局观。 通过完成小实验，建立信心，才能避免“从入门到放弃”的尴尬。因此，第一阶段只推荐4本最必要的书（而且这些书到了第二、三阶段也能继续用），入门以后，在后续学习中再“哪里不会补哪里”即可。

第二阶段：基础进阶（3-6个月）

熟读《机器学习算法的数学解析与Python实现》并动手实践后，你已经对机器学习有了基本的了解，不再是小白了。这时可以开始触类旁通，学习热门技术，加强实践水平。在深入学习的同时，也可以探索自己感兴趣的方向，为求职面试打好基础。

第三阶段：工作应用

这一阶段你已经不再需要引导，只需要一些推荐书目。如果你从入门时就确认了未来的工作方向，可以在第二阶段就提前阅读相关入门书籍（对应“商业落地五大方向”中的前两本），然后再“哪里不会补哪里”。

有需要的小伙伴，可以点击下方链接免费领取或者V扫描下方二维码免费领取🆓

在这里插入图片描述

AI-智能

关注

25
点赞
踩
24

收藏

觉得还不错? 一键收藏
0
评论
思维链COT原理探究

这种替换方式下的实验结果如下，除了体育问题中的随机实体替换，其余symbol的替换对COT的效果影响都非常有限。实体替换(text_diff_entities)：把推理中的实体随机替换成和问题中不一样的实体，包括数学问题中的数字，常识问题中的时间，地点和任务。只有pattern的COT效果很差，和直接推理差不多，说明只有patten肯定是不够的，这和上一篇博客提到COT小王子尝试过的只有数学公式的COT效果不好的结论是一致的。论文给出了symbol和pattern的定义，剩下的token全是Text。
复制链接

扫一扫