- 博客(4)
- 收藏
- 关注
原创 神经网络与深度学习(四)
transformer技术将视觉、语言、声音等各种模态联结在一起,组成“多模态”。多模态主要围绕基础模型构建,其中重要应用:视觉大模型。现成的训练好的单模态基础模型,如LLM,能够为各种MM任务提供认知能力。而如何将不同的单模态连接起来实现协同推理是技术关键。——通过多模态预训练和多模态指令微调来实现模态之间的对齐,以及模型输出与人类意图的对齐。
2026-06-07 23:25:17
226
原创 神经网络与深度学习(三)
相比于常用的LSTM和GRU模型,Transformer有显著优势:可以捕捉间隔较长的语义关联;充分利用分布式GPU进行并行训练,提升模型训练效率;
2026-05-30 22:52:56
202
1
原创 神经网络与深度学习(二)
常用数据集包括MNIST、Fashion-MNIST、CIFAR-10、PASCAL VOC、MS COCO、ImageNet、JFT-300M等。
2026-05-24 17:18:27
38
原创 神经网络与深度学习(一)
2、反向传播:将输出与期望的误差,按原连接通路反向计算,由梯度下降法调整各层节点的权值和阈值,使误差减小。针对非线性不可分问题,提出使用多层感知机的解决办法,即在输入和输出层间加一到多层隐单元。1、正向传播:从输入->隐层->输出,若输出达到了期望,则学习算法结束,否则转至反向。若每一个神经元都连接到上一层的所有神经元(输入层除外),则成为全连接网络。对于多层前馈网络,其学习算法称为BP算法,由正向传播+反向传播组成。对于训练数据,去寻找拟合一条曲线,使得这些训练数据都尽量在曲线上。
2026-05-16 20:47:38
247
1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅