- 博客(4)
- 收藏
- 关注
原创 神经网络和深度学习总结-5
大语言模型(Large Language Model,通常简称为LLM)是基于海量无标注文本数据进行预训练的超大规模深度学习网络体系。其核心技术优势不仅在于能够生成极为流畅、符合人类语法的自然语言文本,更在于通过庞大的参数空间隐式地建立起了对世界知识的深度表征,从而展现出卓越的上下文学习(In-Context Learning)与逻辑推理能力,广泛且高效地处理诸如文本摘要、复杂问答、多语种翻译及代码生成等高阶自然语言任务。
2026-06-07 22:09:56
180
原创 神经网络和深度学习总结-4
传统的深度卷积神经网络在图像分类任务中取得了突破性进展,其典型架构通过一系列卷积层和池化层提取高维特征,最终通过全连接层将特征图展平为一维向量,并利用分类器输出类别概率分布。然而,这种结构在语义分割这类像素级密集预测任务中存在本质缺陷。首先,全连接层丢弃了特征图的空间维度信息,使得网络无法恢复每个像素的具体位置。其次,全连接层的参数矩阵维度固定,这强制要求输入图像必须具有固定的分辨率。如果强行对输入图像进行裁剪或缩放以适应网络,会造成物体几何畸变或上下文信息丢失。
2026-05-31 22:41:01
354
原创 神经网络和深度学习总结-3
如果网格内不包含物体,则 P(Object) = 0,置信度真值为 0;如果网格内包含目标,则置信度真值为预测框与真实框的交并比(Intersection over Union, IoU)。
2026-05-25 01:28:53
373
原创 神经网络和深度学习总结-1&2
人工神经网络作为模拟人脑神经系统微观结构与功能的计算模型,构成了现代人工智能的重要分支。回顾其演进历程,学科经历了多次学术范式的转变与技术起伏。自1943年McCulloch与Pitts提出首个神经元数学模型(M-P模型),以及1949年Hebb提出突触连接强度调整规则以来,神经网络奠定了初步的计算基石。
2026-05-18 00:00:24
542
1
空空如也
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅