自定义博客皮肤VIP专享

*博客头图:

格式为PNG、JPG,宽度*高度大于1920*100像素,不超过2MB,主视觉建议放在右侧,请参照线上博客头图

请上传大于1920*100像素的图片!

博客底图:

图片格式为PNG、JPG,不超过1MB,可上下左右平铺至整个背景

栏目图:

图片格式为PNG、JPG,图片宽度*高度为300*38像素,不超过0.5MB

主标题颜色:

RGB颜色,例如:#AFAFAF

Hover:

RGB颜色,例如:#AFAFAF

副标题颜色:

RGB颜色,例如:#AFAFAF

自定义博客皮肤

-+
  • 博客(40)
  • 收藏
  • 关注

原创 通用唤醒词识别模型 - Wav2Vec2

基于 Wav2Vec2 实现的通用唤醒词识别模型,最终测试效果基本满足需求,但特征样本对模型效果影响较大。

2026-02-20 12:04:13 224

原创 正/余弦位置编码 Sinusoidal Encoding

其中,pos 为词汇在句子中的位置索引;i 为特征维度索引,2i 代表偶数位置,2i + 1 代表奇数位置;d 为特征维度,在传统 Transformer 模型中默认为 512。

2026-02-16 12:43:03 72

原创 实现扩散模型 Stable Diffusion - MNIST 数据集

基于 CNN 和 Attention 实现的扩散模型 Stable Diffusion,此模型在手写数字数据集 MNIST 上训练了 40+ 轮,最终测试效果良好,且能够胜任简单的手写数字图片生成任务。

2026-02-16 12:01:23 261

原创 实现时间步调度器

基于扩散模型 Diffusion 原理实现的时间步调度器,以此支撑后续的 Stable Diffusion 训练任务中的噪声前向扩散和反向采样。

2026-02-15 20:33:37 166

原创 实现变分自编码器 VAE- MNIST 数据集

基于 CNN 和 Attention 实现的变分自编码器 VAE,此模型在手写数字数据集 MNIST 上训练了 60+ 轮,最终测试效果良好,且能够胜任后续的 Stable Diffusion 训练任务。

2026-02-15 20:01:56 414

原创 使用 BERT 实现意图理解和实体识别

本文使用 Base BERT 模型结构,训练 200 余条关于 ”开关灯“ 语料,以实现基本的意图理解和实体识别。

2025-09-09 16:50:59 386 2

原创 手动实现 RNN 和 LSTM

手动实现 RNN 和 LSTM

2025-07-14 17:39:53 326

原创 使用 Conformer 模型实现自动语音识别,ASR

使用 Conformer 模型实现自动语音识别,ASR

2025-05-27 17:41:51 316

原创 手动实现 Transformer 模型

本文使用 Pytorch 库手动实现了传统 Transformer 模型中的多头自注意力机制、残差连接和层归一化、前馈层、编码器、解码器等子模块,进而实现了对 Transformer 模型的构建。

2025-05-17 17:08:34 433

原创 中文 Tokenization&Tokenizer

本文收集封装了几种常用的中文分词器。

2025-03-17 10:50:32 587

原创 中文句子分词

基于 jieba 库的中文句子分词工具,侧重识别句子中的数字词汇。

2025-01-22 10:18:34 196

原创 基于 Transformer 的英译中翻译项目实战

基于 Transformer 的英译中翻译项目实战(附完整代码)。

2024-12-08 18:18:44 1709

原创 基于 Transformer 的新闻标题文本分类项目实战

基于 Transformer 的新闻标题文本分类项目实战(附完整代码)。

2024-12-01 19:34:54 1044

原创 填充句子到相同长度

在进行词向量转换时(词嵌入),由于各个句子长短不一,无法直接转换成张量,这时就需要对较短的句子进行填充(padding),以满足张量输入对于形状的要求。

2024-11-11 14:58:29 286

原创 One-Hot 编码

One-Hot 编码就是用于将离散的分类(文本)标签转换为二进制向量。

2024-10-04 10:38:39 614

原创 OpenCV-图像基础处理

/

2024-03-13 10:37:05 998

原创 Python-sklearn-diabetes项目实战

/

2024-03-11 20:16:10 2141

原创 Python-sklearn-Optimizer

/

2024-03-10 14:30:14 594

原创 Python-sklearn-datasets

/

2024-03-08 11:58:21 754

原创 Python-sklearn-LossFunction

/

2024-03-07 15:53:33 514

原创 Python-Numpy-计算矩阵相乘

/

2024-03-06 09:09:59 577

原创 Python-Numpy-计算向量间的欧式距离

/

2024-03-05 17:04:29 1171

原创 Python-sklearn.datasets-make_blobs

/

2024-03-05 11:51:44 1063

原创 Python-sklearn-RidgeRegression

/

2024-03-04 16:16:16 1381

原创 Python-sklearn-ActivationFunction

/

2024-03-01 16:59:12 406

原创 Python-sklearn-LinearRegression

/

2024-02-29 16:48:50 1870

原创 Python-sklearn-LogisticRegression

/

2024-02-27 17:17:30 1159

原创 Python-sklearn-LinearRegression(2)

/

2024-02-24 11:06:17 1246 1

原创 Python-sklearn-Vectorization

/

2024-02-23 09:13:11 592

原创 Python-sklearn-Normalization

/

2024-02-22 10:10:41 794

原创 Python-sklearn-LinearRegression(1)

/

2024-02-21 11:38:09 1172

原创 Python-Gaussian

/

2024-02-18 16:05:51 849

原创 Python-sklearn-Kmeans(2)

/

2024-02-17 23:59:20 766

原创 Python-sklearn-Algorithm

/

2024-02-16 21:46:34 448

原创 Python-sklearn-Kmeans(1)

/

2024-02-16 16:54:52 797

原创 Java-poi-XWPFDocument-MjWord

/

2024-02-08 13:40:37 731

原创 Java-MjUtil

/

2024-02-06 18:47:11 434

原创 Python-openpyxl-MjExcel

/

2024-02-06 14:25:14 637

原创 Python-docx-MjWord

/

2024-02-05 22:09:51 632

原创 Python-MjUtil

/

2024-02-05 22:07:38 469

通用唤醒词识别模型 - Wav2Vec2

基于 Wav2Vec2 实现的通用唤醒词识别模型,最终测试效果基本满足需求,但特征样本对模型效果影响较大。

2026-02-20

Stable Diffusion 模型 .pt 权重文件

基于 CNN 和 Attention 实现的扩散模型 Stable Diffusion,此模型在手写数字数据集 MNIST 上训练了 40+ 轮,最终测试效果良好,且能够胜任简单的手写数字图片生成任务。

2026-02-16

VAE 模型 .pt 权重文件

基于 CNN 和 Attention 实现的变分自编码器 VAE,此模型在手写数字数据集 MNIST 上训练了 60+ 轮,最终测试效果良好,且能够胜任后续的 Stable Diffusion 训练任务。

2026-02-15

中文 Tokenization&Tokenizer

本资源收集封装了几种常用的中文分词器。

2025-03-17

基于 Transformer 的英译中翻译项目实战

基于 Transformer 的英译中翻译项目实战

2024-12-08

基于 Transformer 的新闻标题文本分类项目实战

基于 Transformer 的新闻标题文本分类项目实战

2024-12-08

空空如也

TA创建的收藏夹 TA关注的收藏夹

TA关注的人

提示
确定要删除当前文章?
取消 删除