<?xml version="1.0" encoding="utf-8" ?><rss version="2.0"><channel><title><![CDATA[Thanours的博客]]></title><description><![CDATA[分享技术]]></description><link>https://blog.csdn.net/Thanours</link><language>zh-cn</language><generator>https://blog.csdn.net/</generator><copyright><![CDATA[Copyright &copy; Thanours]]></copyright><item><title><![CDATA[大模型在推荐领域中的运用-总结]]></title><link>https://blog.csdn.net/Thanours/article/details/139319316</link><guid>https://blog.csdn.net/Thanours/article/details/139319316</guid><author>Thanours</author><pubDate>Thu, 30 May 2024 11:24:41 +0800</pubDate><description><![CDATA[实验表明，RecMind在不同的推荐任务中优于现有的基于LLM的推荐方法，并在与最近需要完全预训练的P5模型竞争的任务中取得了有竞争力的性能。将语言模型视为特征提取器，将物品和用户的原始信息（比如商品的标题/属性/类目、用户的点击序列/上下文）设计成prompt，输入到LLM中并输出相应的embedding或者语义summary信息，后续作为特征或者通过LLM语义挖掘用户潜在的兴趣偏好，最终将这些整合到推荐系统的决策过程中。由于LLM模型返回的是通用知识信息，存在与站内的类目体系无法完全对应的情况。]]></description><category></category></item><item><title><![CDATA[【强化学习篇】on-policy 和 off-policy 的区别]]></title><link>https://blog.csdn.net/Thanours/article/details/132857600</link><guid>https://blog.csdn.net/Thanours/article/details/132857600</guid><author>Thanours</author><pubDate>Wed, 13 Sep 2023 16:39:17 +0800</pubDate><description><![CDATA[然而，一旦policy更新参数后，这时两个policy是不一样了，之前采样数据data则不能继续使用了，需要重新再采样数据，这样效率很低。从on-policy梯度和off-policy梯度对比，很明显的是off-policy跟环境互动的是 θ‘ ，而不是θ，θ‘ 采样出来的数据与待更新的θ没有关系。KL 散度并不是θ和θ‘参数的距离，而是行为上的距离，即给同一个state的时候，action几率分布之间的差距。这里有个假设，pθ(st)和pθ′(st)分布是差不多的，比值接近1，可以略去。]]></description><category></category></item><item><title><![CDATA[linux查看文件内容命令（学习笔记）]]></title><link>https://blog.csdn.net/Thanours/article/details/125610536</link><guid>https://blog.csdn.net/Thanours/article/details/125610536</guid><author>Thanours</author><pubDate>Mon, 04 Jul 2022 23:41:55 +0800</pubDate><description><![CDATA[linux查看文件内容的命令说明]]></description><category></category></item><item><title><![CDATA[ubuntu下安装nccl具体教程]]></title><link>https://blog.csdn.net/Thanours/article/details/124078380</link><guid>https://blog.csdn.net/Thanours/article/details/124078380</guid><author>Thanours</author><pubDate>Sun, 10 Apr 2022 15:29:45 +0800</pubDate><description><![CDATA[使用paddlepaddle框架进行多卡训练时报错：

Traceback (most recent call last):
 File "train.py", line 210, in &lt;module&gt;
  do_train()
 File "train.py", line 91, in do_train
  paddle.distributed.init_parallel_env()
 File "/home/th/anaconda3/envs/paddle/lib/pytho...]]></description><category></category></item><item><title><![CDATA[plt保存图片时会被截断下面一部分（解决方法）]]></title><link>https://blog.csdn.net/Thanours/article/details/123463801</link><guid>https://blog.csdn.net/Thanours/article/details/123463801</guid><author>Thanours</author><pubDate>Sun, 13 Mar 2022 18:55:34 +0800</pubDate><description><![CDATA[使用import matplotlib.pyplot as plt的plt.savefig保存热力图出现下面x轴标签被截断一部分。]]></description><category></category></item><item><title><![CDATA[The current process just got forked. Disabling parallelism to avoid deadlocks.To disable this warnin]]></title><link>https://blog.csdn.net/Thanours/article/details/123371605</link><guid>https://blog.csdn.net/Thanours/article/details/123371605</guid><author>Thanours</author><pubDate>Wed, 09 Mar 2022 10:51:27 +0800</pubDate><description><![CDATA[The current process just got forked. Disabling parallelism to avoid deadlocks...
To disable this warning, please explicitly set TOKENIZERS_PARALLELISM=(true | false)]]></description><category></category></item><item><title><![CDATA[导入matplotlib.pyplot as plt画图问题Matplotlib created a temporary config/cache directory at /tmp/matplotl]]></title><link>https://blog.csdn.net/Thanours/article/details/123370635</link><guid>https://blog.csdn.net/Thanours/article/details/123370635</guid><author>Thanours</author><pubDate>Wed, 09 Mar 2022 10:24:03 +0800</pubDate><description><![CDATA[Matplotlib created a temporary config/cache directory at /tmp/matplotlib-4c7itqfv because the default path (/home/xx/.config/matplotlib) is not a writable directory; it is highly recommended to set the MPLCONFIGDIR environment variable to a writable direct]]></description><category></category></item><item><title><![CDATA[词向量研究-GloVe词向量原理详解-通俗易懂]]></title><link>https://blog.csdn.net/Thanours/article/details/120362085</link><guid>https://blog.csdn.net/Thanours/article/details/120362085</guid><author>Thanours</author><pubDate>Sat, 18 Sep 2021 10:39:11 +0800</pubDate><description><![CDATA[转载-原文：https://zhuanlan.zhihu.com/p/42073620

概述

GloVe：Global Vectors。

模型输入：语料库 corpus

模型输出：每个词的表示向量

论文链接：https://aclanthology.org/D14-1162.pdf

基本思想

要讲GloVe模型的思想方法，我们先介绍两个其他方法：

一个是基于奇异值分解（SVD）的LSA算法，该方法对term-document矩阵（矩阵的每个元素为tf-idf）进行奇异值分解，从而得到te..]]></description><category></category></item><item><title><![CDATA[NLP领域中文对话系统数据集总结（有下载地址）]]></title><link>https://blog.csdn.net/Thanours/article/details/118368742</link><guid>https://blog.csdn.net/Thanours/article/details/118368742</guid><author>Thanours</author><pubDate>Wed, 30 Jun 2021 20:22:34 +0800</pubDate><description><![CDATA[一、豆瓣多轮对话数据集

1、简介：

测试数据包含 1000 个对话上下文，对于每个上下文，创建 10 个响应作为候选。正确的响应意味着响应可以自然地回复给定上下文的消息。每对收到三个标签，大多数标签被视为最终决定。





2、数据格式：

标签 \t 对话话语（由 \t 分割）\t 响应

二、KdConv]]></description><category></category></item><item><title><![CDATA[中文语音语料调研]]></title><link>https://blog.csdn.net/Thanours/article/details/118337951</link><guid>https://blog.csdn.net/Thanours/article/details/118337951</guid><author>Thanours</author><pubDate>Tue, 29 Jun 2021 17:25:57 +0800</pubDate><description><![CDATA[中文语音数据集小调研

许多开源语音语料库都可以从openslr下载。

一、ST-CMDS

简介：ST-CMDS是由一个AI数据公司发布的中文语音数据集，包含10万余条语音文件，大约100余小时的语音数据。数据内容以平时的网上语音聊天和智能语音控制语句为主，855个不同说话者，同时有男声和女声，适合多种场景下使用。

下载：http://openslr.org/38/

二、thchs30

简介：thchs30是由清华大学语音与语言技术中心2015年发布的开源中文语音数据集。一共30 小时， 完全免费]]></description><category></category></item><item><title><![CDATA[git commit 代码提交规范]]></title><link>https://blog.csdn.net/Thanours/article/details/117651266</link><guid>https://blog.csdn.net/Thanours/article/details/117651266</guid><author>Thanours</author><pubDate>Mon, 07 Jun 2021 10:14:40 +0800</pubDate><description><![CDATA[git commit 代码提交规范

一、为什么需要制定提交规范？

在团队协作开发时，每个人提交代码时都会写 commit message。

每个人都有自己的书写风格，翻看我们组的git log, 可以说是五花八门，十分不利于阅读和维护。

一般来说，大厂都有一套的自己的提交规范，尤其是在一些大型开源项目中，commit message 都是十分一致的。

因此，我们需要制定统一标准，促使团队形成一致的代码提交风格，更好的提高工作效率，成为一名有追求的工程师。

二、业界通用的 git 提交规范有哪些？]]></description><category></category></item><item><title><![CDATA[KL散度、JS散度、Wasserstein距离]]></title><link>https://blog.csdn.net/Thanours/article/details/117459647</link><guid>https://blog.csdn.net/Thanours/article/details/117459647</guid><author>Thanours</author><pubDate>Wed, 02 Jun 2021 09:26:54 +0800</pubDate><description><![CDATA[1. KL散度


KL散度又称为相对熵，信息散度，信息增益。KL散度是是两个概率分布PP和QQ 之间差别的非对称性的度量。 KL散度是用来 度量使用基于QQ的编码来编码来自PP的样本平均所需的额外的位元数。 典型情况下，PP表示数据的真实分布，QQ表示数据的理论分布，模型分布，或PP的近似分布。


定义如下：



因为对数函数是凸函数，所以KL散度的值为非负数。


有时会将KL散度称为KL距离，但它并不满足距离的性质：

KL散度不是对称的，即DKL(P||Q)≠DKL(...]]></description><category></category></item><item><title><![CDATA[信息抽取之事件抽取任务技术调研笔记]]></title><link>https://blog.csdn.net/Thanours/article/details/110393743</link><guid>https://blog.csdn.net/Thanours/article/details/110393743</guid><author>Thanours</author><pubDate>Mon, 30 Nov 2020 17:56:29 +0800</pubDate><description><![CDATA[事件抽取（Event Extraction）
一、事件抽取分两大类


事件识别和抽取
从描述事件信息的文本中识别并抽取出事件信息并以结构化的形式呈现出来，包括发生的时间、地点、参与角色以及与之相关的动作或者状态的改变。


事件检测和追踪
事件检测与追踪旨在将文本新闻流按照其报道的事件进行组织，为传统媒体多种来源的新闻监控提供核心技术，以便让用户了解新闻及其发展。具体而言，事件发现与跟踪包括三个主要任务：分割，发现和跟踪，将新闻文本分解为事件， 发现新的（不可预见的）事件，并跟踪以前报道事件的发展。
​	]]></description><category></category></item><item><title><![CDATA[get_encoders() got an unexpected keyword argument ‘use_adapter‘]]></title><link>https://blog.csdn.net/Thanours/article/details/110368433</link><guid>https://blog.csdn.net/Thanours/article/details/110368433</guid><author>Thanours</author><pubDate>Mon, 30 Nov 2020 10:03:27 +0800</pubDate><description><![CDATA[运行环境：

tensorflow-gpu == 1.14.0

keras==2.2.4

keras-bert==0.69.0



使用keras-bert的加载bert预训练模型时报错:



原因分析：

这是keras-transformer版本问题，pip安装keras-bert==0.69.0时自动安装了keras-transformer ==0.38.0（pip list可以查看一下版本）

keras-transformer版本改成0.31.0就可以了



解决步骤：

1. 卸...]]></description><category></category></item><item><title><![CDATA[Leetcode 42题接雨水的解题思路以及C++、java、python实现]]></title><link>https://blog.csdn.net/Thanours/article/details/110200526</link><guid>https://blog.csdn.net/Thanours/article/details/110200526</guid><author>Thanours</author><pubDate>Thu, 26 Nov 2020 20:16:09 +0800</pubDate><description><![CDATA[Leetcode42. 接雨水

题目描述：

给定n 个非负整数表示每个宽度为 1 的柱子的高度图，计算按此排列的柱子，下雨之后能接多少雨水。



示例 1：

输入：height = [0,1,0,2,1,0,1,3,2,1,2,1]
输出：6
解释：上面是由数组 [0,1,0,2,1,0,1,3,2,1,2,1] 表示的高度图，在这种情况下，可以接 6 个单位的雨水（蓝色部分表示雨水）。
示例 2：

输入：height = [4,2,0,3,2,5]
输出：9

解题思路：

官方解法：对于...]]></description><category></category></item><item><title><![CDATA[Leetcode 11题-盛最多水的容器的解题思路以及C++、java、python实现]]></title><link>https://blog.csdn.net/Thanours/article/details/109842469</link><guid>https://blog.csdn.net/Thanours/article/details/109842469</guid><author>Thanours</author><pubDate>Fri, 20 Nov 2020 11:30:09 +0800</pubDate><description><![CDATA[Leetcode 11题-盛最多水的容器

题目描述：

给你 n 个非负整数 a1，a2，...，an，每个数代表坐标中的一个点(i,ai) 。在坐标内画 n 条垂直线，垂直线 i的两个端点分别为(i,ai) 和 (i, 0) 。找出其中的两条线，使得它们与x轴共同构成的容器可以容纳最多的水。

说明：你不能倾斜容器。

示例 1：



输入：[1,8,6,2,5,4,8,3,7]
输出：49
解释：图中垂直线代表输入数组 [1,8,6,2,5,4,8,3,7]。在此情况下，容器能够容纳...]]></description><category></category></item><item><title><![CDATA[Bert，Albert，Roberta，XLNet的中英文预训练模型下载网址及教程]]></title><link>https://blog.csdn.net/Thanours/article/details/109819159</link><guid>https://blog.csdn.net/Thanours/article/details/109819159</guid><author>Thanours</author><pubDate>Thu, 19 Nov 2020 17:58:10 +0800</pubDate><description><![CDATA[自然语言处理的各大热门的中英文预训练模型下载网址，包含了Bert，Albert， Roberta， XLNet等模型的base和large、tensorflow和pytorch版本的预训练模型。

https://huggingface.co/models

以下载tensorflow版本的bert的中文预训练模型为例



点击红框中的bert-base-chinese





接着点击上图红框中的选项，就会有下图的文件



这里我们下载的是tensorflow版本的，所以pytorch版本的文件可.]]></description><category></category></item><item><title><![CDATA[Leetcode 88题.合并两个有序数组的解题思路以及C++、java、python实现]]></title><link>https://blog.csdn.net/Thanours/article/details/109801675</link><guid>https://blog.csdn.net/Thanours/article/details/109801675</guid><author>Thanours</author><pubDate>Thu, 19 Nov 2020 10:24:56 +0800</pubDate><description><![CDATA[Leetcode 88题.合并两个有序数组

题目描述：

给你两个有序整数数组nums1 和 nums2，请你将 nums2 合并到nums1中，使 nums1 成为一个有序数组。



说明：

初始化nums1 和 nums2 的元素数量分别为m 和 n 。
你可以假设nums1有足够的空间（空间大小大于或等于m + n）来保存 nums2 中的元素。


示例：

输入：
nums1 = [1,2,3,0,0,0], m = 3
nums2 = [2,5,6],    n ...]]></description><category></category></item><item><title><![CDATA[Leetcode 66题 加一 解题思路以及C++、java、python实现]]></title><link>https://blog.csdn.net/Thanours/article/details/109765605</link><guid>https://blog.csdn.net/Thanours/article/details/109765605</guid><author>Thanours</author><pubDate>Wed, 18 Nov 2020 10:41:47 +0800</pubDate><description><![CDATA[Leetcode 66题 加一

题目描述：

给定一个由 整数 组成的 非空 数组所表示的非负整数，在该数的基础上加一。

最高位数字存放在数组的首位， 数组中每个元素只存储单个数字。

你可以假设除了整数 0 之外，这个整数不会以零开头。

解题思路：

从数组最后一位开始遍历，加1后不等于10（即最后一位不是9），当前位置now的数值就直接替换加1后的结果并返回数组。

如果等于10，当前位置now的数值设为0，如果当前位置now不是数组第一位（即now != 0），遍历位置向前移动1。

如果当前.]]></description><category></category></item><item><title><![CDATA[Leetcode 283题 移动零的解题思路以及C++、java、python实现]]></title><link>https://blog.csdn.net/Thanours/article/details/109741045</link><guid>https://blog.csdn.net/Thanours/article/details/109741045</guid><author>Thanours</author><pubDate>Tue, 17 Nov 2020 14:00:48 +0800</pubDate><description><![CDATA[Leetcode 283题 移动零（双指针思想）

题目描述：

给定一个数组nums，编写一个函数将所有0移动到数组的末尾，同时保持非零元素的相对顺序。

示例:


输入: [0,1,0,3,12]
输出: [1,3,12,0,0]

说明:

必须在原数组上操作，不能拷贝额外的数组。
	尽量减少操作次数。
解题思路：

双指针解法：慢指针low指向非零元素的尾标，快指针fast遍历整个数组，快指针fast若遇到非零元素，则进行与慢指针交换元素。快指针fast若遇到零，则加1往前遍历。

C++实...]]></description><category></category></item></channel></rss>