tensorflow 导入数据（3）

最新推荐文章于 2022-07-17 20:58:44 发布

孙宝龙

最新推荐文章于 2022-07-17 20:58:44 发布

阅读量1.9k

点赞数

分类专栏：机器学习与人工智能新版tensorflow tensorflow人工智能开发文章标签： tensorflow 数据导入人工智能神经网络

本文链接：https://blog.csdn.net/amao1998/article/details/81280543

版权

本文详细介绍了在TensorFlow中如何导入和预处理数据，特别是使用Dataset.map进行数据转换以及如何利用tf.py_func嵌入Python数据。讨论了数据批量化的重要性，并给出了相关代码示例。

摘要由CSDN通过智能技术生成

1、概述

从文件读取数据时，往往是需要数据转换时，尤其对于多维数据，在使用文件形式进行存储时，除了tfrecord文件格式化，其他的文件的存储都显得无能为力。所以真正从文件读入的数据需要经过转换之后才能够使用。同样在tensorflow这种以小批次进行梯度下降的框架中，需要打乱数据以及对数据进行batch处理，本文主要讨论这些问题。

2、使用Dataset.map() 预处理数据

Dataset.map(f) 转换通过将指定函数 f 应用于输入数据集的每个元素来生成新数据集。此转换基于 map() 函数（通常应用于函数式编程语言中的列表和其他结构）。函数 f 会接受表示输入中单个元素的 tf.Tensor 对象，并返回表示新数据集中单个元素的 tf.Tensor 对象。此函数的实现使用标准的 TensorFlow 指令将一个元素转换为另一个元素。

下面以nlp的word-embeding为例来说明这个情况，在我们存储的原始预料中包含一些关键词，并且包含这些关键词对应的id，我们可以使用下面代码来看一下数据的基本形态：

# 从CSV文件中读取数据
import pandas as pd
data = pd.read_csv('cutword_ths.csv',header=None,delimiter=' ',names=['id','text'])
data.head()

输出结果如下图所示：

最低0.47元/天解锁文章

孙宝龙

关注

0
点赞
踩
5

收藏

觉得还不错? 一键收藏
0
评论
tensorflow 导入数据（3）

1、概述从文件读取数据时，往往是需要数据转换时，尤其对于多维数据，在使用文件形式进行存储时，除了tfrecord文件格式化，其他的文件的存储都显得无能为力。所以真正从文件读入的数据需要经过转换之后才能够使用。同样在tensorflow这种以小批次进行梯度下降的框架中，需要打乱数据以及对数据进行batch处理，本文主要讨论这些问题。2、使用Dataset.map() 预处理数据Datas...
复制链接

扫一扫

专栏目录