python中shuffleSplit（）函数

最新推荐文章于 2024-07-29 16:54:35 发布

Pywin

最新推荐文章于 2024-07-29 16:54:35 发布

阅读量1.4w

点赞数 3

分类专栏： python 文章标签： python shuffleSplit

本文链接：https://blog.csdn.net/qq_36076233/article/details/70307703

版权

python 专栏收录该内容

37 篇文章 1 订阅

订阅专栏

参数：

n : int

数据集中的元素总数。

n_iter : int (default 10)

重新洗牌和分裂迭代次数。

test_size : float (default 0.1), int, or None

如果是float类型的数据, 这个数应该介于0-1.0之间，代表test集所占比例. 如果是int类型, 代表test集的数量. 如果为None, 值将自动设置为train集大小的补集

train_size : float, int, or None (default is None)

如果是float类型的数据应该介于0和1之间，并表示数据集在train集分割中所占的比例如果是int类型, 代表train集的样本数量. 如果为None, 值将自动设置为test集大小的补集

random_state : int or RandomState

用于随机抽样的伪随机数发生器状态。

>>> from sklearn import cross_validation
>>> rs = cross_validation.ShuffleSplit(4, n_iter=3,
...     test_size=.25, random_state=0)
>>> len(rs)
3
>>> print(rs)
... 
ShuffleSplit(4, n_iter=3, test_size=0.25, ...)
>>> for train_index, test_index in rs:
...    print("TRAIN:", train_index, "TEST:", test_index)
...
TRAIN: [3 1 0] TEST: [2]
TRAIN: [2 1 3] TEST: [0]
TRAIN: [0 2 1] TEST: [3]

>>> rs = cross_validation.ShuffleSplit(4, n_iter=3,
...     train_size=0.5, test_size=.25, random_state=0)
>>> for train_index, test_index in rs:
...    print("TRAIN:", train_index, "TEST:", test_index)
...
TRAIN: [3 1] TEST: [2]
TRAIN: [2 1] TEST: [0]
TRAIN: [0 2] TEST: [3]
.. automethod:: __init__