python数据集_python数据集、机器学习、智能数据集[zz]

大家做数据挖掘研究时,常常为找不到合适的数据而发愁。在KDNuggets上有Datasets栏目,提供一些数据集,网址为:http://www.kdnuggets.com/datasets/

还有另外一个很好的资源网址为:http://kdd.ics.uci.edu/,里面包含的数据资源如下(按应用领域划分):

Direct Marketing

KDD CUP 1998 Data

GIS

Forest CoverType

Indexing

Corel Image Features

Pseudo Periodic Synthetic Time Series

Intrusion Detection

KDD CUP 1999 Data

Process Control

Synthetic Control Chart Time Series

Recommendation Systems

Entree Chicago Recommendation Data

Robots

Pioneer-1 Mobile Robot Data

Robot Execution Failures

Sign Language Recognition

Australian Sign Language Data

High-quality Australian Sign Language Data

Text Categorization

20 Newsgroups Data

Reuters-21578 Text Categorization Collection

NSF Research Awards Abstracts 199 0-2003

World Wide Web

Microsoft Anonymous Web Data

MSNBC Anonymous Web Data

Syskill Webert Web Data

------------------------------------------------------------------分割线------------------------------------------------------------------

DMman按:以下链接转自互联网,链接的有效性与可用价值DMman没有逐个进行测试。

2、几个实用的测试数据集下载的网站

以下网址上有各种数据集:

进行文本分类,还有一个数据集是可以用的,即rainbow的数据集

3、找了很多测试数据集,写论文的同志们肯定需要的,至少能用来检验算法的效果

可能有一些不能访问,但是总有能访问的吧:

UCI收集的机器学习数据集

ftp://pami.sjtu.edu.cn/

statlib

样本数据库

关于基金的数据挖掘的网站

reuters数据集

各种数据集:

进行文本分类&WEB

时间序列数据的网址

apriori算法的测试数据

数据生成器的链接

关联:

WEKA:

1。A jarfile containing 37 classification problems, originally obtained from the UCI repository

2。A jarfile containing 37 regression problems, obtained from various sources

3。A jarfile containing 30 regression datasets collected by Luis Torgo

癌症基因:

金融数据:

另一个人提供的

在下面的网址可以找到reuters数据集

以下网址上有各种数据集:

进行文本分类,还有一个数据集是可以用的,即rainbow的数据集

Download the Financial Data (~17.5M zipped file, ~67M unzipped data)

Download the Medical Data (~2M zipped file, ~6M unzipped data)

kdnuggets 相关链接数据集(借花献佛了):

察看kdnuggets 数据集资源的详细介绍。

------------------------------------------------------------------分割线------------------------------------------------------------------

资料来源:网络资料

数据挖掘相关比赛以及数据集

2005 University of California data mining contest, predicting bad accounts and their churn date using real-world CRM data, deadline June 30, 2005.

ILP 2005 Challenge, on the prediction of functional classes of genes.

KDD Cup 2005, on classifying internet user search queries, deadline July 8.

Data Mining Cup 2005 (Chemnitz, Germany), for students; topic: How data mining can ascertain the risk of loss of payments and reduce this risk.

KDD Cup 2004, focuses on data-mining for a several performance criteria using datasets from bioinformatics and quantum physics.

InfoVis 2004 Contest, The History of InfoVis.

DATA MINING CUP 2004 (Chemnitz, Germany), for students.

InfoVis 2003 Contest: Visualization and Pair Wise Comparison of Trees, results announced Sep 5, 2003.

KDD Cup 2003, focuses on problems motivated by network mining and the analysis of usage logs.

DATA MINING CUP 2003 (Chemnitz, Germany). The task is to identify spam emails before they reach the user′s mailbox.

KDD Cup 2002, focus on data mining in molecular biology.

Student Data Mining Cup (2002), Chemnitz University and Prudential Systems.

分享到微信

微信扫码

新浪微博

QQ好友

QQ空间

var rec_url = 'http://www.douban.com/share/recommend?'

推荐1人

添加标签,多个标签用空格分隔,帮助你更好地整理内容

529720fae0f6

2014-11-30 22:42:51python培训(智普教育 www.jeapedu.com)

u74923814-6.jpg

2014-12-13 14:10:11python培训(智普教育 www.jeapedu.com)

u74923814-6.jpg

2015-01-19 00:03:18python培训(智普教育 www.jeapedu.com)

open source map

u74923814-6.jpg

2015-01-19 00:23:44python培训(智普教育 www.jeapedu.com)

u74923814-6.jpg

2015-01-19 00:26:58python培训(智普教育 www.jeapedu.com)

u74923814-6.jpg

2015-04-25 16:18:22python培训(智普教育 www.jeapedu.com)

呵呵

u74923814-6.jpg

2015-06-24 23:01:20python培训(智普教育 www.jeapedu.com)

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值