s2jh mysql_基于的MySQL纵向属性列表转换为横向字段列表脚本

MySQL解析数据存储

为了适应不同项目对不同感兴趣属性的解析存储,数据存储结构采用纵向的属性列表方式,即一个url页面多个属性存储多条记录方式,并且按照text,html,data,num几大典型类型分别对应存储。

创建UTF-8字符集的nutch数据库,并执行表初始化脚本,参考DDL:

CREATE TABLE `crawl_data` (

`url` varchar(255) NOT NULL,

`code` varchar(255) NOT NULL,

`name` varchar(255) DEFAULT NULL,

`category` varchar(255) DEFAULT NULL,

`order_index` int(255) DEFAULT NULL,

`fetch_time` datetime NOT NULL,

`text_value` text,

`html_value` text,

`date_value` datetime DEFAULT NULL,

`num_value` decimal(18,2) DEFAULT NULL

) ENGINE=InnoDB DEFAULT CHARSET=utf8;

b119de098b27e77224c91acb0ca0292a.png

为了一般在业务系统获取同一个url的多个属性或友好查询显示,参考如下MySQL脚本实现把纵向的属性列表属性转换为横向的多列显示模式。网上有相关参考脚本大多是基于数字字段sum汇总等模式的纵转横SQL脚本,本项目需求是单一的基于字符串信息转换,经过一段摸索最后找到基于GROUP_CONCAT可以实现:

SELECT url ,fetch_time,

GROUP_CONCAT(CASE WHEN code = 'domain' THEN text_value ELSE null END) AS `domain`,

GROUP_CONCAT(CASE WHEN code = 'name' THEN text_value ELSE null END) AS `name`,

GROUP_CONCAT(CASE WHEN code = 'brand' THEN text_value ELSE null END) AS `brand`,

GROUP_CONCAT(CASE WHEN code = 'category' THEN text_value ELSE null END) AS `category`,

GROUP_CONCAT(CASE WHEN code = 'purpose' THEN text_value ELSE null END) AS `purpose`,

GROUP_CONCAT(CASE WHEN code = 'price' THEN num_value ELSE null END) AS `price`,

GROUP_CONCAT(CASE WHEN code = 'refPrice' THEN num_value ELSE null END) AS `refPrice`,

GROUP_CONCAT(CASE WHEN code = 'primaryImage' THEN text_value ELSE null END) AS `primaryImage`

FROM crawl_data GROUP BY url,fetch_time

a445c0ec1ad821b174835e86abdd2118.png

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值