excel导入功能中去掉重复数据—解决思路

今天客户提出一个问题,能否在产品中2个子系统中的实现所有的excel导入功能过滤掉已有的数据。

我思考了一番,想到了3种大概的解决思路:

1、在插入每条数据的时候,查到对应的表找出是否存在对应的数据,如存在就跳过。

2、把整个excel文件的里的内容存入到一张临时表中,然后查询去重并插入到目的表中。select distinct into 或insert into select,这只是去掉的当前excel表中重复的数据,不过可以和目的表联合查询出目的表中不存在的新数据,然后插入目的表中。

3、给oracle数据库相应字段(可能多个)增加唯一约束或者对其创建创建唯一的索引,然后程序做对应的异常处理。

何为“重复数据”呢,可能有多个字段或者单个字段影响,和excel文件本身里数据重复或者数据库里的数据重复,这些就需要根据具体业务而定了。

第一种方法也是很容易想到的,不过一定要考虑性能问题,如果导入的数据很多,势必会影响性能,再者即使写这样的方法,尽可能不要改动源代码很大为前提,如写成一个公共方法,直接传入表名和约束的字段名,尽可能的遵循OOP原则,或者直接先处理好当前excel文件,把处理好准备要插入数据库中的数据存入一个List或者其他适合的集合中,最后进行批量的插入,用JDBC或者hibernate或者其他中的批量插入方法,不过这些都不是绝对的,只是一个解决思路,选哪种都要根据情形而定。

第二种方法看起来稍微有点复杂,适合excel表中的重复数据多,导入数据比较多这种情况。

第三种方法实现起来比较容易,但有些细节要注意,如果2个非主键字段判断是否是“重复数据”,是采用创建索引的形式create unique index还是constraint name_unique unique(字段1,字段2)),都要考虑字段是否为空,都为空的情形,尽管约束是可以为空的,如果都为空约束是不起作用,再者就是代码出捕获SQLException或者自己创建的异常,调用方法或者不用调用就能保证业务上这个异常就是只能由于这个原因抛出此异常,如果捕获的异常不是自己那个“违反唯一约束”的异常,要将这个异常throw让外层的try catch处理。而且如果这个导入功能的业务中有“添加”功能,得注意可能添加了重复数据报错,得想到处理这个客户体验问题。再就是添加约束时可能已有数据有所谓“重复”的,可以

select n.*
from RS_ZK_WRITTENINFO n
where (n.PROJECTID, n.IDCARD) in
(select m.PROJECTID, m.IDCARD
from RS_ZK_WRITTENINFO m
group by m.PROJECTID, m.IDCARD
having count(*) > 1)

类似的SQL语句查看重复的数据,然后把重复出来的数据删除掉,类似这样的语句:

delete from RS_ZK_WRITTENINFO n
where (n.PROJECTID, n.IDCARD) in
(select m.PROJECTID, m.IDCARD
from RS_ZK_WRITTENINFO m group by m.PROJECTID, m.IDCARD
having count(*) > 1)
and rowid not in (select min(rowid)
from RS_ZK_WRITTENINFO z
group by z.Projectid, z.IDCARD
having count(*) > 1)

然后再加约束就没问题了。本人根据情况是采用的第三种方法解决这个问题的。

最后,认真看过的网友们,大神们,如有感觉我这个程序猿有哪个地方说的不对或者不妥或者你有很好的

议或者建议或点子方法,还望您大恩大德施舍n秒的时间留下你的宝贵文字(留言),以便你,我,还有广大的程序猿们更快地成长与进步.......

(如有转载,不胜荣兴!转载请连同复制此区域-作者:Java我人生(陈磊兴) 原文链接:http://blog.csdn.net/chenleixing/article/details/42563339


  • 1
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
如果要删除Excel文件重复数据,可以先将Excel数据读入到Java程序,然后对数据进行去重处理,最后将去重后的数据重新写入Excel文件。以下是一个基本的实现过程: 1. 导入POI和Java集合框架的HashSet类。 ``` import org.apache.poi.ss.usermodel.*; import java.util.HashSet; ``` 2. 读取Excel数据,并将数据存储到HashSet。 ``` // 创建文件输入流对象,读取Excel文件到内存。 FileInputStream fis = new FileInputStream(filePath); // 创建工作簿对象,表示整个Excel文件。 Workbook workbook = WorkbookFactory.create(fis); // 获取第一个Sheet页。 Sheet sheet = workbook.getSheetAt(0); // 创建HashSet集合,用于存储去重后的数据。 HashSet<String> set = new HashSet<>(); // 遍历Sheet的每一行和每一列,获取单元格数据,并将数据存储到HashSet。 for (Row row : sheet) { for (Cell cell : row) { String value = cell.getStringCellValue(); set.add(value); } } // 关闭文件输入流和工作簿对象。 fis.close(); workbook.close(); ``` 3. 将HashSet数据重新写入Excel文件。 ``` // 创建文件输出流对象,用于写入Excel文件。 FileOutputStream fos = new FileOutputStream(outputFilePath); // 创建工作簿对象,表示整个Excel文件。 Workbook workbook = new XSSFWorkbook(); // 创建Sheet页。 Sheet sheet = workbook.createSheet(); // 遍历HashSet数据,将数据写入Excel文件。 int rownum = 0; for (String value : set) { Row row = sheet.createRow(rownum++); Cell cell = row.createCell(0); cell.setCellValue(value); } // 将工作簿对象写入到文件输出流。 workbook.write(fos); // 关闭文件输出流和工作簿对象。 fos.close(); workbook.close(); ``` 以上就是基本的实现过程,具体实现方式可以根据具体需求进行调整。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值