【Apache POI】Java解析Excel文件并处理合并单元格-粘贴即用

哦永

于 2024-07-22 02:32:01 发布

阅读量29

点赞数

文章标签： apache java excel 开发语言

同为牛马，点个赞吧！

一、Excel文件样例

【Apache POI】Java解析Excel文件并处理合并单元格-粘贴即用_Excel

二、工具类源码

import org.apache.poi.ss.usermodel.*;
import org.apache.poi.ss.util.CellRangeAddress;
import org.apache.poi.xssf.usermodel.XSSFWorkbookFactory;
import org.springframework.web.multipart.MultipartFile;

import java.io.IOException;
import java.io.InputStream;
import java.util.ArrayList;
import java.util.HashMap;
import java.util.List;
import java.util.Map;

/**
 * 读取Excel并解析合并单元格，将结果转为Map集合
 */
public class ReadMergeCellExcelUtil {

    /**
     * 读取Excel数据
     *
     * @param file 上传的Excel文件
     * @return 解析后的数据列表
     */
    public static List<Map<String, String>> readExcelToObj(MultipartFile file) {
        List<Map<String, String>> result = new ArrayList<>();
        try (InputStream inputStream = file.getInputStream()) {
            Workbook workbook = XSSFWorkbookFactory.create(inputStream);
            result = readExcel(workbook, 0, 0, 0);
        } catch (IOException e) {
            e.printStackTrace();
        }
        return result;
    }

    /**
     * 读取Excel文件
     *
     * @param workbook      工作簿
     * @param sheetIndex    sheet页下标：从0开始
     * @param startReadLine 开始读取的行:从0开始
     * @param tailLine      去除最后读取的行
     * @return 解析后的数据列表
     */
    private static List<Map<String, String>> readExcel(Workbook workbook, int sheetIndex, int startReadLine, int tailLine) {
        Sheet sheet = workbook.getSheetAt(sheetIndex);
        FormulaEvaluator formulaEvaluator = workbook.getCreationHelper().createFormulaEvaluator();
        List<Map<String, String>> result = new ArrayList<>();
        for (int i = startReadLine; i <= sheet.getLastRowNum() - tailLine; i++) {
            Row row = sheet.getRow(i);
            Map<String, String> rowData = parseRow(sheet, row, formulaEvaluator);
            result.add(rowData);
        }
        return result;
    }

    /**
     * 解析一行数据
     *
     * @param sheet           工作表
     * @param row             行对象
     * @param formulaEvaluator 公式评估器
     * @return 解析后的行数据
     */
    private static Map<String, String> parseRow(Sheet sheet, Row row, FormulaEvaluator formulaEvaluator) {
        Map<String, String> rowData = new HashMap<>();
        if (row != null) {
            int cellIndex = 0;
            for (Cell cell : row) {
                String cellValue = getCellValue(sheet, cell, formulaEvaluator);
                rowData.put("field" + cellIndex, cellValue);
                cellIndex++;
            }
        }
        return rowData;
    }

    /**
     * 获取单元格的值
     *
     * @param sheet           工作表
     * @param cell            单元格
     * @param formulaEvaluator 公式评估器
     * @return 单元格值
     */
    private static String getCellValue(Sheet sheet, Cell cell, FormulaEvaluator formulaEvaluator) {
        if (cell == null) return "";
        return isMergedRegion(sheet, cell.getRowIndex(), cell.getColumnIndex())
                ? getMergedRegionValue(sheet, cell.getRowIndex(), cell.getColumnIndex(), formulaEvaluator)
                : getCellStringValue(cell, formulaEvaluator);
    }

    /**
     * 获取合并单元格的值
     *
     * @param sheet           工作表
     * @param row             行号
     * @param column          列号
     * @param formulaEvaluator 公式评估器
     * @return 合并单元格值
     */
    private static String getMergedRegionValue(Sheet sheet, int row, int column, FormulaEvaluator formulaEvaluator) {
        for (CellRangeAddress range : sheet.getMergedRegions()) {
            if (range.isInRange(row, column)) {
                Row firstRow = sheet.getRow(range.getFirstRow());
                Cell firstCell = firstRow.getCell(range.getFirstColumn());
                return getCellStringValue(firstCell, formulaEvaluator);
            }
        }
        return "";
    }

    /**
     * 判断单元格是否是合并单元格
     *
     * @param sheet  工作表
     * @param row    行下标
     * @param column 列下标
     * @return 是否是合并单元格
     */
    private static boolean isMergedRegion(Sheet sheet, int row, int column) {
        for (CellRangeAddress range : sheet.getMergedRegions()) {
            if (range.isInRange(row, column)) {
                return true;
            }
        }
        return false;
    }

    /**
     * 获取单元格的字符串值
     *
     * @param cell            单元格
     * @param formulaEvaluator 公式评估器
     * @return 单元格字符串值
     */
    private static String getCellStringValue(Cell cell, FormulaEvaluator formulaEvaluator) {
        switch (cell.getCellType()) {
            case STRING:
                return cell.getStringCellValue();
            case BOOLEAN:
                return String.valueOf(cell.getBooleanCellValue());
            case FORMULA:
                return formulaEvaluator.evaluate(cell).formatAsString();
            case NUMERIC:
                return String.valueOf(cell.getNumericCellValue());
            default:
                return "";
        }
    }

}

1.
2.
3.
4.
5.
6.
7.
8.
9.
10.
11.
12.
13.
14.
15.
16.
17.
18.
19.
20.
21.
22.
23.
24.
25.
26.
27.
28.
29.
30.
31.
32.
33.
34.
35.
36.
37.
38.
39.
40.
41.
42.
43.
44.
45.
46.
47.
48.
49.
50.
51.
52.
53.
54.
55.
56.
57.
58.
59.
60.
61.
62.
63.
64.
65.
66.
67.
68.
69.
70.
71.
72.
73.
74.
75.
76.
77.
78.
79.
80.
81.
82.
83.
84.
85.
86.
87.
88.
89.
90.
91.
92.
93.
94.
95.
96.
97.
98.
99.
100.
101.
102.
103.
104.
105.
106.
107.
108.
109.
110.
111.
112.
113.
114.
115.
116.
117.
118.
119.
120.
121.
122.
123.
124.
125.
126.
127.
128.
129.
130.
131.
132.
133.
134.
135.
136.
137.
138.
139.
140.
141.
142.
143.
144.
145.
146.
147.
148.
149.
150.
151.

三、解析结果

【Apache POI】Java解析Excel文件并处理合并单元格-粘贴即用_Apache POI_02

以下内容基本为废话，大可直接忽略！

四、工具类详解及使用方法

在日常牛马中，处理Excel文件是一项常见且重要的任务。Excel文件通常包含丰富的结构化数据，其中合并单元格的处理尤为复杂。本文将介绍一个名为ReadMergeCellExcelUtil的Java工具，帮助您轻松读取并解析Excel文件，处理合并单元格，并将结果转化为易于操作的Map集合。通过本文，您将学会如何使用该工具，以及理解其背后的实现原理。

准备工作

在开始之前，我们需要确保项目中添加了必要的依赖。这里我们主要使用Apache POI库来处理Excel文件。

Maven依赖：

<dependency>
    <groupId>org.apache.poi</groupId>
    <artifactId>poi-ooxml</artifactId>
    <version>5.0.0</version>
</dependency>

工具功能概述

ReadMergeCellExcelUtil工具的核心功能是解析Excel文件并处理合并单元格。它可以读取Excel文件，将每个单元格的内容存储到Map集合中，并正确处理合并单元格的值。典型的应用场景包括从Excel中读取配置数据、解析报表数据等。

代码详细解读

1. 读取Excel数据

方法：readExcelToObj

该方法用于读取上传的Excel文件，并将其内容解析为一个包含多个Map的列表。每个Map表示Excel文件中的一行数据。

public static List<Map<String, String>> readExcelToObj(MultipartFile file) {
    List<Map<String, String>> result = new ArrayList<>();
    try (InputStream inputStream = file.getInputStream()) {
        Workbook workbook = XSSFWorkbookFactory.create(inputStream);
        result = readExcel(workbook, 0, 0, 0);
    } catch (IOException e) {
        e.printStackTrace();
    }
    return result;
}

使用try-with-resources确保输入流在使用后正确关闭。

2. 解析Excel文件

方法：readExcel

该方法从工作簿中获取特定工作表，初始化公式评估器，并循环遍历行以解析每一行的数据。

private static List<Map<String, String>> readExcel(Workbook workbook, int sheetIndex, int startReadLine, int tailLine) {
    Sheet sheet = workbook.getSheetAt(sheetIndex);
    FormulaEvaluator formulaEvaluator = workbook.getCreationHelper().createFormulaEvaluator();
    List<Map<String, String>> result = new ArrayList<>();
    for (int i = startReadLine; i <= sheet.getLastRowNum() - tailLine; i++) {
        Row row = sheet.getRow(i);
        Map<String, String> rowData = parseRow(sheet, row, formulaEvaluator);
        result.add(rowData);
    }
    return result;
}

3. 解析一行数据

方法：parseRow

该方法遍历行中的单元格，并将其值存储到Map中。

private static Map<String, String> parseRow(Sheet sheet, Row row, FormulaEvaluator formulaEvaluator) {
    Map<String, String> rowData = new HashMap<>();
    if (row != null) {
        int cellIndex = 0;
        for (Cell cell : row) {
            String cellValue = getCellValue(sheet, cell, formulaEvaluator);
            rowData.put("field" + cellIndex, cellValue);
            cellIndex++;
        }
    }
    return rowData;
}

4. 获取单元格值

方法：getCellValue

该方法根据单元格类型获取其值，并处理合并单元格。

private static String getCellValue(Sheet sheet, Cell cell, FormulaEvaluator formulaEvaluator) {
    if (cell == null) return "";
    return isMergedRegion(sheet, cell.getRowIndex(), cell.getColumnIndex())
            ? getMergedRegionValue(sheet, cell.getRowIndex(), cell.getColumnIndex(), formulaEvaluator)
            : getCellStringValue(cell, formulaEvaluator);
}

5. 获取合并单元格值

方法：getMergedRegionValue

该方法查找并获取合并单元格的值。

private static String getMergedRegionValue(Sheet sheet, int row, int column, FormulaEvaluator formulaEvaluator) {
    for (CellRangeAddress range : sheet.getMergedRegions()) {
        if (range.isInRange(row, column)) {
            Row firstRow = sheet.getRow(range.getFirstRow());
            Cell firstCell = firstRow.getCell(range.getFirstColumn());
            return getCellStringValue(firstCell, formulaEvaluator);
        }
    }
    return "";
}

6. 判断单元格是否是合并单元格

方法：isMergedRegion

该方法检查指定单元格是否属于合并区域。

private static boolean isMergedRegion(Sheet sheet, int row, int column) {
    for (CellRangeAddress range : sheet.getMergedRegions()) {
        if (range.isInRange(row, column)) {
            return true;
        }
    }
    return false;
}

7. 获取单元格的字符串值

方法：getCellStringValue

该方法根据单元格类型获取字符串值，并评估公式单元格。

private static String getCellStringValue(Cell cell, FormulaEvaluator formulaEvaluator) {
    switch (cell.getCellType()) {
        case STRING:
            return cell.getStringCellValue();
        case BOOLEAN:
            return String.valueOf(cell.getBooleanCellValue());
        case FORMULA:
            return formulaEvaluator.evaluate(cell).formatAsString();
        case NUMERIC:
            return String.valueOf(cell.getNumericCellValue());
        default:
            return "";
    }
}

示例代码

以下是一个完整的示例，展示如何使用ReadMergeCellExcelUtil工具读取并解析Excel文件：

import org.springframework.web.multipart.MultipartFile;
import java.util.List;
import java.util.Map;

public class ExcelParserExample {

    public static void main(String[] args) {
        // 假设有一个MultipartFile类型的Excel文件对象file
        MultipartFile file = ...;

        // 使用工具类解析Excel文件
        List<Map<String, String>> parsedData = ReadMergeCellExcelUtil.readExcelToObj(file);

        // 打印解析结果
        for (Map<String, String> rowData : parsedData) {
            System.out.println(rowData);
        }
    }
}