小编Mar*_*oon的帖子

使用Apache POI从Word文档中提取段落

我有一个word文档 Docx文件

正如你在单词文档中看到的那样,有一些关于子弹点的问题.现在我试图使用apache POI从文件中提取每个段落.这是我目前的代码

    public static String readDocxFile(String fileName) {
    try {
        File file = new File(fileName);
        FileInputStream fis = new FileInputStream(file.getAbsolutePath());
        XWPFDocument document = new XWPFDocument(fis);

        List<XWPFParagraph> paragraphs = document.getParagraphs();
        String whole = "";
        for (XWPFParagraph para : paragraphs) {
            System.out.println(para.getText());
            whole += "\n" + para.getText();
        }
        fis.close();
        document.close();
        return whole;
    } catch (Exception e) {
        e.printStackTrace();
        return "";
    }
    }
Run Code Online (Sandbox Code Playgroud)

上述方法的问题在于它是打印每一行而不是段落.此外,子弹点也从提取的whole字符串中消失.将whole返回一个普通字符串.

任何人都可以解释我做错了什么.如果你有更好的想法解决它,请建议.

java apache

9
推荐指数
1
解决办法
1389
查看次数

标签 统计

apache ×1

java ×1