类 ExcelExtractor
java.lang.Object
com.agentsflex.core.file2text.extractor.impl.ExcelExtractor
- 所有已实现的接口:
FileExtractor
Excel 文档提取器(.xlsx, .xlsm, .xls, .xltx)
输出格式:Markdown 表格,支持多 Sheet、公式计算、特殊字符转义
-
字段概要
字段从接口继承的字段 com.agentsflex.core.file2text.extractor.FileExtractor
ORDER_COMPARATOR -
构造器概要
构造器 -
方法概要
修饰符和类型方法说明private StringescapeMarkdown(String text) 转义 Sheet 名称中的 Markdown 特殊字符(用于标题)private StringescapeMarkdownCell(String content) 转义单元格内容中的 Markdown 特殊字符 主要处理:| \ ` * _ [ ] < > 等,避免破坏表格结构extractText(DocumentSource source) private StringformatEvaluatedValue(org.apache.poi.ss.usermodel.CellValue evaluated) private StringgetCellValue(org.apache.poi.ss.usermodel.Cell cell, org.apache.poi.ss.usermodel.FormulaEvaluator evaluator) private StringgetExtension(String fileName) intgetOrder()private booleanisRowEmpty(org.apache.poi.ss.usermodel.Row row) private org.apache.poi.ss.usermodel.WorkbookopenWorkbook(InputStream inputStream, String fileName) private voidoutputMarkdownTable(StringBuilder output, List<List<String>> rowsData, int maxColumns) 输出 Markdown 格式表格booleansupports(DocumentSource source) 判断该 Extractor 是否支持处理此文档
-
字段详细资料
-
KNOWN_MIME_TYPES
-
MIME_PREFIX
- 另请参阅:
-
SUPPORTED_EXTENSIONS
-
-
构造器详细资料
-
ExcelExtractor
public ExcelExtractor()
-
-
方法详细资料
-
supports
从接口复制的说明:FileExtractor判断该 Extractor 是否支持处理此文档- 指定者:
supports在接口中FileExtractor
-
extractText
- 指定者:
extractText在接口中FileExtractor- 抛出:
IOException
-
outputMarkdownTable
输出 Markdown 格式表格 -
escapeMarkdownCell
转义单元格内容中的 Markdown 特殊字符 主要处理:| \ ` * _ [ ] < > 等,避免破坏表格结构 -
escapeMarkdown
转义 Sheet 名称中的 Markdown 特殊字符(用于标题) -
openWorkbook
private org.apache.poi.ss.usermodel.Workbook openWorkbook(InputStream inputStream, String fileName) throws IOException - 抛出:
IOException
-
getCellValue
private String getCellValue(org.apache.poi.ss.usermodel.Cell cell, org.apache.poi.ss.usermodel.FormulaEvaluator evaluator) -
formatEvaluatedValue
-
isRowEmpty
-
getOrder
- 指定者:
getOrder在接口中FileExtractor
-
getExtension
-