LlamaIndex 🦙(@llama_index)
ExtractBench is now live on @Kaggle. It tests schema-guided document extraction on the documents mo...
8.5内容质量

TL;DR · AI 摘要
ExtractBench 是 LlamaIndex 推出的文档提取基准测试,覆盖 370 个企业文档和 67 种类型,用于评估长列表、手写等复杂场景下的提取效果。
核心要点
- ExtractBench 包含 370 个企业文档,覆盖 8 个业务领域和 67 种文档类型。
- 基准测试重点验证长记录列表、手写和复杂表格等易出错场景。
- LlamaParse、Codex、Claude Code 等工具在该基准上进行性能对比。
结构提纲
按章节快速跳转。
介绍 LlamaIndex 在 Kaggle 上推出 ExtractBench 基准测试。
- ·测试目标
验证结构化提取在复杂文档场景(如手写、噪声扫描)中的鲁棒性。
- ›数据覆盖
包含 370 个企业文档,横跨 8 个业务领域和 67 种文档类型。
- ·工具对比
对比 LlamaParse、Codex、Claude Code 等工具在基准上的表现。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- ExtractBench 基准测试
- 测试目标
- 复杂文档解析
- 鲁棒性验证
- 数据范围
- 370 企业文档
- 8 业务领域
- 67 文档类型
- 工具对比
- LlamaParse
- Codex
- Claude Code
金句 / Highlights
值得收藏与分享的关键句。
ExtractBench 覆盖 370 个企业文档,包含长记录列表、手写和复杂表格等挑战性场景。
基准测试旨在识别最可能破坏下游代理和工作流的文档提取失败案例。
LlamaIndex 通过该基准展示不同工具在复杂文档解析任务中的性能差异。
#LlamaIndex#文档提取#Kaggle#基准测试
打开原文LlamaIndex 🦙 on X: "ExtractBench 现已上线 @Kaggle。该基准测试针对最可能破坏下游代理和工作流程的文档进行基于模式的文档提取测试,包括长记录列表、嘈杂扫描件、手写体和复杂表格。该基准测试涵盖了8个业务领域和67种文档类型的370份企业文档。看看LlamaParse、Codex、Claude Code等表现如何。阅读完整故事 →
llamaindex.ai/blog/llamainde…
4:01 PM · 2026年9月2日
9.7K
浏览量
5
6
32
11 / X
LlamaIndex 🦙
@llama_index
ExtractBench 现已上线
@
Kaggle
。该基准测试针对最可能破坏下游代理和工作流程的文档进行基于模式的文档提取测试,包括长记录列表、嘈杂扫描件、手写体和复杂表格。该基准测试涵盖了8个业务领域和67种文档类型的370份企业文档。看看LlamaParse、Codex、Claude Code等表现如何。阅读完整故事 →