Chinese Brief
中文案例导读
jmtroller 公开的文档理解与处理案例,来源为 公开代码库,复核于 2026-06-27T09:19:45Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
厂商xAI / Grok
模型Grok 4.3 (high)
任务类型文档理解与处理
审核状态auto_approved
CASE EVIDENCE / A RECORD
jmtroller 公开的文档理解与处理案例,来源为 公开代码库,复核于 2026-06-27T09:19:45Z。
原始记录:jmtroller 用 Grok 4.3 为破产案件 PACER PDF 做结构化抽取
Chinese Brief
jmtroller 公开的文档理解与处理案例,来源为 公开代码库,复核于 2026-06-27T09:19:45Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
任务
从破产案件 PACER PDF 文档中抽取结构化字段;README 明确写明默认 provider 是 Grok 4.3(xAI Responses API),并提供 doc-extraction extract 命令对 docketId 对应 PDF 自动识别文档类型后抽取。
产物是一个可运行的 Python 服务,输出写入 MongoDB BankruptcyIntel 集合;每个抽取字段采用 {value, source_page} 格式,并带 provenance、raw、normalized JSON,可进一步投影给 Laravel/MCP/REST 使用。
Grok 4.3 作为默认抽取模型处理 PDF 内容理解、文档类型相关字段识别、结构化 JSON 生成和来源页码定位;Anthropic/OpenAI 仅作为可替换备用 provider。
公开证据来自仓库 README;未看到线上生产数据样例,案例粒度按公开开源服务/工程产物采集。