Chinese Brief
中文案例导读
Omni AI (getomni-ai) 公开的知识库与检索问答案例,来源为 公开代码库,复核于 2026-06-26T13:17:46Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
CASE EVIDENCE / A RECORD
Omni AI (getomni-ai) 公开的知识库与检索问答案例,来源为 公开代码库,复核于 2026-06-26T13:17:46Z。
原始记录:Zerox OCR: Vision-based Document Extraction Using Claude 3 Haiku via AWS Bedrock
Chinese Brief
Omni AI (getomni-ai) 公开的知识库与检索问答案例,来源为 公开代码库,复核于 2026-06-26T13:17:46Z。 Model Atlas 将它标记为 A 类证据,因为它同时具备具体使用者、具体任务、公开原始证据和可访问产物。 Model Atlas 不把 benchmark、教程、发布说明或集合页包装成真实案例。
任务
这是一个围绕知识检索和问答的真实任务,公开材料可以回溯到具体使用者和具体产物。 原始资料写作:Zerox is a document OCR library (12,243 GitHub stars) that converts PDFs, DOCX files, and images into Markdown by passing pages as images to vision models. It explicitly lists Claude 3 Haiku (2024.03, 2024.10) as a supp…
公开材料提供公开代码、README 或项目配置,可用于核验任务结果、项目形态和模型绑定关系。 原始资料写作:Structured Markdown output from PDF/image documents; used for downstream LLM ingestion, data extraction pipelines, and document search systems
Claude 3 Haiku 在该案例中承担知识检索和问答相关的生成、分析、编排或实现角色。 原始资料写作:Claude 3 Haiku provides fast, cost-effective vision-based OCR as one of Zerox's Bedrock-supported models. At $0.25/$1.25 per million tokens (input/output), it enables processing large document volumes at a fraction of t…
当前判断基于公开材料;若产物下线、仓库变更或模型参与比例仅来自作者自述,需要在引用前重新复核。 原始资料写作:Zerox defaults to OpenAI GPT-4o for OCR; Claude 3 Haiku is one of several supported providers. Users must explicitly configure the Bedrock/Haiku provider. The product supports Anthropic direct API and AWS Bedrock, but t…