Hugging Face·· 2026-07-16AI 评分35
DharmaOCR:面对更新模型,垂直专精优势依旧
Newer Models, Same Advantage
AI 导读
DharmaOCR 在巴西葡萄牙语基准测试中取得 0.925 分,显著领先更新的 Mistral OCR4(0.798 分)和 Unlimited-OCR(0.7587 分)。该模型通过监督微调将全部参数容量集中于目标语言结构,并引入直接偏好优化(DPO)抑制重复与不连贯输出。测试结果表明,垂直领域专精训练在复杂文档抽取质量和推理稳定性上明显优于多语言通用模型。
来源:Hugging Face · huggingface.co