
AI 新闻 15 天前
新模型,不一定更强:DharmaOCR 说明了什么
DharmaOCR 的研究显示,在巴西葡萄牙语的结构化 OCR 任务中,专门化的小模型(3B)通过任务对齐和 DPO 优化,能在准确率和成本上超越更大的模型和商业基线。论文与模型卡强调了退化率、推理成本与稳定性作为关键评估指标,表明专精策略在明确场景下能带来显著收益。
编辑部
聚焦该标签下的所有相关内容。

DharmaOCR 的研究显示,在巴西葡萄牙语的结构化 OCR 任务中,专门化的小模型(3B)通过任务对齐和 DPO 优化,能在准确率和成本上超越更大的模型和商业基线。论文与模型卡强调了退化率、推理成本与稳定性作为关键评估指标,表明专精策略在明确场景下能带来显著收益。