DharmaAI aplica DPO post-entrenamiento para eliminar defectos en OCR
Línea temporal
-
DharmaAI demuestra que Direct Preference Optimization reduce defectos en OCR un 59% de promedio
DharmaAI lanzó DharmaOCR, un modelo de OCR especializado en estructuración de documentos, y publicó investigación mostrando que Direct Preference Optimization (DPO) aplicado tras fine-tuning supervisado reduce…