Self-Distilled Reasoning: preservar razonamiento en fine-tuning de Nova sin CoT manual
Línea temporal
-
AWS presenta técnica para preservar razonamiento en fine-tuning sin trazas de cadena de pensamiento
AWS publica en su blog de machine learning una técnica llamada Self-Distilled Reasoning (SDR) que permite mejorar el fine-tuning supervisado (SFT) de modelos Amazon Nova 2 cuando los datos de entrenamiento carecen de…