Compartir:
Los modelos de lenguaje grandes, conocidos por su eficacia en tareas generales, enfrentan desafíos cuando se trata de trabajos especializados que requieren comprensión de datos internos y terminología específica. Para superar estas barreras, el fine-tuning supervisado (SFT) se presenta como una solución, permitiendo adaptar estos modelos a contextos organizacionales. Hay dos metodologías destacadas en este proceso: el ajuste de parámetros eficientes (PEFT) y el SFT de rango completo. La primera permite un entrenamiento más rápido y económico al actualizar solo algunos parámetros, mientras que la segunda actualiza todos, incorporando así un conocimiento más amplio del dominio.
No obstante, el SFT de rango completo puede conllevar el «olvido catastrófico», un fenómeno donde los modelos, al especializarse, pierden capacidades generales como el razonamiento y el conocimiento general. Esto representa un dilema para las organizaciones: optar por la especialización o mantener la inteligencia general, lo que limita la utilidad del modelo en diferentes contextos empresariales.
Amazon busca resolver este dilema con Nova Forge, una innovadora herramienta que posibilita a los usuarios construir modelos personalizados, combinando datos propios con los de entrenamiento de Amazon, y gestionándolos en AWS. Una evaluación realizada por el equipo de ciencia aplicada de AWS China destacó las ventajas de Nova Forge con una tarea compleja de clasificación de la Voz del Cliente (VOC). A través del análisis de comentarios de clientes, los resultados mostraron un 17% de mejora en el puntaje F1 en el rendimiento de tareas de dominio y la preservación de capacidades generales, manteniendo habilidades como el seguimiento de instrucciones.
Este avance es crucial para grandes empresas de comercio electrónico que manejan volúmenes masivos de comentarios de clientes. La necesidad de categorizar estos comentarios automáticamente con alta precisión resalta la importancia de modelos que no solo sean especializados, sino también capaces de realizar tareas generales como generar respuestas adecuadas y redactar documentación siguiendo pautas específicas.
La evaluación incluyó un enfoque dual para medir el rendimiento específico del dominio y la capacidad general del modelo. Al utilizar un conjunto de datos real de reseñas de clientes, los modelos ajustados con Nova Forge mostraron mejoras significativas en el F1-score, subrayando la efectividad de la mezcla de datos en mitigar el olvido catastrófico.
Estos hallazgos sugieren que al emplear una mezcla de datos durante el ajuste, es posible mantener un alto rendimiento en tareas específicas sin perder capacidades generales. Nova Forge demuestra así cómo es posible construir modelos de IA especializados sin sacrificar la inteligencia general, ofreciendo beneficios significativos en el desarrollo e implementación de soluciones de IA en entornos empresariales.








