Compartir:
El 5 de agosto de 2025, OpenAI presentó sus modelos GPT-OSS en la plataforma de Amazon, disponibles a través de Amazon SageMaker AI y Amazon Bedrock. Los modelos, denominados gpt-oss-20b y gpt-oss-120b, representan una nueva generación de arquitecturas de Transformer, entrenadas únicamente con textos y destacadas por su implementación de la Mixture-of-Experts (MoE). Esta innovación permite optimizar los recursos computacionales al activar solo una parte de los parámetros por token, mejorando así la eficiencia.
Estos modelos sobresalen en tareas complejas como la programación, el análisis científico y el razonamiento matemático. Además, cuentan con una impresionante longitud de contexto de 128,000 tokens y ofrecen niveles de razonamiento ajustables, así como capacidades de razonamiento estructurado.
La documentación de OpenAI revela que ambos modelos han sido diseñados con especial atención a la seguridad, habiendo superado evaluaciones de afinamiento adversarial para fortalecer su resistencia frente a usos indebidos. La flexibilidad en su implementación es uno de sus principales atractivos, permitiendo ser utilizados directamente a través de Amazon SageMaker JumpStart o mediante las API de Amazon Bedrock.
Una de las características más destacadas es la capacidad de afinar estos modelos, permitiendo ajustar los pesos de un modelo ya entrenado mediante un conjunto de datos específico. Esto facilita adaptarlos a distintos dominios, logrando un desempeño más preciso y adaptado a las necesidades del usuario, sin la necesidad de comenzar el proceso de entrenamiento desde cero.
Asimismo, se ofrece un entorno de gestión completa para el afinamiento de estos modelos mediante herramientas open source que simplifican la distribución del entrenamiento en múltiples GPUs. La técnica de optimización DeepSpeed ZeRO-3 es clave, ya que reduce el uso de memoria, lo que permite entrenar modelos con miles de millones de parámetros de manera más eficaz.
Para el ámbito empresarial, la versatilidad del GPT-OSS lo convierte en una elección ideal para tareas que requieren razonamiento en varios idiomas. Esto es esencial para empresas que buscan herramientas de inteligencia artificial operativas en diversos idiomas y contextos. Los modelos están diseñados para ser implementados con rapidez y ajustarse a necesidades específicas, lo que los hace activos valiosos para la innovación y la automatización dentro de las organizaciones.
En suma, con la introducción de sus modelos GPT-OSS, OpenAI ha dado un paso significativo al ofrecer soluciones de inteligencia artificial avanzadas, integrables fácilmente en procesos empresariales, potenciando el razonamiento y análisis en múltiples idiomas.









