Modelos GPT OSS de OpenAI Disponibles en SageMaker JumpStart

Elena Digital López

OpenAI ha lanzado al mercado sus nuevos modelos de peso abierto, GPT OSS, que incluyen el gpt-oss-120b y el gpt-oss-20b. Estos modelos están disponibles para desarrolladores y empresas a través de Amazon SageMaker JumpStart, permitiéndoles implementar y escalar ideas de inteligencia artificial generativa en la plataforma de Amazon Web Services (AWS).

Los modelos GPT OSS destacan en tareas de programación, análisis científico y razonamiento matemático. Cuentan con una ventana de contexto de 128K y ofrecen niveles ajustables de razonamiento, lo que permite personalizar su rendimiento. Además, integran herramientas externas y pueden ser utilizados en flujos de trabajo de inteligencia artificial con frameworks como Strands Agents. Su capacidad para generar cadenas de pensamientos proporciona una visión detallada del proceso de razonamiento del modelo.

SageMaker JumpStart proporciona un servicio completamente gestionado con modelos de última generación para diversas aplicaciones, como la redacción de contenido, generación de código y clasificación. Ofrece acceso a un amplio catálogo de modelos preentrenados que se pueden desplegar fácilmente, simplificando el desarrollo de aplicaciones de aprendizaje automático.

Los desarrolladores pueden acceder a los modelos de OpenAI desde Amazon SageMaker Studio o mediante el SDK de Python de SageMaker. Las características de Amazon SageMaker, como Pipelines y Debugger, permiten optimizar el rendimiento del modelo y el control de operaciones de aprendizaje automático en un entorno seguro de AWS.

Los modelos están disponibles en regiones específicas de AWS, como US East (Ohio, N. Virginia) y Asia Pacífico (Mumbai, Tokio). Para utilizarlos, los usuarios necesitan una cuenta en AWS, un rol de IAM para la gestión de SageMaker, y acceso a SageMaker Studio o a un entorno de desarrollo interactivo.

El despliegue del modelo gpt-oss-120b requiere ciertos procedimientos en SageMaker Studio o a través del SDK de Python, como definir el nombre del endpoint y seleccionar el tipo adecuado de instancia GPU para un rendimiento óptimo.

OpenAI ha introducido un sistema de búsqueda en la web mediante EXA, una API basada en significados, que enriquece las respuestas de los modelos con información actualizada. Los usuarios deben obtener una clave API de EXA para utilizar este servicio y configurarla en su entorno de despliegue.

Finalmente, se aconseja eliminar los recursos creados tras el uso del modelo para evitar cargos adicionales. Con esta iniciativa, OpenAI reafirma su compromiso con la accesibilidad y la potencia de la inteligencia artificial en entornos empresariales, fomentando la innovación en múltiples sectores.

Scroll al inicio