Compartir:
Hoy se han lanzado los innovadores modelos de razonamiento de NVIDIA, Llama 3.3 Nemotron Super 49B V1 y Llama 3.1 Nemotron Nano 8B V1, los cuales ya están disponibles en Amazon Bedrock Marketplace y Amazon SageMaker JumpStart. Estos avances permiten a las organizaciones desarrollar y expandir sus iniciativas de inteligencia artificial generativa de manera responsable en la plataforma de AWS.
La integración con los microservicios de inferencia de NVIDIA NIM facilita el uso de modelos de IA generativa, aprovechando los servicios gestionados de AWS. Estas soluciones están diseñadas para acelerar el despliegue de IA, permitiendo a los desarrolladores integrar aplicaciones con solo un comando o unas pocas líneas de código.
El modelo Llama 3.3 Nemotron Super 49B V1 ha sido optimizado utilizando el enfoque de Búsqueda de Arquitectura Neuronal (NAS), lo que reduce su huella de memoria y aumenta su eficiencia. Ofrece un notable soporte para contextos de hasta 128,000 tokens, ideal para tareas complejas como la generación aumentada de datos. Por otro lado, el Llama 3.1 Nemotron Nano 8B V1 se presenta como una opción más compacta que se puede usar localmente, manteniendo capacidades mejoradas.
Amazon Bedrock Marketplace facilita una experiencia unificada y segura para acceder a modelos de IA, permitiendo a las organizaciones encontrar lo que más se ajuste a sus necesidades. Estos modelos abarcan una amplia variedad de aplicaciones, desde la creación de contenido hasta la clasificación de información.
Para comenzar a usar estos modelos, los usuarios solo necesitan suscribirse en Amazon Bedrock y seguir unos sencillos pasos para desplegarlos. Las inferencias se pueden realizar directamente en la consola de Bedrock o a través del SDK de SageMaker.
En resumen, la introducción de los modelos Llama 3.3 y Llama 3.1 significa un avance significativo para las empresas que buscan implementar soluciones avanzadas de AI. Aprovechando la infraestructura escalable de AWS, las empresas pueden implementar estos modelos de manera fácil y rápida, mejorando sus aplicaciones de inteligencia artificial con tecnologías de vanguardia.










