Descripción
OpenAI está lanzando gpt-oss-120b y gpt-oss-20b, dos modelos de lenguaje de peso abierto de última generación que ofrecen un sólido rendimiento en el mundo real a bajo costo. Estos modelos están disponibles bajo la flexible licencia Apache 2.0 y superan a modelos abiertos de tamaño similar en tareas de razonamiento. Demuestran fuertes capacidades de uso de herramientas y están optimizados para un despliegue eficiente en hardware de consumo.
El modelo gpt-oss-120b logra una paridad casi total con OpenAI o4-mini en los principales benchmarks de razonamiento mientras se ejecuta de manera eficiente en una sola GPU de 80 GB. El modelo gpt-oss-20b ofrece resultados similares a OpenAI o3-mini en benchmarks comunes y puede ejecutarse en dispositivos de borde con solo 16 GB de memoria. Esto lo hace ideal para casos de uso en el dispositivo, inferencia local o iteración rápida sin infraestructura costosa. Ambos modelos también tienen un rendimiento sólido en el uso de herramientas, llamadas a funciones con pocos ejemplos y razonamiento en cadena.
La seguridad es fundamental para el enfoque de OpenAI al lanzar modelos, particularmente para modelos abiertos. Los modelos gpt-oss han pasado por una capacitación y evaluaciones de seguridad exhaustivas, asegurando que cumplan con altos estándares de seguridad. OpenAI también ha colaborado con socios iniciales para explorar aplicaciones en el mundo real, proporcionando estos modelos para empoderar a desarrolladores, empresas y gobiernos para ejecutar y personalizar IA en su propia infraestructura.
Los modelos gpt-oss fueron entrenados utilizando técnicas avanzadas de preentrenamiento y postentrenamiento, enfocándose en el razonamiento, la eficiencia y la usabilidad en diversos entornos de despliegue. Cada modelo es un Transformer que aprovecha la mezcla de expertos para optimizar el rendimiento. Los modelos admiten tres niveles de esfuerzo de razonamiento: bajo, medio y alto, permitiendo a los desarrolladores ajustar el rendimiento según sus necesidades.
Los pesos de ambos modelos están disponibles para su descarga gratuita en Hugging Face y vienen nativamente cuantizados en MXFP4. Esto permite un uso eficiente de la memoria, haciendo que los modelos sean flexibles y fáciles de ejecutar localmente o a través de proveedores de terceros. OpenAI está comprometido a fomentar un ecosistema saludable de modelos abiertos, alentando a desarrolladores e investigadores a experimentar e innovar con estas poderosas herramientas.
Aspectos destacados de gpt-oss
Modelos de peso abierto
Licencia Apache 2.0
Fuertes capacidades de razonamiento
Soporte para uso de herramientas
Personalizable
Despliegue eficiente
Admite inferencia local
Arquitectura de mezcla de expertos
Primeros pasos con gpt-oss
Acceder al modelo: Visita el sitio web de OpenAI para acceder a gpt-oss.
Autenticarse: Configura una cuenta si es necesario para acceder al modelo.
Configurar el entorno: Prepara tu entorno de desarrollo para la integración.
Integrar a través de API: Utiliza la API proporcionada para integrar gpt-oss en tu aplicación.
Optimizar: Ajusta los parámetros del modelo para el rendimiento según tu caso de uso específico.
Casos de uso de gpt-oss
- IA en el dispositivo
- Inferencia local
- Iteración rápida
- Integración de herramientas
- Soluciones de IA personalizadas






