Description
OpenAI publie gpt-oss-120b et gpt-oss-20b, deux modèles de langage à poids ouverts de pointe qui offrent de solides performances dans le monde réel à faible coût. Ces modèles sont disponibles sous la licence flexible Apache 2.0 et surpassent des modèles ouverts de taille similaire sur des tâches de raisonnement. Ils démontrent de fortes capacités d'utilisation d'outils et sont optimisés pour un déploiement efficace sur du matériel grand public.
Le modèle gpt-oss-120b atteint une parité presque totale avec OpenAI o4-mini sur des benchmarks de raisonnement fondamentaux tout en fonctionnant efficacement sur un seul GPU de 80 Go. Le modèle gpt-oss-20b fournit des résultats similaires à OpenAI o3-mini sur des benchmarks courants et peut fonctionner sur des appareils de périphérie avec seulement 16 Go de mémoire. Cela le rend idéal pour des cas d'utilisation sur appareil, des inférences locales ou une itération rapide sans infrastructure coûteuse. Les deux modèles affichent également de solides performances en matière d'utilisation d'outils, d'appels de fonctions avec peu d'exemples et de raisonnement en chaîne.
La sécurité est fondamentale dans l'approche d'OpenAI pour la publication de modèles, en particulier pour les modèles ouverts. Les modèles gpt-oss ont subi une formation et des évaluations de sécurité complètes, garantissant qu'ils respectent des normes de sécurité élevées. OpenAI a également collaboré avec des partenaires précoces pour explorer des applications dans le monde réel, fournissant ces modèles pour permettre aux développeurs, aux entreprises et aux gouvernements de faire fonctionner et de personnaliser l'IA sur leur propre infrastructure.
Les modèles gpt-oss ont été formés en utilisant des techniques avancées de pré-entraînement et de post-entraînement, en se concentrant sur le raisonnement, l'efficacité et l'utilisabilité dans divers environnements de déploiement. Chaque modèle est un Transformer qui exploite un mélange d'experts pour optimiser les performances. Les modèles prennent en charge trois niveaux d'efforts de raisonnement — faible, moyen et élevé — permettant aux développeurs d'ajuster les performances en fonction de leurs besoins.
Les poids des deux modèles sont librement disponibles en téléchargement sur Hugging Face et sont nativement quantifiés en MXFP4. Cela permet une utilisation efficace de la mémoire, rendant les modèles flexibles et faciles à exécuter localement ou via des fournisseurs tiers. OpenAI s'engage à favoriser un écosystème de modèles ouverts sain, encourageant les développeurs et les chercheurs à expérimenter et à innover avec ces outils puissants.
Points forts de gpt-oss
Modèles à poids ouverts
Licence Apache 2.0
Forte capacité de raisonnement
Support de l'utilisation d'outils
Personnalisable
Déploiement efficace
Prend en charge l'inférence locale
Architecture de mélange d'experts
Premiers pas avec gpt-oss
Accéder au modèle : Visitez le site Web d'OpenAI pour accéder à gpt-oss.
Authentifier : Créez un compte si nécessaire pour accéder au modèle.
Configurer l'environnement : Préparez votre environnement de développement pour l'intégration.
Intégrer via l'API : Utilisez l'API fournie pour intégrer gpt-oss dans votre application.
Optimiser : Ajustez les paramètres du modèle pour les performances en fonction de votre cas d'utilisation spécifique.
Cas d'utilisation de gpt-oss
- IA sur appareil
- Inférence locale
- Itération rapide
- Intégration d'outils
- Solutions d'IA personnalisées






