Openai a fait un mouvement que la communauté technologique mondiale ne s'attendait pas. Maintenant que les utilisateurs attendent GPT-5 et à leur arrivée imminente, la société mère de Chatgpt a lancé GPT-ASS-120B et GPT-OSS-20B. Deux modèles linguistiques de l'intelligence artificielle ouverte. Autrement dit, téléchargeable, révisable et personnalisable par tout utilisateur qui le souhaite.
Publiés sous la licence Apache 2.0, ces modèles surprennent le retour du public et de Mark Openai à l'IA Open après plusieurs années. Et ce qui est plus important: il envoie des capacités avancées de l'IA pour tous les types d'utilisateurs et de professionnels qui souhaitent utiliser Chatgpt sans avoir besoin de dépendre du cloud OpenAI.
Même ainsi, le modèle 120b ne nécessite qu'un GB 80 Go Travailler. Quelque chose qui n'est pas à la portée des ordinateurs les plus standard. Pour sa part, le modèle 20B est beaucoup plus accessible, car il peut être exécuté dans des ordinateurs qui ont 16 Go de RAM. Les deux ont été formés dans les disciplines STEM, c'est-à-dire le raisonnement, la santé et la programmation, et ont obtenu des résultats exceptionnels dans des repères.
L'importance des modèles « Open-Weight »
Le lancement des modèles 120b et 20b d'OpenAI est livré avec l'étiquette « poids ouvert » ou le poids ouvert. Mais l'importance de ce type de modèles souligne que les informations logicielles et les paramètres formés sont disponibles pour tout utilisateur ou entreprise. Autrement dit, il vous permet d'exécuter l'IA localement, d'auditer son fonctionnement et de l'adapter à des tâches spécifiques. Et pour cela, il n'est pas nécessaire d'utiliser un type d'API ou de passer par un serveur externe.
Même ainsi, nous ne devons pas les confondre avec les modèles open source traditionnels, car dans les modèles open source également Le code source est partagéDonnées d'architecture et de formation. Quelque chose pour lequel les modèles ouverts ne sont pas régis. Ce qui signifie qu'ils ne peuvent pas être reconstruits ou ressentis à partir de zéro.
Caractéristiques techniques de GPT-OSS-120B et 20B
De la part de GPT-OSS-120B, selon la déclaration officielle d'Openai le 6 août, nous trouvons un modèle qui a 117 000 millions de paramètres, de petites valeurs que l'IA utilise pour prendre des décisions et répondre aux questions. De plus, il est construit avec la technologie « Transformer » et utilise une technique de fonctionnement connue sous le nom de «mélange de réseaux». Ce dernier signifie que le modèle peut décider quelle partie de son système utiliser pour chaque tâche, gagnant en efficacité et en flexibilité.
Lorsque vous l'utilisez, 5 100 millions de ces paramètres sont activés à chaque fois qu'il génère un mot ou une réponse. De plus, il a la capacité de lire très longs textes à la fois. Et avec longtemps, nous nous référons à environ 128 000 mots. Il est donc idéal si nous avons besoin d'aide avec de grandes quantités d'informations ou d'informations sur les conversations.
La partie la plus complexe de ses exigences est son besoin d'une carte graphique que 80 Go, qui, bien qu'elle soit très optimisée, en ce qui concerne sa puissance, nous sommes avant tout un défi pour les utilisateurs individuels. Mais il est plus accessible par les laboratoires de recherche ou les grandes entreprises. En outre, ses performances améliorent même les principaux modèles tels que la famille « O4 » du Chatgpt lui-même dans les tâches logiques, les mathématiques et les problèmes de santé.
Quant à GPT-OSS-20nous trouvons un système plus petit, conçu avec 21 000 millions de paramètres et 24 blocs de traitement. Sa grande qualité est qu'il est possible de travailler sur PC avec seulement 16 Go de RAM. Ce qui le rend beaucoup plus accessible à tout utilisateur individuel. Cette optimisation rend le modèle 20B plus accessible aux utilisateurs avec du matériel plus commun, comme RAM 16. Une étape qui démocratise l'accès à une IA haute performance.
De plus, il offre des résultats qui sont équipés également de modèles OpenAI avancés, tels que la famille de « O3 ». Mettre en évidence surtout en mathématiques et en connaissances médicales.
| Fonctionnalité | GPT-OSS-120B | GPT-OSS-20B |
|---|---|---|
| Paramètres totaux | 117 000 millions | 21 000 millions |
| Paramètres actifs (MOE) | 5 100 millions par jeton | 3,6 milliards par jeton |
| Matériel minimum | GPU avec 80 Go de VRM | 16 Go de RAM |
| Fenêtre de contexte | 128 000 jetons | 128 000 jetons |
| Performance équivalente | Près d'Openai O4-MinI | Similaire à Openai O3-MinI |
| Licence | Apache 2.0 | Apache 2.0 |
| Décharge | Visage ouvert / étreint | Visage étreint |