OpenAI a présenté GPT-6 Soleil et GPT-6 Lunedeux modèles qui s'ajoutent à GPT-6 Astra au sein de sa famille GPT-6. L'entreprise baisse les prix de son API de 50 % par rapport au tarif promotionnel GPT-5.6, ce qui vous intéresse si vous travaillez avec des agents ou si vous automatisez des tâches à grande échelle, car cela réduit directement le coût de chaque token traité.
Voyons ce que chaque modèle apporte. Sol et Luna partagent une méthodologie de formation avec Astra et héritent de leurs avancées en matière de travail professionnel, de fiabilité factuelle, de programmation et de gestion informatique, axées sur la rentabilité. Les améliorations apportées à la mise en cache et à l'inférence permettent à ces modèles d'être servis à moindre coût, répercutant ainsi les économies sur ceux qui les utilisent. Astra reste le choix de référence pour le plus haut niveau de précision.
Combien coûte l'utilisation de GPT-6 Sol y Luna par million de jetons ?
Les nouveaux prix par million de jetons ressemblent à ceci : GPT-6 Soleil passe de 4 à 2 dollars à l'entrée et de 20 à 10 dollars à la sortie ; GPT-6 Luna passe de 0,20 à 0,10 dollars à l'entrée et de 1,20 à 0,50 dollars à la sortie. Dans les deux cas, la remise est de 50 % par rapport au tarif promotionnel dont bénéficiaient GPT-5.6 Sol et GPT-5.6 Luna, et remplace directement ce tarif précédent dans le catalogue API.
GPT-6 Astra, présenté des semaines plus tôt au cours du même mois, est exclu de cette coupe. Si vous avez besoin de réduire votre budget pour des tâches massives, Sol y Luna est désormais l'option la plus raisonnable ; Si votre projet ne prend pas en charge les erreurs, vous disposez toujours d'Astra, même si cela coûte plus cher par jeton traité. C’est cette différence de prix qui détermine quel modèle choisir en fonction du volume de demandes que vous gérez chaque jour.
Sol contre Claude Opus 5 dans les tâches d'automatisation
Dans Banc d'automatisationun test avec 47 outils de vente, de marketing, d'opérations, de support, de finance et de ressources humaines, GPT-6 Sol avec un effort élevé (xhigh) atteint un taux de réussite de 33,2 % pour 0,27 $ par tâche. Claude Opus 5, à son effort maximum, reste à 26,9% et coûte 11,1 fois plus cher par tâche.
La comparaison avec d'autres modèles : GPT-6 Astra à faible effort atteint 30,3% pour un coût 3,9 fois supérieur à celui du Sol, et Claude Fable 5.1 avec réserve Opus 5 atteint 31,4% avec une dépense 8,9 fois supérieure (un chiffre qui n'inclut pas le coût des relances Opus 5, activées dans environ 40% des tâches). Dans Dernier examen des agentsavec des tâches longues réparties sur 55 sous-secteurs professionnels, GPT-6 Sol avec effort maximum obtient un score de 56,4%, au-dessus du meilleur résultat de Claude Opus 5, avec un coût inférieur de 60%. GPT-6 Luna, avec un effort élevé, améliore de 5,4 points de pourcentage par rapport à son prédécesseur et réduit le coût par tâche de 58 %.
Moins d'erreurs factuelles, proche du niveau d'Astra
OpenAI mesure la fiabilité factuelle avec conversations réelles et anonymes de ChatGPT dans lequel les utilisateurs avaient signalé une erreur d'un modèle précédent. Sur cette base, GPT-6 Soleil Il commet environ deux fois moins d'erreurs que son prédécesseur, se rapprochant du niveau d'Astra à un coût bien inférieur. Il s'agit d'informations pertinentes si vous utilisez ces modèles pour des tâches où la précision des données finales l'emporte sur la vitesse de réponse.
GPT-6 Luna s'améliore également sensiblement : à des niveaux d'effort plus élevés, est égal à GPT-5.6 Sol mais avec un coût qui avoisine le centième. L'entreprise elle-même précise que ces conversations avec des erreurs marquées ne représentent pas un usage habituel, où les erreurs factuelles sont beaucoup plus rares, et que les scores ne sont pas ajustés en fonction de la longueur de réponse, bien que ses tests de variation de longueur aient montré une dépendance presque nulle à ce facteur. Il est conseillé de garder cette nuance à l’esprit avant d’extrapoler les pourcentages à une conversation quotidienne.
En programmation, évalué avec FrontierCode (un test qui juge si le code généré par un agent est prêt à être fusionné dans de véritables référentiels, sur la base de la qualité des tests, de la discipline de portée et du style), GPT-6 Sol s'améliore considérablement par rapport à GPT-5.6 Sol et se rapproche de Claude Fable 5.1 en termes d'efforts élevés, à un coût bien inférieur.
FAQ GPT-6 Soleil et Lune GPT-6 Sol coûte 2 $ par million de jetons pour entrer et 10 $ pour sortir. GPT-6 Luna coûte 0,10 $ en entrée et 0,50 $ en sortie, soit 50 % de moins que le tarif promotionnel de GPT-5.6 dans les deux cas.
Dans AutomationBench, GPT-6 Sol à effort élevé atteint 33,2% contre 26,9% pour Claude Opus 5 à effort maximum, avec un coût par tâche 11,1 fois inférieur.
GPT-6 Sol commet environ deux fois moins d'erreurs factuelles que son prédécesseur, se rapprochant de la fiabilité du GPT-6 Astra mais à un coût bien inférieur.
Avec un effort élevé, GPT-6 Luna améliore 5,4 points de pourcentage dans AutomationBench par rapport à son prédécesseur et réduit le coût par tâche de 58 %.
Combien coûte l’API GPT-6 Soleil et Lune ?
Comment GPT-6 Sol se compare-t-il à Claude Opus 5 ?
Comment la fiabilité factuelle s’améliore-t-elle dans ces nouveaux modèles ?
Qu’est-ce que GPT-6 Luna améliore par rapport à son prédécesseur ?