OpenAI construit sa propre puce pour faire tourner ChatGPT à moindre coût

— Business

OpenAI dévoile Jalapeño, son premier processeur pensé pour exécuter ses modèles déjà entraînés, avec jusqu'à 1,9 fois plus de réponses produites pour la même énergie consommée. Aucune baisse de prix n'est annoncée, et les chiffres viennent d'un système encore en phase de test.

OpenAI construit sa propre puce pour faire tourner ChatGPT à moindre coût

Une entreprise qui fabrique ses propres modèles finit toujours par vouloir fabriquer aussi le matériel qui les fait tourner. OpenAI franchit cette étape avec Jalapeño, un processeur conçu pour exécuter ChatGPT, Codex et les services vendus par API, une fois l'apprentissage des modèles terminé. Sur les tests présentés, la puce produit jusqu'à 1,9 fois plus de réponses pour la même quantité d'électricité que les systèmes concurrents habituels.

La matière ne cite aucun graphiste, aucun studio, aucune agence utilisant cette puce. L'objet reste une brique d'infrastructure, réservée aux centres de calcul d'OpenAI et à ses partenaires industriels, Broadcom et Celestica. Mais tout ce qui fait tourner ChatGPT ou une API dépend de ce type de matériel, et ce sont ces mêmes services que beaucoup de studios interrogent déjà pour rédiger un brief, adapter un texte de campagne ou automatiser une tâche répétitive derrière un outil créatif.

Le raisonnement économique tient en une phrase simple : chaque réponse générée coûte de l'électricité, et une puce plus efficace réduit ce coût à grande échelle. OpenAI en tire un avantage sur sa propre facture, et potentiellement sur sa capacité à absorber davantage d'utilisateurs sans construire de nouveaux centres à l'identique.

Aucune baisse tarifaire n'accompagne pourtant l'annonce. Un gain d'efficacité peut tout aussi bien financer des marges plus confortables, des modèles plus lourds ou une demande en hausse, sans qu'un euro de moins n'arrive jamais sur une facture d'abonnement ou d'API.

Les chiffres avancés proviennent d'un système en phase de validation, testé et présenté par OpenAI elle-même, sans que Jalapeño équipe encore l'infrastructure qui répond aux centaines de millions de personnes utilisant ses produits. Le déploiement réel n'est prévu qu'avant la fin de 2026.

Ce genre de puce ne change rien à la qualité d'une réponse ni à la créativité d'un modèle. Elle décide de la vitesse à laquelle cette réponse arrive et du prix qu'elle coûtera à produire, deux paramètres qui finissent toujours par se refléter, tôt ou tard, dans le tarif d'un abonnement ou la fluidité d'un outil du quotidien.

Sources

Umiros Média