Modèles et LLM

GPT-4.1 : OpenAI réduit ses coûts face à la pression de DeepSeek

OpenAI a présenté GPT-4.1 le 14 avril 2025, une nouvelle famille de modèles conçue pour les développeurs. Avec une fenêtre de contexte d’un million de jetons, de meilleurs résultats en programmation et un coût annoncé inférieur de 26 % sur les requêtes médianes, le groupe cherche aussi à rester compétitif dans une guerre des prix ravivée par DeepSeek.

Équipe comparant les performances, le contexte et les coûts de modèles d’intelligence artificielle.
Illustration : Actu.ai

OpenAI ne présente pas seulement un modèle plus performant : avec GPT-4.1, l’entreprise revoit aussi l’équation économique de l’intelligence artificielle générative. Annoncée le 14 avril 2025, cette nouvelle famille de modèles entend mieux répondre aux besoins très concrets des développeurs, de l’écriture de code à l’analyse de documents volumineux, tout en abaissant le coût de nombreuses requêtes par rapport à GPT-4o.

Le timing est révélateur. Depuis le début de l’année 2025, l’essor de modèles chinois à bas coût, en particulier ceux de DeepSeek, a remis le prix des grands modèles de langage au centre de la compétition. OpenAI ne dit pas que GPT-4.1 est une réponse directe à DeepSeek. Mais la réduction tarifaire annoncée s’inscrit clairement dans un secteur où les entreprises comparent désormais aussi attentivement les factures d’API que les performances des modèles.

GPT-4.1, un modèle d’abord destiné aux développeurs

GPT-4.1 est proposé via l’API d’OpenAI, l’interface qui permet à une entreprise ou à un développeur d’intégrer le modèle dans un site, un logiciel, un assistant client ou un outil interne. À son lancement, il n’est donc pas présenté comme un nouveau choix direct dans ChatGPT pour le grand public.

OpenAI décline cette génération en trois offres : GPT-4.1, le modèle principal, GPT-4.1 mini, conçu pour concilier capacités et prix, et GPT-4.1 nano, la version la plus rapide et la moins coûteuse. Cette segmentation reflète un usage devenu courant dans les entreprises : réserver le modèle le plus avancé aux tâches difficiles, et confier les demandes simples ou répétitives à un modèle allégé.

Le changement le plus spectaculaire concerne la quantité d’informations que GPT-4.1 peut lire en une fois. Son contexte peut atteindre un million de jetons. Un jeton n’est pas exactement un mot : il s’agit d’une unité de texte manipulée par le modèle, qui peut correspondre à un mot court, une partie de mot ou un signe de ponctuation. À cette échelle, il devient possible de soumettre de longs contrats, un vaste historique de conversations, des milliers de pages de documentation ou une grande base de code sans devoir les découper aussi finement qu’auparavant.

Pourquoi OpenAI annonce-t-il une baisse de coûts de 26 % ?

OpenAI indique que GPT-4.1 est 26 % moins cher que GPT-4o pour les requêtes médianes. Cette formule mérite une explication : il ne s’agit pas d’une baisse uniforme de 26 % sur chaque ligne de la grille tarifaire. Le prix d’une requête varie selon le volume de texte envoyé au modèle, le volume de texte généré en réponse et l’usage éventuel d’un cache.

Dans l’API, les clients paient généralement au million de jetons. Pour le modèle GPT-4.1 principal, OpenAI affiche un tarif de 2 dollars pour un million de jetons en entrée et de 8 dollars pour un million de jetons générés en sortie. À titre de comparaison, GPT-4o est facturé 2,50 dollars en entrée et 10 dollars en sortie. Les requêtes qui réutilisent une partie identique de leur contexte peuvent bénéficier d’un prix encore réduit grâce à la mise en cache.

ModèlePrix d’entrée pour 1 million de jetonsPrix de sortie pour 1 million de jetonsPositionnement
GPT-4.12 dollars8 dollarsModèle principal pour les tâches complexes
GPT-4.1 mini0,40 dollar1,60 dollarCompromis entre coût, vitesse et capacités
GPT-4.1 nano0,10 dollar0,40 dollarTâches simples, nombreuses et sensibles au coût
GPT-4o2,50 dollars10 dollarsModèle de la génération précédente servant de référence

OpenAI augmente aussi l’avantage lié au cache de prompts. Lorsqu’une application envoie régulièrement les mêmes instructions de départ, par exemple les règles d’un assistant de service client ou le manuel d’une entreprise, la partie déjà connue du modèle coûte moins cher à retraiter. Pour GPT-4.1, la remise sur ces jetons mis en cache atteint 75 %.

C’est un élément particulièrement important pour les produits à forte fréquentation. Dans une démonstration ponctuelle, le prix d’un modèle peut sembler secondaire. À l’échelle de milliers ou de millions de conversations, une baisse de quelques centimes par million de jetons devient une décision d’architecture et de budget.

GPT-4.1 face à GPT-4o : les changements essentiels

GPT-4.1

  • Jusqu’à un million de jetons de contexte.
  • 2 dollars en entrée et 8 dollars en sortie par million de jetons.
  • 26 % moins cher sur les requêtes médianes, selon OpenAI.
  • 54,6 % sur SWE-bench Verified selon OpenAI.
  • Remise de 75 % sur les jetons mis en cache.

GPT-4o

  • Fenêtre de contexte inférieure à celle annoncée pour GPT-4.1.
  • 2,50 dollars en entrée et 10 dollars en sortie par million de jetons.
  • Référence tarifaire utilisée par OpenAI pour mesurer la baisse.
  • 33,2 % sur SWE-bench Verified selon les chiffres comparatifs d’OpenAI.
  • Remise de 50 % sur les jetons mis en cache.

Des progrès ciblés sur le code et le suivi des consignes

GPT-4.1 n’est pas présenté comme un simple changement de nom. OpenAI met en avant des améliorations dans trois domaines : la programmation, le suivi d’instructions et le traitement de longues quantités de texte.

Sur SWE-bench Verified, un benchmark qui évalue la capacité d’un modèle à résoudre des problèmes issus de véritables projets logiciels, GPT-4.1 obtient 54,6 %. Selon OpenAI, cela représente un gain de 21,4 points par rapport à GPT-4o. Ce type de mesure doit être lu avec prudence. Il renseigne sur des exercices standardisés, pas sur la capacité à remplacer un ingénieur logiciel dans toutes les situations. Il donne néanmoins une indication utile : le modèle est davantage entraîné à modifier du code, comprendre une demande technique et produire un correctif exploitable.

OpenAI met également en avant le benchmark MultiChallenge, consacré au respect de consignes complexes. GPT-4.1 y atteint 38,3 %, contre 27,8 % pour GPT-4o, d’après les chiffres du groupe. Pour un utilisateur, ce progrès peut se traduire par moins de reformulations nécessaires lorsqu’une demande comporte plusieurs contraintes : respecter un format précis, exploiter un document fourni, répondre dans une langue définie ou suivre une procédure métier.

Enfin, le modèle obtient 72 % sur Video-MME pour les vidéos longues, contre 65,3 % pour GPT-4o selon OpenAI. Même si cette évaluation porte sur la compréhension vidéo, elle illustre l’objectif général de GPT-4.1 : mieux conserver et utiliser les éléments pertinents lorsqu’une requête contient beaucoup d’informations.

DeepSeek, le révélateur d’une nouvelle guerre des prix

L’arrivée de GPT-4.1 intervient dans un environnement radicalement plus concurrentiel qu’un an auparavant. DeepSeek a attiré l’attention mondiale au début de 2025 avec des modèles capables de rivaliser sur certaines tâches de raisonnement et de programmation, tout en affichant des coûts d’usage très bas. Cette stratégie a mis sous pression les acteurs établis, à commencer par OpenAI, mais aussi les fournisseurs de modèles américains et européens.

Il serait toutefois réducteur de résumer le marché au seul prix par jeton. Les entreprises choisissent un modèle en fonction d’un ensemble de critères : qualité des résultats, vitesse, stabilité du service, confidentialité des données, outils disponibles, facilité d’intégration et assistance technique. Un modèle moins cher qui nécessite beaucoup de vérifications ou de corrections peut, au final, coûter davantage qu’un modèle plus onéreux mais plus fiable sur une tâche précise.

OpenAI dispose à cet égard d’un vaste écosystème d’outils et d’une forte présence auprès des développeurs. Avec GPT-4.1, l’entreprise tente de préserver cet avantage tout en réduisant l’écart de prix avec les nouveaux entrants. Son message est double : offrir de meilleures performances techniques sans réserver ces gains aux applications disposant des budgets les plus élevés.

Quels usages concrets pour les entreprises ?

La grande fenêtre de contexte et les améliorations de suivi des consignes visent des cas d’usage où les générations précédentes montraient des limites. Une entreprise pourrait, par exemple, utiliser GPT-4.1 pour interroger sa documentation interne, assister les équipes informatiques dans la maintenance d’un logiciel ou extraire des éléments d’un ensemble important de documents.

Les trois déclinaisons de la gamme permettent d’adapter le choix à la nature de chaque demande :

  • GPT-4.1 peut être réservé à l’analyse de code, aux dossiers complexes et aux assistants nécessitant une forte qualité de réponse.
  • GPT-4.1 mini peut convenir à la synthèse de documents, au tri de demandes ou à des assistants internes sollicités fréquemment.
  • GPT-4.1 nano vise les opérations très nombreuses et plus simples, comme la classification de messages, la détection d’informations structurées ou le routage de requêtes.

La promesse économique dépendra donc moins du seul tarif affiché que de la façon dont l’outil est intégré. Envoyer systématiquement un million de jetons n’a pas de sens si quelques paragraphes suffisent. À l’inverse, pouvoir transmettre un dossier complet peut éviter de perdre des informations importantes lors d’un découpage excessif des documents.

Les organisations doivent aussi prévoir des garde-fous. Un modèle de langage peut inventer une référence, mal interpréter une instruction ambiguë ou produire du code qui semble correct sans l’être. Le déploiement d’une IA générative suppose de définir les données autorisées, de tester les réponses sur des cas réels, de protéger les informations confidentielles et de conserver un contrôle humain proportionné aux risques.

Ce qu’OpenAI change dans sa gamme de modèles

Le lancement de GPT-4.1 s’accompagne d’une clarification progressive du catalogue d’OpenAI. L’entreprise indique que GPT-4.5 Preview sera retiré de l’API le 14 juillet 2025, après une période de préavis pour les développeurs. OpenAI présente GPT-4.1 comme une solution plus performante ou comparable à GPT-4.5 Preview dans plusieurs capacités clés, à un coût nettement inférieur et avec une latence plus faible.

Cette décision montre que la course aux modèles ne consiste plus seulement à lancer la version la plus grande possible. Les fournisseurs doivent désormais démontrer qu’ils peuvent proposer un rapport entre puissance, rapidité et coût adapté à des services réellement déployés. Les développeurs, eux, disposent de plus en plus souvent de plusieurs modèles complémentaires plutôt que d’un unique moteur universel.

Ce qu’il faut surveiller

Le principal test de GPT-4.1 se jouera dans les usages réels. Les évaluations publiées par OpenAI donnent des repères utiles, notamment sur le code et le suivi des consignes, mais les entreprises devront vérifier si ces progrès se retrouvent sur leurs propres données, leurs langues de travail et leurs contraintes métiers.

La question tarifaire restera également décisive. DeepSeek a contribué à accélérer une dynamique de baisse des prix et à rendre plus visible le coût de l’IA générative. OpenAI répond avec des modèles moins coûteux et une meilleure tarification du cache, sans renoncer à la montée en capacité technique. Cette concurrence peut profiter aux utilisateurs, à condition qu’elle ne fasse pas oublier les enjeux de sécurité, de confidentialité et de qualité.

Enfin, la fenêtre de contexte d’un million de jetons ouvre des possibilités nouvelles, mais elle change aussi la nature des risques. Plus un modèle reçoit d’informations, plus les entreprises doivent veiller à ce qu’il ne traite que les données nécessaires et autorisées. L’enjeu pour GPT-4.1 ne sera pas uniquement de lire davantage, mais d’aider à produire des résultats réellement vérifiables, utiles et maîtrisés.

Questions fréquentes

Qu’est-ce que GPT-4.1 d’OpenAI ?

GPT-4.1 est une nouvelle famille de modèles de langage dévoilée par OpenAI le 14 avril 2025. Elle comprend GPT-4.1, GPT-4.1 mini et GPT-4.1 nano. Au lancement, ces modèles sont accessibles par l’API d’OpenAI, pour être intégrés dans des applications et services, plutôt que comme une nouvelle option directement proposée dans ChatGPT.

Pourquoi GPT-4.1 est-il annoncé 26 % moins cher que GPT-4o ?

OpenAI indique que GPT-4.1 revient 26 % moins cher que GPT-4o pour des requêtes médianes. Ce pourcentage dépend de la composition des requêtes, notamment du texte envoyé, du texte généré et de l’usage du cache. Les tarifs affichés pour GPT-4.1 passent à 2 dollars par million de jetons en entrée et 8 dollars en sortie.

Quelle est la différence entre GPT-4.1, GPT-4.1 mini et GPT-4.1 nano ?

GPT-4.1 est le modèle principal, destiné aux tâches complexes telles que le code ou l’analyse approfondie de documents. GPT-4.1 mini cherche un équilibre entre coût, vitesse et performances. GPT-4.1 nano est l’option la plus économique pour les tâches simples et répétitives, comme le tri, la classification ou l’extraction d’informations.

GPT-4.1 est-il meilleur pour programmer ?

OpenAI met fortement en avant les progrès de GPT-4.1 en programmation. Sur le benchmark SWE-bench Verified, le modèle atteint 54,6 %, contre 33,2 % pour GPT-4o selon les données de l’entreprise. Ce résultat ne dispense pas de relire et tester le code généré : un benchmark ne reproduit pas toutes les contraintes d’un projet réel.

DeepSeek a-t-il obligé OpenAI à baisser ses prix ?

OpenAI n’affirme pas que le lancement de GPT-4.1 ou sa baisse de coûts répond directement à DeepSeek. Mais la montée de modèles concurrents à faible coût, dont DeepSeek, accentue la pression concurrentielle sur le marché. Dans ce contexte, le prix par jeton et l’efficacité opérationnelle deviennent des critères aussi importants que les performances brutes.

Sources

Références consultées pour la rédaction de cet article. Les adresses sont indiquées à titre informatif et ne sont pas des liens.

  1. OpenAI, annonce officielle de GPT-4.1, 14 avril 2025openai.com/index/gpt-4-1
  2. OpenAI, grille tarifaire de l’APIopenai.com/api/pricing
  3. OpenAI, calendrier de dépréciation des modèlesplatform.openai.com/docs/deprecations
  4. DeepSeek, documentation et tarifs de l’APIapi-docs.deepseek.com/quick_start/pricing