Modèles et LLM

GPT-4.5 d’OpenAI : des échanges plus naturels, mais un modèle très coûteux

OpenAI a dévoilé GPT-4.5 le 27 février 2025, un modèle présenté comme plus naturel dans la conversation et plus attentif aux intentions de son interlocuteur. Cette version expérimentale réduit certaines erreurs factuelles face à GPT-4o, mais son prix élevé et ses limites en raisonnement restreignent ses usages.

Une personne échange avec un assistant d’intelligence artificielle sur un écran d’ordinateur, dans un espace de travail.
Illustration : Actu.ai

Le nouvel arrivant d’OpenAI ne cherche pas seulement à écrire des textes plus fluides. Avec GPT-4.5, dévoilé le 27 février 2025, l’entreprise veut améliorer ce qui fait souvent la différence dans un échange avec une intelligence artificielle : comprendre une demande formulée de façon imparfaite, saisir le ton attendu et proposer une réponse utile sans obliger l’utilisateur à tout reformuler. La promesse est séduisante, mais elle s’accompagne d’un tarif qui réserve pour l’instant le modèle aux usages les plus exigeants.

GPT-4.5 est lancé comme un aperçu de recherche, et non comme un remplaçant immédiat de tous les modèles précédents. OpenAI entend observer son comportement dans des situations réelles, recueillir les retours des utilisateurs et des développeurs, puis déterminer les cas où ses qualités justifient son coût. Cette nuance est importante : le modèle marque une évolution visible dans la qualité des interactions, mais il ne règle pas toutes les faiblesses des assistants conversationnels.

Ce qu’OpenAI lance réellement avec GPT-4.5

GPT-4.5 est un grand modèle de langage, ou LLM. Comme ses prédécesseurs, il produit une réponse en prédisant, mot après mot, la suite la plus probable et la plus pertinente d’un texte. Il peut recevoir du texte et des images, puis générer du texte. Son intérêt ne repose donc pas sur une faculté humaine de compréhension au sens strict, mais sur un entraînement et des méthodes d’apprentissage qui lui permettent de mieux repérer les régularités du langage, les relations entre les idées et le contexte d’une requête.

OpenAI décrit GPT-4.5 comme son modèle de discussion le plus performant à ce stade. L’entreprise met particulièrement en avant la montée en puissance de l’apprentissage non supervisé, une phase où le modèle absorbe des régularités à partir de très grands volumes de données sans recevoir une correction humaine détaillée pour chaque exemple. En pratique, OpenAI affirme que cette approche aide GPT-4.5 à produire des réponses plus nuancées, à tirer davantage de liens entre les informations et à faire preuve de davantage de créativité.

Le positionnement du modèle est cependant très précis. GPT-4.5 n’est pas un modèle de raisonnement comparable aux modèles de la série o, tels qu’o3-mini. Ces derniers sont conçus pour consacrer davantage de calcul à un problème avant de répondre, notamment en mathématiques, en programmation ou dans les tâches logiques à plusieurs étapes. GPT-4.5 répond plus directement : il vise la qualité générale de l’échange, la formulation et la pertinence contextuelle.

Pourquoi les échanges paraissent-ils plus humains ?

L’expression d’« intelligence émotionnelle » employée autour de GPT-4.5 mérite d’être expliquée avec prudence. Il ne s’agit pas d’une émotion ressentie par la machine. OpenAI désigne plutôt la capacité du modèle à mieux détecter l’intention d’une personne, le niveau de détail recherché, les implicites et certains signaux sociaux dans une conversation.

Cette amélioration peut compter dans de nombreux échanges ordinaires. Une personne qui demande de réécrire un message délicat, de préparer une réponse professionnelle, de trouver des idées ou de comprendre un sujet complexe ne veut pas toujours une simple liste de faits. Elle attend un ton adapté, une structure claire et, parfois, la prise en compte d’une hésitation exprimée entre les lignes. OpenAI estime que GPT-4.5 est plus à l’aise dans ce type de dialogue et le décrit comme davantage capable de converser de manière naturelle.

Ce gain de naturel peut aussi réduire une difficulté fréquente avec les assistants : l’art de rédiger la bonne consigne. Lorsqu’un système comprend mieux une demande ambiguë, l’utilisateur doit moins souvent détailler son objectif, son public ou le format désiré. Cela ne dispense pas de donner des instructions précises pour une tâche importante, mais cela peut rendre les premiers échanges moins mécaniques.

Pour les créateurs de contenus, les équipes de communication ou les services clients, la promesse est donc celle d’un assistant qui propose un brouillon plus proche de l’intention initiale. Pour un particulier, elle peut se traduire par des explications plus pédagogiques, une aide à l’organisation ou un dialogue plus agréable. Dans tous les cas, la qualité dépendra toujours de la demande et de la vérification humaine du résultat.

Une fiabilité factuelle en hausse, sans garantie d’exactitude

OpenAI affirme que GPT-4.5 produit moins d’informations inventées que GPT-4o. C’est un point central, car les « hallucinations » restent l’un des principaux défauts des modèles génératifs : ils peuvent fournir une réponse fluide et convaincante tout en contenant un fait erroné, une date fausse ou une référence inexistante.

Pour étayer cette amélioration, l’entreprise publie notamment des résultats sur SimpleQA, une évaluation de questions factuelles courtes. Les chiffres ci-dessous comparent les résultats communiqués par OpenAI pour GPT-4.5 et GPT-4o.

Mesure sur l’évaluation SimpleQAGPT-4.5GPT-4o
Réponses correctes62,5 %38,2 %
Taux d’hallucinations37,1 %61,8 %

Ces résultats montrent un progrès net sur ce test particulier, mais ils ne doivent pas être lus comme une garantie de fiabilité universelle. Un benchmark évalue un protocole donné, avec un ensemble défini de questions. Il ne mesure pas, à lui seul, la précision du modèle dans tous les domaines, toutes les langues ou tous les contextes professionnels.

Surtout, un taux d’hallucinations de 37,1 % rappelle que le risque ne disparaît pas. Pour une décision médicale, juridique, financière, administrative ou de sécurité, une réponse générée ne doit pas être considérée comme une source suffisante. Il faut contrôler les affirmations importantes à partir de documents de référence et consulter un professionnel lorsque la situation l’exige.

Qui peut utiliser GPT-4.5 et à quel prix ?

Au 2 mars 2025, GPT-4.5 est d’abord accessible aux abonnés ChatGPT Pro et aux développeurs utilisant les niveaux payants de l’API d’OpenAI. L’accès n’est donc pas réservé à l’API, contrairement à ce que pourrait laisser penser une présentation trop rapide du lancement : il existe aussi dans ChatGPT pour les abonnés Pro.

OpenAI a annoncé un déploiement progressif. Les abonnés ChatGPT Plus et Team doivent recevoir l’accès au cours de la semaine suivant l’annonce, puis les clients Enterprise et Edu la semaine d’après. Cette diffusion par étapes permet à l’entreprise de suivre la demande, de recueillir des retours et d’évaluer les usages du modèle à grande échelle.

Pour les développeurs, le prix constitue le principal obstacle. Les modèles facturent leur usage en jetons, des unités de texte qui ne correspondent pas exactement aux mots. Un million de jetons représente environ plusieurs centaines de milliers de mots en anglais, avec une conversion qui varie selon la langue et le contenu.

Usage facturé dans l’APITarif GPT-4.5
1 million de jetons en entrée75 dollars
1 million de jetons en sortie150 dollars
1 million de jetons mis en cache37,50 dollars

Ce niveau de prix rend GPT-4.5 difficile à rentabiliser pour un chatbot grand public recevant un très grand volume de messages. Il peut en revanche intéresser des applications où une réponse particulièrement soignée vaut davantage que le coût de calcul : accompagnement rédactionnel haut de gamme, assistants internes employés sur des dossiers limités, génération de contenu à forte valeur ou phases de prototypage.

GPT-4.5 face à GPT-4o : ce qui change

GPT-4.5

  • Davantage orienté vers les conversations naturelles et les nuances de ton.
  • 62,5 % de réponses correctes sur SimpleQA selon les mesures publiées par OpenAI.
  • 37,1 % d’hallucinations sur SimpleQA, contre 61,8 % pour GPT-4o.
  • 75 dollars par million de jetons en entrée et 150 dollars en sortie.
  • Accès initial limité à ChatGPT Pro et aux développeurs API payants.

GPT-4o

  • Modèle plus accessible et déjà largement intégré aux usages de ChatGPT.
  • 38,2 % de réponses correctes sur SimpleQA dans la comparaison d’OpenAI.
  • 61,8 % d’hallucinations sur cette même évaluation factuelle.
  • 2,50 dollars par million de jetons en entrée et 10 dollars en sortie dans l’API.
  • Mieux adapté aux applications nécessitant un coût d’usage maîtrisé.

Quels usages peuvent justifier ce modèle ?

Le principal terrain de GPT-4.5 est celui des tâches ouvertes, conversationnelles et créatives. Dans ces situations, il n’existe pas forcément une réponse unique et l’utilisateur attend surtout une bonne interprétation de son besoin.

Parmi les usages les plus cohérents figurent :

  • la rédaction et la révision de textes, lorsque le ton, la clarté et l’adaptation à un destinataire sont essentiels ;
  • l’idéation, par exemple pour explorer des angles, des plans, des slogans ou des pistes de projets ;
  • l’assistance à la communication client, avec une validation humaine avant l’envoi des réponses ;
  • l’explication pédagogique et l’accompagnement dans des échanges où il faut reformuler progressivement ;
  • l’analyse qualitative de retours utilisateurs, à condition de protéger les données transmises au service.

Dans un service client, par exemple, la valeur ne consiste pas à laisser l’IA répondre seule à toutes les demandes. Elle peut aider un agent à résumer un historique, à produire une première réponse courtoise ou à adapter une explication à un client mécontent. La responsabilité de la décision finale et du contrôle des informations reste toutefois humaine.

Le modèle n’est pas nécessairement le choix rationnel pour chaque besoin. Une extraction de données structurées, une classification simple de messages, une question factuelle courte ou une tâche répétitive peuvent souvent être réalisées avec un modèle moins cher. Le bon choix dépend du volume, du niveau de risque, de l’exigence de qualité et de la possibilité de vérifier les sorties.

GPT-4.5 n’est pas encore GPT-5

Le nom choisi nourrit naturellement les attentes autour de GPT-5. Pourtant, OpenAI présente GPT-4.5 comme une étape distincte. Dans sa feuille de route publiée en février 2025, l’entreprise indique qu’il s’agit de son dernier modèle qui ne repose pas sur une approche de raisonnement de type chaîne de pensée. Elle prévoit ensuite de rapprocher les capacités conversationnelles de la série GPT et les capacités de raisonnement de la série o dans de futurs systèmes.

Cette stratégie explique la place particulière de GPT-4.5. Il ne cherche pas à battre les modèles de raisonnement sur tous les exercices de logique ou de calcul. Il explore plutôt ce que des progrès dans l’apprentissage non supervisé peuvent apporter à la connaissance générale, à la conversation et à la qualité perçue des réponses.

OpenAI a bien confirmé travailler vers GPT-5, mais n’a pas annoncé de date précise de lancement à ce stade. Il serait donc hasardeux de présenter GPT-4.5 comme une simple version d’attente ou de lui attribuer des capacités qui appartiendraient à un futur modèle. Pour les utilisateurs, la distinction pratique est simple : GPT-4.5 privilégie la qualité de conversation, tandis que les modèles de raisonnement sont plus adaptés quand il faut résoudre méthodiquement un problème complexe.

Des limites techniques et des précautions à conserver

Même amélioré, GPT-4.5 peut se tromper, mal interpréter une demande ou présenter une hypothèse comme un fait. Son comportement reste probabiliste : il génère une réponse plausible à partir de son entraînement et du contexte fourni, il ne consulte pas automatiquement une vérité incontestable.

Les utilisateurs professionnels doivent aussi réfléchir aux données qu’ils transmettent. Un échange peut contenir des informations personnelles, des documents confidentiels, des éléments stratégiques ou des données de clients. Avant toute intégration dans une organisation, il convient de vérifier les conditions de service, les paramètres de confidentialité disponibles et les règles internes applicables.

Enfin, il faut éviter d’attribuer au système une intention ou une empathie qu’il ne possède pas. Un ton compréhensif peut améliorer une expérience utilisateur, mais il ne remplace ni le discernement d’un conseiller, ni l’écoute d’un proche, ni l’expertise d’un professionnel dans une situation sensible.

Ce qu’il faut surveiller après ce lancement

Les prochaines semaines diront si GPT-4.5 trouve une place durable malgré son coût. Les retours des développeurs seront déterminants : il faudra mesurer non seulement la qualité perçue des réponses, mais aussi le gain de temps réel, le taux de corrections nécessaires et le coût total par utilisateur.

Il faudra également observer la disponibilité effective du modèle pour les abonnés Plus, Team, Enterprise et Edu, ainsi que les évolutions éventuelles de ses tarifs. OpenAI assume que GPT-4.5 est un modèle coûteux à servir. Si ses capacités conversationnelles deviennent centrales dans les produits d’IA, l’entreprise devra démontrer qu’elles peuvent être proposées à une échelle économiquement viable.

Pour le grand public, GPT-4.5 illustre surtout une tendance majeure de l’IA générative : la compétition ne porte plus uniquement sur la capacité à répondre à une question, mais sur la manière de comprendre ce que la personne essaie réellement d’obtenir. Le progrès est tangible, mais la règle demeure la même : utiliser l’assistant comme un outil de travail et de réflexion, jamais comme une autorité infaillible.

Questions fréquentes

Qu’est-ce que GPT-4.5 d’OpenAI ?

GPT-4.5 est un modèle de langage présenté le 27 février 2025 sous la forme d’un aperçu de recherche. OpenAI le conçoit pour améliorer la qualité des conversations, la compréhension des intentions et la pertinence des réponses. Il accepte du texte et des images en entrée, puis produit du texte en sortie.

GPT-4.5 est-il plus intelligent que GPT-4o ?

GPT-4.5 obtient de meilleurs résultats que GPT-4o sur l’évaluation factuelle SimpleQA publiée par OpenAI, avec 62,5 % de bonnes réponses contre 38,2 %. Il est aussi présenté comme plus naturel dans les échanges. Cela ne signifie pas qu’il est supérieur dans toutes les tâches, notamment celles qui demandent un raisonnement méthodique.

GPT-4.5 peut-il comprendre ou ressentir les émotions humaines ?

Non. GPT-4.5 ne ressent pas d’émotions et ne possède pas de conscience. OpenAI emploie l’expression d’intelligence émotionnelle pour désigner une meilleure détection du ton, des intentions et de certains indices sociaux dans le texte. Cette capacité peut rendre le dialogue plus agréable, mais elle reste le résultat d’un traitement statistique du langage.

Combien coûte l’API de GPT-4.5 ?

L’API de GPT-4.5 est facturée 75 dollars par million de jetons en entrée, 150 dollars par million de jetons en sortie et 37,50 dollars pour les jetons mis en cache. Ces tarifs sont très supérieurs à ceux de GPT-4o, ce qui réserve surtout le modèle à des cas où la qualité de réponse justifie un coût élevé.

Quand GPT-5 sera-t-il disponible ?

Au 2 mars 2025, OpenAI a confirmé travailler sur GPT-5 dans le cadre d’une feuille de route visant à combiner conversation et raisonnement, mais n’a pas donné de date de sortie précise. GPT-4.5 doit donc être considéré comme un lancement autonome, et non comme une annonce de disponibilité imminente de GPT-5.

Sources

Références consultées pour la rédaction de cet article. Les adresses sont indiquées à titre informatif et ne sont pas des liens.

  1. OpenAI, présentation de GPT-4.5openai.com/index/introducing-gpt-4-5
  2. OpenAI, feuille de route pour GPT-4.5 et GPT-5openai.com/index/openai-roadmap-update-for-gpt-4-5-and-gpt-5
  3. OpenAI, documentation des tarifs de l’APIopenai.com/api/pricing
  4. OpenAI, carte système de GPT-4.5cdn.openai.com