OpenAI a mis GPT-5.4 mini dans ChatGPT le 18 mars 2026. Pas dans le sélecteur de modèles. Pas avec une annonce fracassante. Juste là, en dessous, qui tourne quand ça en a besoin. Le truc c’est que ça touche directement les utilisateurs sur le plan gratuit, et la plupart ne s’en sont pas rendu compte. Voilà ce que t’as besoin de savoir. Ce que tu vas apprendre :

  • Comment GPT-5.4 mini arrive dans ChatGPT via la fonction Thinking sans apparaître dans le menu
  • Pourquoi OpenAI l’utilise comme filet de sécurité lors des pics d’utilisation
  • Ce que les utilisateurs gratuits gagnent concrètement avec ce déploiement discret
  • Comment GPT-5.4 mini s’inscrit dans la stratégie plus large de modèles compacts chez OpenAI
  • Quels anciens modèles disparaissent et selon quel calendrier

Ce qu’OpenAI a annoncé exactement

Le 18 mars 2026, OpenAI a déployé GPT-5.4 mini dans ChatGPT. Sauf qu’il n’est pas apparu dans la liste déroulante de sélection de modèles où tu choisis entre GPT-5.4, GPT-5.4 Thinking, ou d’autres options. Le déploiement était délibérément discret. Ce modèle a deux rôles spécifiques dans l’écosystème ChatGPT. Premier rôle : il est accessible gratuitement via la fonction Thinking, ce mode de raisonnement en plusieurs étapes qu’OpenAI a intégré à ChatGPT. Deuxième rôle : il sert de fallback automatique quand GPT-5.4 Thinking est sous pression de capacité.

Maquette au trait de l'interface ChatGPT avec le menu de sélection de modèles ouvert, listant GPT-5, GPT-5 Thinking, GPT-5 mini, GPT-4o et More models, à côté d'une étiquette pointillée signalant que GPT-5.4 mini n'apparaît pas dans la liste.
Le sélecteur de modèles de ChatGPT, schématisé : quatre entrées visibles, aucune ligne pour GPT-5.4 mini — qui circule en coulisse via Thinking et le fallback automatique.

OpenAI a aussi précisé que GPT-5.4 mini ne resterait pas disponible comme option sélectionnable indéfiniment. Le retrait de cette option est prévu environ 30 jours après le 18 mars 2026. Ce qui signifie que la fenêtre où ce modèle faisait partie d’une route accessible directement était déjà limitée dès le départ.

Les chiffres derrière l’annonce

Événement Date Durée Plan visé
Déploiement GPT-5.4 mini 18 mars 2026 Continu Gratuit + payant
Retrait GPT-5.4 mini comme option sélectionnable ~17 avril 2026 30 jours Tous
Retraite GPT-4.5 de ChatGPT 27 juin 2026 30 jours Tous
Retraite OpenAI o3 de ChatGPT 26 août 2026 90 jours Tous
Retraite des modèles GPT-5.1 11 mars 2026 Continu API + ChatGPT
Plan ChatGPT Prix mensuel
Free 0 $US/mois
Go 8 $US/mois
Plus 20 $US/mois
Business 25 $US/mois (ou 20 $US/mois en facturation annuelle)
Pro 5x 100 $US/mois
Pro 200 $US/mois

Le contexte

Comment on en est arrivé là

OpenAI gère des millions d’utilisateurs actifs sur ChatGPT, dont une portion significative sur le plan gratuit. La fonction Thinking, qui permet à un modèle de raisonner en plusieurs étapes avant de répondre, est computationnellement coûteuse. Donner accès à GPT-5.4 Thinking directement à tout le monde sur le plan gratuit sans filet de sécurité côté capacité serait risqué pour la stabilité du service. La solution d’OpenAI : déployer un modèle plus léger, GPT-5.4 mini, qui peut gérer les demandes Thinking quand GPT-5.4 Thinking est saturé. C’est une décision d’ingénierie d’infrastructure autant qu’une décision produit. L’utilisateur final obtient un résultat de raisonnement, même si le modèle sous-jacent bascule.

Diagramme du flux d'une requête Thinking dans ChatGPT : un losange de décision teste la disponibilité de GPT-5.4 Thinking, redirige vers GPT-5.4 mini en cas de saturation, les deux branches convergent vers une réponse identique côté utilisateur.
Routage interne d'une requête Thinking : ChatGPT tente d'abord GPT-5.4 Thinking ; si la capacité manque, il bascule en pointillé ambré vers GPT-5.4 mini — fallback absent du sélecteur — sans que la réponse finale, elle, ne change d'apparence.

Il y a un précédent direct dans la gamme OpenAI qui éclaire cette logique. Dans Codex, OpenAI applique un mécanisme similaire : GPT-5-Codex-Mini prend le relais automatiquement quand un utilisateur atteint 90% de la limite d’usage de 5 heures allouée. Ce modèle offre aussi jusqu’à 4x plus d’usage comparé à GPT-5-Codex dans les mêmes fenêtres d’accès, et GPT-5.3-Codex tourne environ 25% plus rapidement que son prédécesseur. Ces chiffres viennent directement d’OpenAI et donnent un repère sur l’ambition réelle derrière les modèles compacts.

La retraite progressive des anciens modèles

Ce déploiement ne se passe pas dans le vide. OpenAI fait une purge simultanée du catalogue ChatGPT. Les modèles GPT-5.1 ont été retirés le 11 mars 2026, soit une semaine avant l’arrivée de GPT-5.4 mini. GPT-4.5 disparaîtra de ChatGPT le 27 juin 2026, après une période de préavis de 30 jours. OpenAI o3 suivra le 26 août 2026, avec une période de transition plus longue de 90 jours.

Ce nettoyage progressif n’est pas anodin. Chaque modèle qu’OpenAI maintient en vie coûte en infrastructure, en mises à jour de sécurité, en tests de compatibilité API. Consolider autour d’une gamme plus restreinte (GPT-5.4, GPT-5.4 mini, et leurs variantes Thinking) permet à OpenAI de concentrer ses ressources. Et pour les utilisateurs, ça simplifie le choix, même si ça enlève de la flexibilité.

À retenir ici : la retraite d’anciens modèles et le déploiement discret de GPT-5.4 mini sont deux faces de la même stratégie. OpenAI consolide le catalogue vers le bas (moins de modèles à maintenir) et vers le haut (des capacités de raisonnement accessibles même gratuitement).


GPT-5.4 mini via la fonction Thinking : comment ça fonctionne

La fonction Thinking dans ChatGPT permet au modèle de générer une chaîne de raisonnement interne avant de formuler une réponse visible. C’est particulièrement utile pour des problèmes mathématiques, des questions à plusieurs étapes logiques, ou des tâches de codage complexes. GPT-5.4 Thinking est la version principale qui gère ça. GPT-5.4 mini entre en jeu dans deux scénarios. Quand un utilisateur sur le plan gratuit active Thinking, c’est souvent GPT-5.4 mini qui tourne en arrière-plan, pas GPT-5.4 Thinking complet. Et quand GPT-5.4 Thinking reçoit plus de demandes que sa capacité peut absorber, les requêtes supplémentaires basculent automatiquement vers GPT-5.4 mini.

Maquette d'UI de ChatGPT montrant un panneau Thinking en cours de génération, sans indication du modèle utilisé.
Conversation ChatGPT avec la fonction Thinking activée : le panneau de raisonnement se déroule en direct, mais aucun nom de modèle n'apparaît sous la réponse.

Ce qui est notable : l’interface ne t’informe pas toujours explicitement de quel modèle traite ta requête dans ces situations. Tu vois Thinking en action, tu vois un résultat, mais le modèle sous-jacent a peut-être basculé sans notification proéminente. C’est un choix d’UX d’OpenAI : priorité à l’expérience fluide, pas à la transparence granulaire sur l’infrastructure.

Le rôle de fallback lors des pics d’utilisation

Le concept de modèle fallback n’est pas une nouveauté en soi dans le domaine des systèmes distribués. Ce qui est nouveau, c’est qu’OpenAI l’applique maintenant ouvertement à une expérience utilisateur grand public. Historiquement, les fallbacks étaient des détails d’architecture API que seuls les développeurs géraient dans leur code. Pis là tu te dis : pourquoi pas juste limiter les utilisateurs gratuits à moins d’accès Thinking au lieu de déployer un modèle entier en coulisse? La réponse probable est stratégique. Un utilisateur qui obtient une réponse de raisonnement, même de GPT-5.4 mini, reste dans l’expérience ChatGPT. Un utilisateur bloqué par un message « capacité insuffisante, réessaie plus tard » teste d’autres options.

Diagramme comparatif au trait montrant à gauche un utilisateur recevant un message d'erreur de capacité saturée, et à droite le même utilisateur recevant une réponse via GPT-5.4 mini en fallback automatique.
Deux trajets, une même saturation : à gauche, la requête bute sur GPT-5 et l'utilisateur reçoit une erreur ; à droite, GPT-5.4 mini prend le relais en silence et la conversation continue.

La gestion de la capacité serveur est donc la raison principale de ce déploiement, mais elle sert aussi un objectif de rétention. GPT-5.4 mini permet à OpenAI de dire oui là où ils auraient dû dire non. Dans un marché où Anthropic, Google, et d’autres ont tous des offres gratuites avec des capacités de raisonnement, chaque friction compte.

Soyons clairs : GPT-5.4 mini comme fallback n’est pas un service dégradé invisible. C’est une décision architecturale documentée par OpenAI. La transparence était limitée au moment du déploiement, mais le mécanisme est réel et délibéré.


Pourquoi GPT-5.4 mini n’apparaît pas dans le sélecteur de modèles

C’est la question que beaucoup d’utilisateurs se posent. Si ce modèle existe et tourne dans ChatGPT, pourquoi est-ce qu’il n’est pas dans la liste déroulante comme GPT-5.4 ou GPT-5.4 Thinking? Plusieurs raisons probables s’empilent. Premièrement, afficher GPT-5.4 mini dans le sélecteur créerait de la confusion sur le positionnement : si les utilisateurs peuvent choisir entre GPT-5.4 et GPT-5.4 mini directement, ça soulève immédiatement la question de la différence de qualité. OpenAI préfère visiblement gérer cette différence en arrière-plan plutôt que de forcer l’utilisateur à faire un choix qu’il n’est pas équipé pour évaluer sans documentation technique.

Maquette du sélecteur de modèles ChatGPT listant trois options principales, avec une annotation indiquant que GPT-5.4 mini n'apparaît pas dans la liste mais reste actif en arrière-plan.
Le sélecteur ne montre que les modèles principaux ; GPT-5.4 mini reste hors menu, activé via Thinking ou en fallback automatique.

Deuxièmement, OpenAI a confirmé que GPT-5.4 mini ne resterait pas comme option sélectionnable longtemps après son déploiement du 18 mars 2026. La fenêtre de 30 jours suggère que l’accès direct n’était peut-être qu’une phase transitoire ou de test, pas une fonctionnalité permanente. Après ça, le modèle continue d’exister et de fonctionner, mais uniquement via les routes Thinking et fallback.

Ce que les utilisateurs gratuits gagnent concrètement

Avant GPT-5.4 mini, un utilisateur sur le plan gratuit avait accès à des modèles plus limités pour le raisonnement. L’accès à Thinking était rationné, et les modèles de raisonnement de pointe étaient en grande partie réservés aux plans payants. GPT-5.4 mini change ça de façon pratique : les utilisateurs gratuits peuvent maintenant accéder à un niveau de raisonnement en plusieurs étapes sans payer 20 $US/mois pour le plan Plus. Ce n’est pas équivalent à GPT-5.4 Thinking complet. Un modèle compact comme GPT-5.4 mini fait des compromis par rapport à son grand frère, typiquement en profondeur de raisonnement, en capacité à gérer des contextes très longs, ou en nuance sur des tâches complexes. Mais pour des questions de niveau intermédiaire, des problèmes logiques standard, ou des tâches de codage courant, la différence pratique est souvent négligeable pour l’utilisateur moyen.

Diagramme comparatif à deux colonnes opposant GPT-5.4 Thinking complet et GPT-5.4 mini sur trois axes : profondeur de raisonnement, vitesse, et disponibilité pour les utilisateurs gratuits.
Lecture en miroir : à gauche le Thinking complet (raisonnement profond, plus lent, accès rationné), à droite le mini (raisonnement allégé, vitesse accrue, disponibilité quasi continue). Les deux convergent vers un même point — le fallback automatique qui bascule silencieusement de l'un à l'autre selon la charge.

Le gain concret pour l’utilisateur gratuit, c’est aussi la continuité du service. Avant un fallback automatique, une demande Thinking en période de forte affluence aurait pu retourner une erreur ou une réponse non-Thinking. Maintenant, la demande est traitée, juste potentiellement par un modèle plus léger. Pour quelqu’un qui utilise ChatGPT ponctuellement pour des questions complexes, cette fiabilité améliorée a une valeur réelle.

Positionnement de GPT-5.4 mini dans la gamme OpenAI

OpenAI a depuis un moment une stratégie de modèles compacts parallèles à ses modèles principaux. GPT-4o mini, o1-mini, et maintenant GPT-5.4 mini suivent tous la même logique : un modèle plus petit, moins coûteux à faire tourner, qui couvre une portion importante des cas d’usage à une fraction du coût computationnel. Ce positionnement sert plusieurs objectifs simultanément. Pour OpenAI, réduire le coût marginal de chaque requête augmente les marges sur les plans gratuits et bas de gamme. Pour les développeurs qui accèdent aux modèles via l’API, un modèle compact moins cher permet des applications avec un volume de requêtes beaucoup plus élevé. Pour les utilisateurs finaux, c’est un accès à des capacités de raisonnement sans débourser pour les plans haut de gamme.

Le pattern établi avec Codex est instructif. GPT-5-Codex-Mini offre jusqu’à 4x plus d’usage que GPT-5-Codex pour les mêmes fenêtres d’accès. Ça veut dire qu’un développeur ou une équipe peut faire tourner beaucoup plus de requêtes avec le modèle compact avant d’atteindre les limites. GPT-5.4 mini dans ChatGPT suit la même logique : maximiser la portée du service avec des ressources optimisées.

Diagramme pyramidal des modèles OpenAI dans ChatGPT, du sommet Pro à la base gratuite, mettant en évidence GPT-5.4 mini comme couche transversale accessible à tous via Thinking.
Pyramide éditoriale des modèles ChatGPT : au sommet, GPT-5.4 Pro réservé au plan Pro ; au centre, GPT-5.4 pour Plus et Team ; juste en dessous, GPT-5.4 mini — hachuré car invisible dans le sélecteur — qui s'active via Thinking et en fallback pour tous les plans, y compris gratuit ; à la base, GPT-4o mini, socle historique du plan gratuit.

Sauf que la vraie affaire dans ce positionnement, c’est ce que ça dit de la direction stratégique d’OpenAI en 2026. L’entreprise ne mise plus seulement sur « le plus grand modèle possible ». Elle construit une grille de modèles à différents niveaux de capacité et de coût, et elle orchestre les bascules automatiquement en arrière-plan. L’utilisateur final interagit avec une interface unifiée pendant qu’OpenAI optimise quel modèle tourne sous le capot.

Ce que ça change pour toi

OK check ça. Si tu utilises ChatGPT sur le plan gratuit et que tu actives la fonction Thinking, tu accèdes maintenant à un niveau de raisonnement qui n’était pas disponible gratuitement avant mars 2026. C’est un gain réel, même si le modèle sous-jacent n’est pas le plus puissant de la gamme. Si tu utilises le plan Plus (20 $US/mois) ou un plan supérieur, GPT-5.4 mini comme fallback signifie que tes requêtes Thinking seront traitées même en période de forte affluence, possiblement par un modèle moins puissant que ce que tu penses utiliser. C’est le compromis qu’OpenAI fait pour toi sans te demander ton avis.

Maquette au trait d'une interface mobile ChatGPT avec mode Thinking actif et réponse en cours de génération
Schéma éditorial d'une session ChatGPT sur mobile : bulle utilisateur en haut, indicateur « Thinking » actif et lignes de réponse en cours de génération, soulignant l'apparition silencieuse du raisonnement dans l'app.

Si tu accèdes aux modèles OpenAI via l’API pour tes projets, GPT-5.4 mini va probablement devenir disponible comme option de déploiement directe, à un coût inférieur à GPT-5.4. Ça mérite d’être dans ton radar si tu optimises des coûts d’inférence. La question à te poser : est-ce que la qualité de raisonnement de GPT-5.4 mini est suffisante pour ton usage? Pour la majorité des tâches quotidiennes sur ChatGPT gratuit, la réponse est probablement oui. Pour des analyses complexes ou des tâches où chaque nuance compte, tu voudras confirmer que tu tournes sur GPT-5.4 Thinking complet, ce qui implique généralement un plan payant avec moins de pression de capacité.

Le verdict : GPT-5.4 mini est le genre de changement infrastructure qu’OpenAI déploie discrètement parce qu’il est difficile à marketer mais facile à justifier. Meilleure disponibilité du service Thinking, coût serveur réduit, accès au raisonnement étendu aux plans gratuits. Pas de fanfare nécessaire. Le modèle tourne, les requêtes passent, la plupart des utilisateurs ne voient pas la différence.


Conclusion

GPT-5.4 mini est arrivé dans ChatGPT le 18 mars 2026 par la porte de service, sans annonce dans le sélecteur de modèles, sans grande campagne de communication. Son rôle est double et pragmatique : rendre la fonction Thinking accessible gratuitement, et absorber la surcharge quand GPT-5.4 Thinking est sous pression. Le calendrier de consolidation est clair. GPT-4.5 disparaît le 27 juin 2026, OpenAI o3 suit le 26 août 2026. OpenAI simplifie le catalogue pendant qu’il déploie des couches d’automatisation qui gèrent la qualité de l’expérience sans exposer la complexité à l’utilisateur. Prochaine étape concrète : active la fonction Thinking sur le plan gratuit si tu ne l’as pas encore fait, et teste-la sur une vraie tâche de raisonnement. C’est maintenant disponible sans abonnement. Compare le résultat avec ce que tu obtenais avant, et décide si ça justifie ou non de rester sur le plan gratuit pour tes besoins. C’est tout.

On continue à la Taverne ?

Un courriel par semaine. Pas de fluff.

En t'abonnant, tu reçois Le Tour de Table chaque semaine. Tu peux te désabonner en un clic. Voir notre politique de confidentialité.

Texte par David Cyr