OpenAI a mis GPT-5.4 mini dans ChatGPT le 18 mars 2026. Pas dans le sélecteur de modèles. Pas avec une annonce fracassante. Juste là, en dessous, qui tourne quand ça en a besoin. Le truc c’est que ça touche directement les utilisateurs sur le plan gratuit, et la plupart ne s’en sont pas rendu compte. Voilà ce que t’as besoin de savoir. Ce que tu vas apprendre :
- Comment GPT-5.4 mini arrive dans ChatGPT via la fonction Thinking sans apparaître dans le menu
- Pourquoi OpenAI l’utilise comme filet de sécurité lors des pics d’utilisation
- Ce que les utilisateurs gratuits gagnent concrètement avec ce déploiement discret
- Comment GPT-5.4 mini s’inscrit dans la stratégie plus large de modèles compacts chez OpenAI
- Quels anciens modèles disparaissent et selon quel calendrier
Ce qu’OpenAI a annoncé exactement
Le 18 mars 2026, OpenAI a déployé GPT-5.4 mini dans ChatGPT. Sauf qu’il n’est pas apparu dans la liste déroulante de sélection de modèles où tu choisis entre GPT-5.4, GPT-5.4 Thinking, ou d’autres options. Le déploiement était délibérément discret. Ce modèle a deux rôles spécifiques dans l’écosystème ChatGPT. Premier rôle : il est accessible gratuitement via la fonction Thinking, ce mode de raisonnement en plusieurs étapes qu’OpenAI a intégré à ChatGPT. Deuxième rôle : il sert de fallback automatique quand GPT-5.4 Thinking est sous pression de capacité.
OpenAI a aussi précisé que GPT-5.4 mini ne resterait pas disponible comme option sélectionnable indéfiniment. Le retrait de cette option est prévu environ 30 jours après le 18 mars 2026. Ce qui signifie que la fenêtre où ce modèle faisait partie d’une route accessible directement était déjà limitée dès le départ.
Les chiffres derrière l’annonce
| Événement | Date | Durée | Plan visé |
|---|---|---|---|
| Déploiement GPT-5.4 mini | 18 mars 2026 | Continu | Gratuit + payant |
| Retrait GPT-5.4 mini comme option sélectionnable | ~17 avril 2026 | 30 jours | Tous |
| Retraite GPT-4.5 de ChatGPT | 27 juin 2026 | 30 jours | Tous |
| Retraite OpenAI o3 de ChatGPT | 26 août 2026 | 90 jours | Tous |
| Retraite des modèles GPT-5.1 | 11 mars 2026 | Continu | API + ChatGPT |
| Plan ChatGPT | Prix mensuel |
|---|---|
| Free | 0 $US/mois |
| Go | 8 $US/mois |
| Plus | 20 $US/mois |
| Business | 25 $US/mois (ou 20 $US/mois en facturation annuelle) |
| Pro 5x | 100 $US/mois |
| Pro | 200 $US/mois |
Le contexte
Comment on en est arrivé là
OpenAI gère des millions d’utilisateurs actifs sur ChatGPT, dont une portion significative sur le plan gratuit. La fonction Thinking, qui permet à un modèle de raisonner en plusieurs étapes avant de répondre, est computationnellement coûteuse. Donner accès à GPT-5.4 Thinking directement à tout le monde sur le plan gratuit sans filet de sécurité côté capacité serait risqué pour la stabilité du service. La solution d’OpenAI : déployer un modèle plus léger, GPT-5.4 mini, qui peut gérer les demandes Thinking quand GPT-5.4 Thinking est saturé. C’est une décision d’ingénierie d’infrastructure autant qu’une décision produit. L’utilisateur final obtient un résultat de raisonnement, même si le modèle sous-jacent bascule.
Il y a un précédent direct dans la gamme OpenAI qui éclaire cette logique. Dans Codex, OpenAI applique un mécanisme similaire : GPT-5-Codex-Mini prend le relais automatiquement quand un utilisateur atteint 90% de la limite d’usage de 5 heures allouée. Ce modèle offre aussi jusqu’à 4x plus d’usage comparé à GPT-5-Codex dans les mêmes fenêtres d’accès, et GPT-5.3-Codex tourne environ 25% plus rapidement que son prédécesseur. Ces chiffres viennent directement d’OpenAI et donnent un repère sur l’ambition réelle derrière les modèles compacts.
La retraite progressive des anciens modèles
Ce déploiement ne se passe pas dans le vide. OpenAI fait une purge simultanée du catalogue ChatGPT. Les modèles GPT-5.1 ont été retirés le 11 mars 2026, soit une semaine avant l’arrivée de GPT-5.4 mini. GPT-4.5 disparaîtra de ChatGPT le 27 juin 2026, après une période de préavis de 30 jours. OpenAI o3 suivra le 26 août 2026, avec une période de transition plus longue de 90 jours.
Ce nettoyage progressif n’est pas anodin. Chaque modèle qu’OpenAI maintient en vie coûte en infrastructure, en mises à jour de sécurité, en tests de compatibilité API. Consolider autour d’une gamme plus restreinte (GPT-5.4, GPT-5.4 mini, et leurs variantes Thinking) permet à OpenAI de concentrer ses ressources. Et pour les utilisateurs, ça simplifie le choix, même si ça enlève de la flexibilité.
À retenir ici : la retraite d’anciens modèles et le déploiement discret de GPT-5.4 mini sont deux faces de la même stratégie. OpenAI consolide le catalogue vers le bas (moins de modèles à maintenir) et vers le haut (des capacités de raisonnement accessibles même gratuitement).
GPT-5.4 mini via la fonction Thinking : comment ça fonctionne
La fonction Thinking dans ChatGPT permet au modèle de générer une chaîne de raisonnement interne avant de formuler une réponse visible. C’est particulièrement utile pour des problèmes mathématiques, des questions à plusieurs étapes logiques, ou des tâches de codage complexes. GPT-5.4 Thinking est la version principale qui gère ça. GPT-5.4 mini entre en jeu dans deux scénarios. Quand un utilisateur sur le plan gratuit active Thinking, c’est souvent GPT-5.4 mini qui tourne en arrière-plan, pas GPT-5.4 Thinking complet. Et quand GPT-5.4 Thinking reçoit plus de demandes que sa capacité peut absorber, les requêtes supplémentaires basculent automatiquement vers GPT-5.4 mini.
Ce qui est notable : l’interface ne t’informe pas toujours explicitement de quel modèle traite ta requête dans ces situations. Tu vois Thinking en action, tu vois un résultat, mais le modèle sous-jacent a peut-être basculé sans notification proéminente. C’est un choix d’UX d’OpenAI : priorité à l’expérience fluide, pas à la transparence granulaire sur l’infrastructure.
Le rôle de fallback lors des pics d’utilisation
Le concept de modèle fallback n’est pas une nouveauté en soi dans le domaine des systèmes distribués. Ce qui est nouveau, c’est qu’OpenAI l’applique maintenant ouvertement à une expérience utilisateur grand public. Historiquement, les fallbacks étaient des détails d’architecture API que seuls les développeurs géraient dans leur code. Pis là tu te dis : pourquoi pas juste limiter les utilisateurs gratuits à moins d’accès Thinking au lieu de déployer un modèle entier en coulisse? La réponse probable est stratégique. Un utilisateur qui obtient une réponse de raisonnement, même de GPT-5.4 mini, reste dans l’expérience ChatGPT. Un utilisateur bloqué par un message « capacité insuffisante, réessaie plus tard » teste d’autres options.
La gestion de la capacité serveur est donc la raison principale de ce déploiement, mais elle sert aussi un objectif de rétention. GPT-5.4 mini permet à OpenAI de dire oui là où ils auraient dû dire non. Dans un marché où Anthropic, Google, et d’autres ont tous des offres gratuites avec des capacités de raisonnement, chaque friction compte.
Soyons clairs : GPT-5.4 mini comme fallback n’est pas un service dégradé invisible. C’est une décision architecturale documentée par OpenAI. La transparence était limitée au moment du déploiement, mais le mécanisme est réel et délibéré.
Pourquoi GPT-5.4 mini n’apparaît pas dans le sélecteur de modèles
C’est la question que beaucoup d’utilisateurs se posent. Si ce modèle existe et tourne dans ChatGPT, pourquoi est-ce qu’il n’est pas dans la liste déroulante comme GPT-5.4 ou GPT-5.4 Thinking? Plusieurs raisons probables s’empilent. Premièrement, afficher GPT-5.4 mini dans le sélecteur créerait de la confusion sur le positionnement : si les utilisateurs peuvent choisir entre GPT-5.4 et GPT-5.4 mini directement, ça soulève immédiatement la question de la différence de qualité. OpenAI préfère visiblement gérer cette différence en arrière-plan plutôt que de forcer l’utilisateur à faire un choix qu’il n’est pas équipé pour évaluer sans documentation technique.
Deuxièmement, OpenAI a confirmé que GPT-5.4 mini ne resterait pas comme option sélectionnable longtemps après son déploiement du 18 mars 2026. La fenêtre de 30 jours suggère que l’accès direct n’était peut-être qu’une phase transitoire ou de test, pas une fonctionnalité permanente. Après ça, le modèle continue d’exister et de fonctionner, mais uniquement via les routes Thinking et fallback.
Ce que les utilisateurs gratuits gagnent concrètement
Avant GPT-5.4 mini, un utilisateur sur le plan gratuit avait accès à des modèles plus limités pour le raisonnement. L’accès à Thinking était rationné, et les modèles de raisonnement de pointe étaient en grande partie réservés aux plans payants. GPT-5.4 mini change ça de façon pratique : les utilisateurs gratuits peuvent maintenant accéder à un niveau de raisonnement en plusieurs étapes sans payer 20 $US/mois pour le plan Plus. Ce n’est pas équivalent à GPT-5.4 Thinking complet. Un modèle compact comme GPT-5.4 mini fait des compromis par rapport à son grand frère, typiquement en profondeur de raisonnement, en capacité à gérer des contextes très longs, ou en nuance sur des tâches complexes. Mais pour des questions de niveau intermédiaire, des problèmes logiques standard, ou des tâches de codage courant, la différence pratique est souvent négligeable pour l’utilisateur moyen.
Le gain concret pour l’utilisateur gratuit, c’est aussi la continuité du service. Avant un fallback automatique, une demande Thinking en période de forte affluence aurait pu retourner une erreur ou une réponse non-Thinking. Maintenant, la demande est traitée, juste potentiellement par un modèle plus léger. Pour quelqu’un qui utilise ChatGPT ponctuellement pour des questions complexes, cette fiabilité améliorée a une valeur réelle.
Positionnement de GPT-5.4 mini dans la gamme OpenAI
OpenAI a depuis un moment une stratégie de modèles compacts parallèles à ses modèles principaux. GPT-4o mini, o1-mini, et maintenant GPT-5.4 mini suivent tous la même logique : un modèle plus petit, moins coûteux à faire tourner, qui couvre une portion importante des cas d’usage à une fraction du coût computationnel. Ce positionnement sert plusieurs objectifs simultanément. Pour OpenAI, réduire le coût marginal de chaque requête augmente les marges sur les plans gratuits et bas de gamme. Pour les développeurs qui accèdent aux modèles via l’API, un modèle compact moins cher permet des applications avec un volume de requêtes beaucoup plus élevé. Pour les utilisateurs finaux, c’est un accès à des capacités de raisonnement sans débourser pour les plans haut de gamme.
Le pattern établi avec Codex est instructif. GPT-5-Codex-Mini offre jusqu’à 4x plus d’usage que GPT-5-Codex pour les mêmes fenêtres d’accès. Ça veut dire qu’un développeur ou une équipe peut faire tourner beaucoup plus de requêtes avec le modèle compact avant d’atteindre les limites. GPT-5.4 mini dans ChatGPT suit la même logique : maximiser la portée du service avec des ressources optimisées.
Sauf que la vraie affaire dans ce positionnement, c’est ce que ça dit de la direction stratégique d’OpenAI en 2026. L’entreprise ne mise plus seulement sur « le plus grand modèle possible ». Elle construit une grille de modèles à différents niveaux de capacité et de coût, et elle orchestre les bascules automatiquement en arrière-plan. L’utilisateur final interagit avec une interface unifiée pendant qu’OpenAI optimise quel modèle tourne sous le capot.
Ce que ça change pour toi
OK check ça. Si tu utilises ChatGPT sur le plan gratuit et que tu actives la fonction Thinking, tu accèdes maintenant à un niveau de raisonnement qui n’était pas disponible gratuitement avant mars 2026. C’est un gain réel, même si le modèle sous-jacent n’est pas le plus puissant de la gamme. Si tu utilises le plan Plus (20 $US/mois) ou un plan supérieur, GPT-5.4 mini comme fallback signifie que tes requêtes Thinking seront traitées même en période de forte affluence, possiblement par un modèle moins puissant que ce que tu penses utiliser. C’est le compromis qu’OpenAI fait pour toi sans te demander ton avis.
Si tu accèdes aux modèles OpenAI via l’API pour tes projets, GPT-5.4 mini va probablement devenir disponible comme option de déploiement directe, à un coût inférieur à GPT-5.4. Ça mérite d’être dans ton radar si tu optimises des coûts d’inférence. La question à te poser : est-ce que la qualité de raisonnement de GPT-5.4 mini est suffisante pour ton usage? Pour la majorité des tâches quotidiennes sur ChatGPT gratuit, la réponse est probablement oui. Pour des analyses complexes ou des tâches où chaque nuance compte, tu voudras confirmer que tu tournes sur GPT-5.4 Thinking complet, ce qui implique généralement un plan payant avec moins de pression de capacité.
Le verdict : GPT-5.4 mini est le genre de changement infrastructure qu’OpenAI déploie discrètement parce qu’il est difficile à marketer mais facile à justifier. Meilleure disponibilité du service Thinking, coût serveur réduit, accès au raisonnement étendu aux plans gratuits. Pas de fanfare nécessaire. Le modèle tourne, les requêtes passent, la plupart des utilisateurs ne voient pas la différence.
Conclusion
GPT-5.4 mini est arrivé dans ChatGPT le 18 mars 2026 par la porte de service, sans annonce dans le sélecteur de modèles, sans grande campagne de communication. Son rôle est double et pragmatique : rendre la fonction Thinking accessible gratuitement, et absorber la surcharge quand GPT-5.4 Thinking est sous pression. Le calendrier de consolidation est clair. GPT-4.5 disparaît le 27 juin 2026, OpenAI o3 suit le 26 août 2026. OpenAI simplifie le catalogue pendant qu’il déploie des couches d’automatisation qui gèrent la qualité de l’expérience sans exposer la complexité à l’utilisateur. Prochaine étape concrète : active la fonction Thinking sur le plan gratuit si tu ne l’as pas encore fait, et teste-la sur une vraie tâche de raisonnement. C’est maintenant disponible sans abonnement. Compare le résultat avec ce que tu obtenais avant, et décide si ça justifie ou non de rester sur le plan gratuit pour tes besoins. C’est tout.
Check tes courriels.
Lien à cliquer pour confirmer ton abonnement.
Texte par David Cyr
