Mais cela ne signifie pas qu’un visuel en chinois traditionnel peut être livré sans relecture. À ce stade, les sources consultables ne publient pas de taux d’exactitude propre au chinois traditionnel, ni de mesure publique du nombre de caractères erronés dans des menus, affiches ou cartes très denses.
Ici, le « texte illisible » ne désigne pas seulement des symboles incompréhensibles. Le risque inclut aussi les caractères déformés, les fautes, les caractères manquants ou ajoutés, le mélange entre chinois simplifié et traditionnel, la ponctuation incorrecte, ou encore une phrase que le modèle reformule alors que vous aviez fourni un texte précis.
Dans cet article, nous traitons ensemble deux réalités proches : gpt-image-2, le nom du modèle côté API OpenAI, et ChatGPT Images 2.0, l’expérience côté produit. Le premier apparaît dans la documentation API d’OpenAI, le second dispose d’une page officielle de présentation, et ETtoday indique que l’API permet aux développeurs d’y accéder via gpt-image-2.
Les informations publiques permettent d’affirmer trois choses.
D’abord, gpt-image-2 est bien listé dans la documentation API d’OpenAI, tandis qu’OpenAI présente officiellement ChatGPT Images 2.0 sur son site.
Ensuite, la nouvelle génération est décrite comme plus utile pour des flux de travail visuels concrets. PetaPixel rapporte qu’Images 2.0 est positionné comme un système capable de servir des usages en design, éducation, développement et création de contenu.
Enfin, le texte dans l’image et les langues non anglaises font partie des améliorations mises en avant. The Times of India indique que le modèle peut générer avec plus de précision du texte dans des langues comme le japonais, le coréen, le chinois, l’hindi et le bengali, notamment dans des affiches, explicatifs, diagrammes et bandes dessinées. ETtoday évoque aussi des progrès en restitution des détails, mise en page et traitement multilingue, tandis que Yahoo News UK souligne des gains dans la compréhension et le rendu des textes non latins.
La limite est importante : ces sources parlent de « chinois », de langues non anglaises ou d’écritures non latines à un niveau général. Elles ne donnent pas de taux d’erreur spécifique au chinois traditionnel, ni de test public massif sur des menus longs, des affiches événementielles ou des infographies chargées. La conclusion la plus solide n’est donc pas : « ça ne fera plus jamais de texte illisible ». C’est plutôt : « c’est devenu beaucoup plus intéressant à utiliser, mais il faut toujours relire avant publication ».
Les preuves disponibles soutiennent l’idée d’un meilleur rendu textuel, pas celle d’une mise en page professionnelle en chinois traditionnel sans faute. En pratique, mieux vaut raisonner selon la quantité de texte et le coût d’une erreur.
| Cas d’usage | Niveau de risque | Approche conseillée |
|---|---|---|
| Visuel social avec titre court | Plutôt favorable | Utiliser des phrases courtes, de gros caractères et vérifier chaque caractère après génération. |
| Affiche d’événement avec titre, sous-titre, date et lieu | Bon pour un premier jet | Laisser le modèle proposer composition, style, couleurs et zones de texte, puis contrôler dates, adresses, noms et marques. |
| Menu avec plats et prix | À tester, mais pas à livrer tel quel | S’en servir pour explorer une ambiance et une grille visuelle ; recomposer ensuite les prix, plats et détails dans un outil de mise en page. |
| Infographie longue, tableau, petits caractères | Risque élevé | Traiter l’image générée comme un fond ou une maquette ; poser le texte final avec un outil contrôlable. |
En design, le chinois traditionnel ne doit pas seulement « ressembler » à du chinois. Un menu exige des plats et des prix exacts. Une affiche doit conserver la bonne date, le bon lieu, le bon organisateur. Un visuel de marque doit respecter les noms propres, le ton, les signes de ponctuation et parfois des caractères rares.
Les sources disponibles montrent que ChatGPT Images 2.0 progresse sur le texte dans l’image, le multilingue, les écritures non latines et la structure visuelle. Mais « chinois » ne signifie pas automatiquement « chinois traditionnel exact », et « meilleur rendu non latin » ne veut pas dire « petit texte dense et multi-colonnes publiable sans contrôle ».
Trois situations méritent une vigilance particulière :
La meilleure manière d’utiliser GPT Image 2 aujourd’hui est de le considérer comme un outil de maquette visuelle, pas comme un outil de typographie finale sans relecture.
Voici une base de prompt à adapter :
Générez une [affiche/un menu/un visuel pour les réseaux sociaux] en chinois traditionnel.
Tout le texte visible dans l’image doit utiliser uniquement les éléments ci-dessous.
Ne traduisez pas, ne reformulez pas, n’ajoutez rien et n’omettez rien.
Utilisez un style de police en chinois traditionnel clair et lisible.
Évitez les corps trop petits, les colonnes serrées et les zones de texte encombrées.
Liste du texte :
Titre principal : …
Sous-titre : …
Date / lieu / prix / articles : …
Commencez par prévoir les zones de texte, puis générez l’image en gardant chaque caractère aussi fidèle que possible à la liste.
Ce type de consigne ne garantit pas l’absence totale d’erreurs. En revanche, il rend le contrôle plus simple : vous avez une liste de référence, et vous pouvez comparer l’image produite ligne par ligne.
GPT Image 2 et ChatGPT Images 2.0 semblent beaucoup plus adaptés qu’auparavant à la création de visuels contenant du texte. Les sources consultables soutiennent l’idée de progrès sur le rendu typographique, le multilingue, les écritures non latines et les flux de création visuelle utilisables.
Mais si la question est : « Les affiches, menus et visuels en chinois traditionnel ne produiront-ils enfin plus jamais de texte illisible ? », la réponse reste : ce n’est pas prouvé. Le bon usage consiste à accélérer la recherche graphique et la maquette, puis à confier le texte final — surtout les prix, dates, noms et petits caractères — à une relecture humaine et à une mise en page contrôlée.