NapseflowNapseflow
Tech

De « Bordouse » à Bordeaux : cette carte de France montre les progrès de ChatGPT en un an et demi

Numerama · mis à jour il y a 8 j

En mars 2025, ChatGPT produisait une carte de France complètement délirante, remplie de villes imaginaires. Dix-sept mois plus tard, le résultat est méconnaissable -- mais pas 100 % convaincant.

ChatGPT 2025 : une carte fantaisiste

En mars 2025, ChatGPT, un modèle d'intelligence artificielle développé par OpenAI, a généré une carte de France particulièrement erronée. Les villes comme Paris, Toulouse ou Bordeaux y apparaissaient à plusieurs endroits, parfois sous des noms fantaisistes comme Bordouse ou Bordol. Marseille était positionnée en Bretagne, et le Royaume-Uni était renommé France, suggérant une confusion géographique majeure. La forme générale du pays restait identifiable, mais les erreurs de localisation et les noms inventés rendaient la carte peu crédible. Cette première tentative illustrait les limites des générateurs d'images d'IA à cette époque, notamment leur difficulté à respecter des consignes précises ou à produire un texte lisible.

Progrès visibles en août 2026

Dix-sept mois plus tard, en août 2026, ChatGPT a produit une nouvelle carte de France bien plus réaliste. Les grandes villes comme Paris, Lille, Strasbourg, Lyon ou Marseille sont désormais placées dans des zones géographiques correctes, un progrès spectaculaire par rapport à 2025. Cependant, des erreurs subsistent, notamment à l'échelle locale : Béziers apparaît deux fois dans le sud-est, au détriment de Montpellier, et le tracé des routes ou des reliefs ne correspond pas exactement à la réalité. Le Luxembourg, par exemple, semble anormalement agrandi. Ces imperfections montrent que l'IA a progressé, mais reste perfectible dans la précision des détails.

Évolution des modèles d'IA

Les progrès observés entre 2025 et 2026 s'expliquent par l'évolution rapide des modèles de génération d'images. En mars 2025, ChatGPT utilisait principalement DALL-E 3, un outil performant mais limité pour le texte et la disposition des éléments. En mars 2025, OpenAI a intégré la génération d'images directement dans GPT-4o, améliorant la compréhension des consignes et la lisibilité du texte. Google a ensuite lancé Nano Banana en août 2025, puis Nano Banana Pro en novembre 2025 et Nano Banana 2 en février 2026, chacun apportant des améliorations en rendu et en précision. OpenAI a répliqué avec ChatGPT Images 2.0 en avril 2026, promettant un texte plus fiable et une meilleure compréhension des instructions.

Limites persistantes des IA

Malgré ces avancées, les générateurs d'images comme ChatGPT ou Google Gemini conservent des limites majeures. Par exemple, la génération d'un verre de vin rempli à ras bord reste difficile. En 2024, cette tâche était quasi impossible, car les modèles étaient entraînés sur des images de verres partiellement remplis (au tiers ou à moitié), plus courantes dans la réalité. En août 2026, ChatGPT parvient à produire un tel verre, mais le résultat reste imparfait. Gemini, quant à lui, a d'abord proposé un cadrage trop serré pour voir le niveau du liquide, avant de réussir après plusieurs tentatives. Ces exemples montrent que les IA comprennent une instruction, mais peinent encore à la représenter fidèlement dans des cas inhabituels.

Ce que ça pourrait changer

Cette comparaison entre les cartes de 2025 et 2026, ainsi que les tests sur les verres de vin, illustre la course technologique entre les entreprises spécialisées dans l'IA. OpenAI et Google multiplient les innovations pour améliorer la qualité des images générées, avec des modèles comme ChatGPT Images 2.0 ou Nano Banana 2. Cependant, ces progrès s'accompagnent de défis techniques persistants, notamment pour les scènes complexes ou les objets peu représentés dans les données d'entraînement. Les utilisateurs doivent donc rester prudents face aux résultats produits par ces outils, qui restent perfectibles malgré leurs avancées.

Sujets complémentaires

Ce contenu a été généré par intelligence artificielle à partir de l'article source. Il peut contenir des erreurs ou imprécisions.