☕️ Claude, ChatGPT, Gemini et Grok sont simultanément tombés en panne, SpaceXAI s’excuse
Dans la soirée de ce jeudi 3 septembre, quatre des principaux fournisseurs de services d’IA générative étaient inaccessibles. Anthropic a d’abord signalé un problème sur Claude Sonnet 5 puis un nombre d’erreurs anormal sur Claude Mythos 5.1, Claude Fable 5.1, et Claude Opus 5.
Dans la soirée du 3 septembre 2026, quatre des principaux services d'intelligence artificielle générative (IA) sont devenus inaccessibles simultanément. Il s'agit de Claude (développé par Anthropic), ChatGPT (OpenAI), Gemini (Google) et Grok (SpaceXAI). Cette panne généralisée a surpris les utilisateurs, car ces services sont proposés par des entreprises concurrentes. Les problèmes techniques ont été signalés par les plateformes de suivi de statut des services, comme status.claude.com ou status.openai.com, qui ont enregistré une augmentation anormale des erreurs. Par exemple, Anthropic a mentionné des dysfonctionnements sur plusieurs de ses modèles d'IA (Claude Sonnet 5, Claude Mythos 5.1, etc.), tandis qu'OpenAI a constaté une hausse des erreurs sur ChatGPT et Codex.
L'entreprise SpaceXAI (anciennement xAI), dirigée par Elon Musk, a rapidement reconnu sa responsabilité dans cette panne. Dans un message publié sur X (ex-Twitter) le 3 septembre à 21h38, elle a expliqué que le problème provenait de son datacenter Colossus, situé au sud de Memphis (États-Unis). Ce centre de données, ouvert en septembre 2024, est l'un des plus grands au monde et loue des espaces à de nombreuses entreprises technologiques. SpaceXAI a précisé que la panne était due à un incident survenu dans ce datacenter, affectant non seulement son propre service Grok, mais aussi ses partenaires, dont Anthropic et OpenAI. L'entreprise a présenté ses excuses et assuré que tous les systèmes avaient été rétablis, tout en promettant des mesures pour éviter une récidive.
Le datacenter Colossus de SpaceXAI, situé près de Memphis, joue un rôle clé dans l'infrastructure numérique mondiale. Inauguré en septembre 2024, il s'étend sur une surface considérable et utilise des turbines à gaz pour alimenter ses serveurs. Ce site est loué à plusieurs acteurs majeurs de l'IA, comme Anthropic, qui y héberge une partie de ses modèles Claude. Cette centralisation des ressources pose question : en cas de panne, comme celle du 3 septembre, tous les services dépendant de ce datacenter sont paralysés. Les commentaires des lecteurs soulignent ce risque, comparant cette situation à un SPOF (Single Point Of Failure), c'est-à-dire un point unique de défaillance qui peut entraîner l'effondrement d'un système entier.
La panne a provoqué des réactions variées parmi les utilisateurs et les experts. Certains ont souligné l'absence de *redondance*, c'est-à-dire de systèmes de secours capables de prendre le relais en cas de défaillance. D'autres ont évoqué une possible *mauvaise gestion des ressources*, comme une surcharge du datacenter ou une configuration inadaptée. Elon Musk a répondu sobrement sur *X*, confirmant que les systèmes avaient été rétablis et que des mesures correctives étaient mises en place. Malgré l'incident, certains utilisateurs ont rapporté n'avoir rien remarqué, suggérant que le service n'était pas totalement interrompu mais simplement ralenti ou partiellement inaccessible. Cette panne rappelle l'importance de la résilience dans l'infrastructure numérique.

