DeepSeek paralysé pendant 12 heures, la puissance de calcul des grands modèles nationaux ne suit-elle plus leurs ambitions ?
Le 29 mars, DeepSeek, l'un des principaux fournisseurs chinois de modèles de langage, a connu une panne majeure durant 12 heures. L’incident a débuté à 21h35, rendant l’application et la plateforme web inaccessibles, avec des échecs de connexion, des interruptions de dialogue et des pertes de contenu.
Bien que l’explication initiale ait évoqué un afflux massif d’utilisateurs, les données montrent que le trafic n’a pas connu de pic anormal. La cause réelle semble être une tension structurelle entre les capacités de calcul (compute) et la demande croissante, exacerbée par de nouveaux usages comme les "agents IA" qui sollicitent le système de manière intensive.
Cet incident reflète un défi plus large dans l’industrie de l’IA : alors que les modèles deviennent plus puissants (comme la future version V4 de DeepSeek, attendue avec des capacités étendues), les infrastructures peinent à suivre. La concurrence ne se limite plus seulement aux performances des modèles, mais aussi à leur stabilité, leur coût et leur évolutivité.
La panne de DeepSeek sert ainsi d’avertissement : le succès de l’IA à grande échelle dépendra autant de la puissance de calcul et de l’ingénierie système que de l’intelligence des modèles.
marsbit04/03 12:27