
Que signifie « serveur occupé » sur DeepSeek ?
La documentation d'API de DeepSeek classe ce message sous HTTP 503, « Server Overloaded », avec une seule cause : « The server is overloaded due to high traffic. » La solution indiquée est « Please retry your request after a brief wait. » Une ligne plus haut, pour le 429, DeepSeek va plus loin que tous les guides de dépannage classés sur cette requête : « We also advise users to temporarily switch to the APIs of alternative LLM service providers, like OpenAI. » Aucune des deux lignes ne parle de votre compte, de votre navigateur, de votre cache ou de votre VPN. Le refus, c'est DeepSeek qui décline un travail pour lequel il n'a aucun GPU libre à cet instant, et l'ordre des correctifs en découle.
- Copiez votre prompt hors de la zone de saisie avant toute chose. Un rafraîchissement, c'est comme ça que meurent les longs prompts.
- Désactivez DeepThink et la recherche, puis renvoyez. La variante « recherche » du message le dit elle-même : « Sorry, deepseek search service is busy. please disable search or try again later. »
- Ouvrez une nouvelle conversation et collez-y le prompt. Une conversation neuve est une requête plus légère qu'un long fil.
- Si c'est toujours occupé après deux essais à une minute d'intervalle, cessez de réessayer et envoyez le même prompt au même modèle chez un autre hébergeur (section suivante).
- Consultez status.deepseek.com uniquement pour écarter une vraie panne. Un refus pour cause d'occupation n'est pas une panne, et cette page mesure les pannes.
DeepSeek publie aussi, en pratique, les moments où ses serveurs sont les plus chargés, sur sa page de tarifs plutôt que sur sa page de statut. Son API coûte le double pendant ce qu'il appelle les heures de pointe : « Peak hours are 01:00 - 04:00 and 06:00 - 10:00 UTC, Monday through Friday, excluding Chinese public holidays. All other hours are off-peak, including weekends and Chinese public holidays in full. » Ces plages correspondent à 9 h à midi et 14 h à 18 h à Pékin, 2 h à 5 h et 7 h à 11 h à Londres, et 21 h à minuit et 2 h à 6 h à New York en heure d'été. Une entreprise ne divise pas son prix par deux hors d'une plage à moins que la charge ne soit dans cette plage : en septembre 2026, cette phrase est donc ce qui ressemble le plus à un calendrier officiel d'affluence chez DeepSeek.
La page de statut, consultée le 27 septembre 2026, n'affichait aucun incident ouvert et donnait à ses deux composants de chat 99.82% et 99.64% de disponibilité de juin à septembre 2026, avec l'API V4 Pro à 99.89% et l'API V4.1 Flash à 99.66%. Ces chiffres comptent le temps où le service était hors service. Un refus pour cause d'occupation est une requête écartée par un service qui fonctionne, donc une semaine de « server is busy » tient dans un trimestre à 99.8% sans laisser une ligne sur la page.
Quels autres hébergeurs servent le même modèle DeepSeek ?
Vingt hébergeurs autres que DeepSeek servaient DeepSeek V4 Pro 0813 via OpenRouter le 27 septembre 2026, dont 14 au siège aux États-Unis, et Together et Fireworks le vendent directement au prix de pointe en semaine de DeepSeek, $1.32 en entrée et $3.96 en sortie par million de tokens. DeepSeek publie ses modèles en poids ouverts : le fichier qu'exécute l'application est celui qu'exécutent ces hébergeurs, sur leurs GPU, dans leurs files d'attente. L'API de DeepSeek, elle, liste deux modèles en septembre 2026, V4.1 Flash et V4 Pro ; l'ancien V3.2 est servi par 14 hébergeurs sur OpenRouter, et aucun n'est DeepSeek.
Le tableau porte sur un seul modèle, DeepSeek V4 Pro 0813, au prix catalogue par million de tokens en dollars américains, relevé le 27 septembre 2026 sur la page de tarifs de chaque hébergeur ou sur son point d'accès OpenRouter. Les sièges proviennent des fiches de fournisseurs d'OpenRouter.
| Hébergeur | Siège | Entrée, $ par million | Sortie, $ par million | Remarque |
|---|---|---|---|---|
| API DeepSeek, heures de pointe en semaine | Chine | 1.32 | 3.96 | les serveurs derrière l'application ; la pointe va de 01:00 à 04:00 et de 06:00 à 10:00 UTC |
| API DeepSeek, heures creuses | Chine | 0.66 | 1.98 | week-ends et jours fériés chinois en heures creuses toute la journée |
| Together | États-Unis | 1.32 | 3.96 | pas d'entraînement sans accord préalable ; un réglage de rétention zéro des données dans les paramètres |
| Fireworks, offre Standard | États-Unis | 1.32 | 3.96 | offre Priority à $1.65 et $4.95 |
| Baidu, via OpenRouter | Chine | 0.24 | 0.73 | point d'accès le moins cher, version fp8 |
| Ionstream, via OpenRouter | États-Unis | 0.25 | 1.96 | point d'accès américain le moins cher |
| Novita, via OpenRouter | États-Unis | 0.99 | 2.97 | version fp8 |
| Venice, via OpenRouter | États-Unis | 1.65 | 4.95 | le plus cher des 20 |
Deux choses dans ce tableau comptent plus que la ligne la moins chère. Together et Fireworks facturent exactement le tarif de pointe en semaine de DeepSeek pour V4 Pro, et c'est pareil pour V4.1 Flash à $0.30 en entrée et $1.20 en sortie : un hébergeur américain ne coûte donc rien de plus que DeepSeek aux heures où l'application est la plus chargée. Et Fireworks tarife un point d'accès V4.1 Flash épinglé aux États-Unis à $0.45 et $1.80, soit 50% de plus que son offre par défaut, le seul prix publié que j'aie trouvé pour la garantie qu'une requête DeepSeek reste sur du matériel américain. Azure AI Foundry de Microsoft liste aussi V4 Pro et V4 Flash en déploiements Global, sans prix renseigné sur la page quand je l'ai lue.
Les réponses sont proches d'un hébergeur à l'autre, mais pas identiques. OpenRouter signale Baidu, Novita et CoreWeave comme des versions fp8 et Sail Research comme fp4, tandis que Together et DeepSeek lui-même ne précisent pas la précision. Mêmes poids, arrondis différents : une réponse de code ou de maths sur laquelle vous comptez agir mérite donc un second regard chez un second hébergeur. DeepSeek est-il sûr traite de l'autre différence, à savoir sous quelle politique de confidentialité atterrit la requête.
Whizi, qui publie cette page, est l'un des produits bâtis sur ce marché : DeepSeek V3.2 à 1 crédit par message et R1 à 2 sur Pro ($29.99 par mois, ou $19.99 en facturation annuelle), avec les lignes V4 sur Powerhouse, le tout servi via OpenRouter et des fournisseurs routés plutôt que par chat.deepseek.com, sous une politique qui précise que Whizi n'utilise pas vos prompts pour entraîner des modèles appartenant à Whizi. Là où il perd face à l'application : l'application est gratuite et les lignes DeepSeek de Whizi commencent à Pro, et Whizi n'affirme rien sur le pays où tourne le fournisseur routé. Utiliser DeepSeek dans Whizi liste les lignes et les crédits.
Comment corriger « serveur occupé » sur DeepSeek : ce qui marche et ce qui ne peut pas marcher
Seuls trois des correctifs en circulation agissent sur ce qui est en panne, à savoir la capacité de DeepSeek : réessayer plus tard, envoyer une requête plus légère et envoyer la requête ailleurs. Tout ce qui vise votre propre appareil traite un 503 comme si c'était votre faute.
| Correctif | Agit sur la cause | Ce qu'il fait vraiment |
|---|---|---|
| Attendre et réessayer | Oui | Remet votre requête dans la file une minute plus tard ; marche en bord de plage de pointe, rarement en plein milieu |
| Désactiver DeepThink | Oui | Une réponse avec raisonnement génère bien plus de tokens qu'une réponse simple, donc elle occupe un emplacement GPU plus longtemps |
| Désactiver la recherche | Oui | La variante « recherche » du message vous le demande |
| Nouvelle conversation, prompt plus court | En partie | Moins de contexte à traiter par tour ; le plus ancien signalement public, un ticket GitHub du 28 janvier 2025, a constaté que le deuxième message d'un fil échouait là où une nouvelle conversation fonctionnait |
| Rafraîchir, vider le cache, réinstaller, se déconnecter | Non | Le refus est généré côté DeepSeek après l'arrivée intacte de votre requête |
| VPN ou autre région | Non | Un VPN change l'origine de la requête, pas le nombre de GPU libres à son arrivée ; il n'aide que là où un réseau bloque DeepSeek purement et simplement, ce qui est une autre erreur |
| Une extension de relance | Non | Appuie sur Régénérer à votre place, dans la même file, et ajoute de la charge |
| Le même modèle chez un autre hébergeur | Oui | Autres GPU, autre file, mêmes poids |
L'angle des extensions mérite une ligne de plus, parce que l'autocomplétion propose « deepseek server busy extension » comme s'il s'agissait d'un correctif. Il en existe deux sortes. Les extensions de relance rappuient sur le bouton pour vous, ce qui revient à attendre avec de moins bonnes manières. HARPA, dont la page est classée sur cette requête, décrit son produit comme des modèles « hosted on our servers with 99.9% uptime », ce qui en fait un autre hébergeur, pas une réparation de l'application DeepSeek ; c'est la section précédente derrière un bouton de navigateur, sous la politique de confidentialité de HARPA et non celle de DeepSeek.
Un dernier schéma, tiré du fil GitHub, ouvert une semaine après le lancement de R1 : le premier message d'une conversation obtenait une réponse et le second revenait occupé, et une nouvelle conversation réglait le problème au prix de la mémoire. Mon interprétation, pas celle de DeepSeek, est que le deuxième tour transporte tout le fil en entrée, donc sous charge c'est la requête la plus lourde et la première écartée. Si le fil compte, collez-en un résumé de trois lignes dans la nouvelle conversation plutôt que toute la transcription.
Le serveur DeepSeek est-il en panne en ce moment ?
En général non. Panne et occupation se ressemblent depuis la zone de saisie et diffèrent sur status.deepseek.com : une panne est publiée comme un incident sur l'un des six composants, alors qu'un refus pour cause d'occupation est le service qui fonctionne comme prévu sous charge, et la page mesure si le service est en marche.
Les six composants, au 27 septembre 2026, sont l'API V4 Pro, l'API V4.1 Flash, deux services de chat, l'envoi de fichiers et la recherche, libellés en chinois avec des gloses en anglais. Leur disponibilité de juin à septembre 2026 allait de 99.64% pour un service de chat à 100% pour l'envoi de fichiers. Si les composants de chat affichent un incident, c'est une panne et rien de votre côté n'y changera quoi que ce soit. S'ils sont au vert et que l'application dit occupé, vous avez affaire à de la charge.
Le test qui départage les deux prend une minute. Ouvrez une nouvelle conversation et envoyez « hi » avec DeepThink et la recherche désactivés. Si cela répond et que votre long fil non, la charge est l'hypothèse la plus probable et le tableau ci-dessus s'applique. Si « hi » échoue aussi et que la page de statut montre un incident, traitez-le comme n'importe quelle panne de fournisseur : la marche à suivre de que faire quand ChatGPT est en panne fonctionne telle quelle en changeant les noms, sauf que le remplaçant le moins cher d'un DeepSeek occupé est DeepSeek chez un autre hébergeur plutôt qu'un autre modèle.
La règle que j'applique : deux refus pour cause d'occupation à une minute d'intervalle, et la requête part chez un autre hébergeur. La documentation de DeepSeek le disait déjà sur la ligne du 429 avant qu'aucun d'entre nous ne le fasse.
- Copiez le prompt hors de la zone de saisie avant de rafraîchir quoi que ce soit
- Désactivez DeepThink et la recherche, puis renvoyez une fois
- Ouvrez une nouvelle conversation pour le second essai ; un long fil est une requête plus lourde
- Après deux refus à une minute d'intervalle, envoyez le même prompt au même modèle chez un autre hébergeur
- Attendez-vous à la plage d'occupation en semaine de 01:00 à 04:00 et de 06:00 à 10:00 UTC, les heures de tarification de pointe de DeepSeek
- Laissez tomber vidage du cache, réinstallation et VPN ; un 503 n'est pas sur votre appareil
Questions fréquentes
Quel est l'état actuel de DeepSeek ?
status.deepseek.com est la réponse officielle, et le 27 septembre 2026 il n'affichait aucun incident, avec une disponibilité du chat de 99.82% et 99.64% de juin à septembre 2026. Il suit six composants : l'API V4 Pro, l'API V4.1 Flash, deux services de chat, l'envoi de fichiers et la recherche. Un refus pour cause d'occupation n'est pas un incident : une page au vert et une application occupée sont donc vraies en même temps.
Pourquoi DeepSeek est-il toujours occupé ?
L'application est gratuite, donc la demande n'est pas tarifée, et sa fenêtre la plus chargée est la journée de travail chinoise : DeepSeek facture le double aux utilisateurs de l'API de 01:00 à 04:00 et de 06:00 à 10:00 UTC en semaine, précisément pour cette raison. Hors de ces heures et tout le week-end, il facture moitié moins, ce qui est le signal de DeepSeek lui-même que la charge est plus faible.
L'extension « DeepSeek server busy » fonctionne-t-elle ?
Une extension de relance se contente d'appuyer sur Régénérer à votre place, donc elle marche exactement aussi souvent qu'un essai à la main. Les extensions qui promettent DeepSeek sans le message d'occupation, comme HARPA, font tourner le modèle sur leurs propres serveurs : c'est un autre hébergeur avec sa propre politique de confidentialité ; ce changement est le correctif qui marche, qu'il vienne ou non sous forme de bouton de navigateur.
Un VPN règle-t-il le problème de serveur occupé de DeepSeek ?
Non. Le refus est le 503 de DeepSeek pour trafic élevé, produit après l'arrivée de votre requête, et un VPN change l'origine de la requête, pas le nombre de GPU libres. Un VPN n'aide que lorsqu'un réseau bloque entièrement DeepSeek, ce qui produit une erreur de connexion et non le message d'occupation.