
DeepSeekの「サーバー混雑」とはどういう意味か
DeepSeek自身のAPIドキュメントは、このメッセージをHTTP 503「Server Overloaded」に分類し、原因をひとつだけ挙げています。「The server is overloaded due to high traffic.」(高トラフィックでサーバーが過負荷)。対処として示されているのは「Please retry your request after a brief wait.」(少し待ってから再試行)です。ひとつ上の429の行では、このキーワードで上位に出る対処ガイドのどれよりも踏み込んで、「We also advise users to temporarily switch to the APIs of alternative LLM service providers, like OpenAI.」と書いています。どちらの行にも、あなたのアカウント、ブラウザ、キャッシュ、VPNに関する記述はありません。これは、今は空いているGPUがなく、DeepSeekが仕事を断っているだけの状態で、対処の順番もそこから決まります。
- 何よりも先に、入力欄のプロンプトをコピーしておく。長いプロンプトが消えるのは、たいてい再読み込みのときです。
- DeepThinkと検索をオフにして再送信する。検索版のメッセージ自体がそう案内しています。「Sorry, deepseek search service is busy. please disable search or try again later.」
- 新しいチャットを開き、プロンプトを貼り付ける。新しいチャットは、長いスレッドよりも小さなリクエストです。
- 1分あけて2回試してもまだビジーなら、再試行をやめて、同じプロンプトを別のホストの同じモデルに送る(次のセクション)。
- status.deepseek.comは、本物の障害でないかを確認するためだけに見る。ビジーによる拒否は障害ではなく、このページが測っているのは障害です。
DeepSeekは、サーバーがいつ最も混むかを、ステータスページではなく料金ページで事実上公開しています。同社のAPIは、ピーク時間と呼ぶ時間帯に料金が2倍になります。「Peak hours are 01:00 - 04:00 and 06:00 - 10:00 UTC, Monday through Friday, excluding Chinese public holidays. All other hours are off-peak, including weekends and Chinese public holidays in full.」この時間帯は、北京では午前9時から正午と午後2時から6時、ロンドンでは午前2時から5時と午前7時から11時、ニューヨークでは夏時間で午後9時から午前0時と午前2時から6時にあたります。負荷がある時間帯でなければ、企業は時間帯を区切って料金を半額にはしません。だから2026年9月時点では、この一文がDeepSeekの公式の混雑スケジュールにいちばん近いものです。
2026年9月27日に確認したステータスページには未解決のインシデントはなく、2つのチャット系コンポーネントの2026年6月から9月の稼働率は99.82%と99.64%、V4 Pro APIは99.89%、V4.1 Flash APIは99.66%でした。これらの数字が数えているのは、サービスが止まっていた時間です。ビジーによる拒否は、稼働しているサービスがリクエストを断っているので、1週間「server is busy」が続いても、ページに一行も載らないまま稼働率99.8%の四半期に収まります。
同じDeepSeekモデルを動かしている他のホストはどこか
2026年9月27日、OpenRouter経由でDeepSeek以外の20ホストがDeepSeek V4 Pro 0813を提供しており、そのうち14は米国に本社があります。TogetherとFireworksは、DeepSeek自身の平日ピーク料金である100万トークンあたり入力$1.32、出力$3.96でそのまま販売しています。DeepSeekはモデルをオープンウェイトで公開しているため、アプリが動かしているファイルと、これらのホストが自社のGPUと自社のキューで動かしているファイルは同じです。一方、DeepSeek自身のAPIが挙げるモデルは2026年9月時点でV4.1 FlashとV4 Proの2つだけで、旧版のV3.2はOpenRouterで14のホストが提供していますが、そのなかにDeepSeekはありません。
下の表は、DeepSeek V4 Pro 0813という1つのモデルについて、100万トークンあたりの定価を米ドルで示したものです。2026年9月27日に各ホストの料金ページ、またはOpenRouterのエンドポイントで確認しました。本社所在地はOpenRouterのプロバイダー情報によります。
| ホスト | 本社 | 入力、100万あたり$ | 出力、100万あたり$ | 備考 |
|---|---|---|---|---|
| DeepSeek API、平日ピーク時間 | 中国 | 1.32 | 3.96 | アプリの裏側のサーバー。ピークはUTC 01:00から04:00と06:00から10:00 |
| DeepSeek API、オフピーク | 中国 | 0.66 | 1.98 | 週末と中国の祝日は終日オフピーク |
| Together | 米国 | 1.32 | 3.96 | オプトインなしの学習利用なし。設定にゼロデータ保持のスイッチあり |
| Fireworks、Standardティア | 米国 | 1.32 | 3.96 | Priorityティアは$1.65と$4.95 |
| Baidu、OpenRouter経由 | 中国 | 0.24 | 0.73 | 最安のエンドポイント、fp8ビルド |
| Ionstream、OpenRouter経由 | 米国 | 0.25 | 1.96 | 米国で最安のエンドポイント |
| Novita、OpenRouter経由 | 米国 | 0.99 | 2.97 | fp8ビルド |
| Venice、OpenRouter経由 | 米国 | 1.65 | 4.95 | 20ホストのなかで最も高い |
この表で最安の行よりも大事なことが2つあります。TogetherとFireworksはV4 Proに対してDeepSeekの平日ピーク料金とまったく同じ額を請求しており、V4.1 Flashの入力$0.30、出力$1.20でも同じなので、アプリがいちばん混む時間帯に米国のホストを使っても余分なコストはかかりません。そしてFireworksは、米国内に固定したV4.1 Flashのエンドポイントを$0.45と$1.80、つまり標準より50%高い額で提供しています。DeepSeekのリクエストが米国のハードウェアにとどまることを保証する料金として、私が見つけた公開価格はこれだけです。MicrosoftのAzure AI FoundryもV4 ProとV4 FlashをGlobalデプロイとして載せていますが、私が見た時点では価格は入っていませんでした。
ホストが違っても答えは近いものの、同一ではありません。OpenRouterはBaidu、Novita、CoreWeaveをfp8ビルド、Sail Researchをfp4と記載し、TogetherとDeepSeek自身は精度を明記していません。重みは同じでも丸め方が違うので、そのまま実行に移すコードや計算の答えは、別のホストでもう一度確かめる価値があります。もうひとつの違い、つまりリクエストがどの会社のプライバシーポリシーの下に置かれるかは、DeepSeekは安全かで扱っています。
このページを公開しているWhiziも、この市場の上に作られたサービスのひとつです。Proプラン(月額$29.99、年払いなら月$19.99)では、DeepSeek V3.2が1メッセージ1クレジット、R1が2クレジットで、V4の行はPowerhouseにあり、すべてchat.deepseek.comではなくOpenRouterとルーティング先のプロバイダーを通じて提供されます。ポリシーでは、Whiziがあなたのプロンプトを使ってWhizi所有のモデルを学習することはないとしています。アプリに劣る点もあります。アプリは無料ですが、WhiziのDeepSeekの行はProから始まり、ルーティング先のプロバイダーがどの国で動いているかについてWhiziは何も保証していません。対応モデルとクレジットはWhiziでDeepSeekを使うにまとめています。
DeepSeekのサーバー混雑の直し方:効くものと効かないもの
出回っている対処法のうち、実際に故障している部分、つまりDeepSeekの容量に作用するのは3つだけです。あとで再試行する、軽いリクエストを送る、別の場所に送る。自分の端末に向けた対処は、どれも503をあなたの責任であるかのように扱っています。
| 対処 | 原因に効くか | 実際に起きること |
|---|---|---|
| 待って再試行 | はい | 1分後にリクエストをキューへ戻す。ピーク時間帯の端では効くが、真ん中ではまず効かない |
| DeepThinkをオフ | はい | 推論つきの回答は通常の回答よりはるかに多くのトークンを生成するため、GPUの枠をより長く占有する |
| 検索をオフ | はい | 検索版のメッセージが、そうするよう求めている |
| 新しいチャット、短いプロンプト | 一部 | ターンごとに処理する文脈が減る。最も古い公開報告である2025年1月28日のGitHub issueでは、スレッドの2通目が失敗し、新しいチャットでは動いた |
| 再読み込み、キャッシュ削除、再インストール、ログアウト | いいえ | 拒否は、リクエストが無傷で届いたあと、DeepSeek側で生成される |
| VPNや別の地域 | いいえ | VPNが変えるのはリクエストの発信元で、届いた時点で空いているGPUの数ではない。効くのはネットワークがDeepSeekを完全に遮断している場合だけで、それは別のエラー |
| 再試行の拡張機能 | いいえ | 同じキューのなかで、代わりに再生成を押すだけで、負荷を増やす |
| 別のホストの同じモデル | はい | GPUもキューも違い、重みは同じ |
拡張機能の話にはもう一言必要です。オートコンプリートが「deepseek server busy extension」をまるで解決策のように出してくるからです。提供されているのは2種類あります。再試行系の拡張機能は代わりにボタンを押し直すだけで、行儀の悪い待ち方にすぎません。このキーワードで上位に出るHARPAは、自社製品を「hosted on our servers with 99.9% uptime」(当社のサーバーでホストされ、稼働率99.9%)のモデルだと説明しており、これはDeepSeekアプリの修復ではなく別のホストです。前のセクションの方法をブラウザのボタンの後ろに置いたもので、適用されるのはDeepSeekではなくHARPAのプライバシーポリシーです。
GitHubのスレッドにはもうひとつパターンがあります。R1の公開から1週間後に立てられたもので、チャットの1通目には答えるのに2通目はビジーで返り、新しいチャットにすると直るが、それまでの記憶を失うというものです。これはDeepSeekの見解ではなく私の読みですが、2通目はスレッド全体を入力として運ぶので、負荷がかかっているときはより重いリクエストになり、最初に切り捨てられるのだと思います。スレッドが大事なら、全文ではなく3行の要約を新しいチャットに貼ってください。
DeepSeekのサーバーは今ダウンしているのか
たいていは違います。ダウンとビジーは入力欄からは同じに見えますが、status.deepseek.comでは別物です。障害は6つのコンポーネントのどれかに対するインシデントとして掲載され、ビジーによる拒否は負荷のもとで設計どおりに動いているサービスの挙動なので、このページが測っているのはサービスが稼働しているかどうかです。
2026年9月27日時点の6つのコンポーネントは、V4 Pro API、V4.1 Flash API、2つのチャットサービス、ファイルアップロード、検索で、中国語の表記に英語の注釈がついています。2026年6月から9月の稼働率は、チャットサービスのひとつの99.64%からファイルアップロードの100%までの範囲でした。チャット系コンポーネントにインシデントが出ていれば、それは障害で、あなた側でできることはありません。緑なのにアプリがビジーと言うなら、見ているのは負荷です。
両者を見分けるテストは1分で済みます。新しいチャットを開き、DeepThinkと検索をオフにして「hi」と送ります。それには答えるのに長いスレッドには答えないなら、負荷のほうが有力で、上の表が当てはまります。「hi」も失敗し、ステータスページにインシデントが出ているなら、通常のプロバイダー障害として扱います。ChatGPTが落ちたときに使うものの手順は名前を入れ替えればそのまま使えます。ただし、ビジーなDeepSeekのいちばん安い代替は別のモデルではなく、別のホストのDeepSeekです。
私のルールは、1分あけてビジーの拒否が2回出たら、リクエストを別のホストに回すことです。DeepSeek自身のドキュメントも、429の行で私たちの誰よりも先にそう言っていました。
- 何かを再読み込みする前に、入力欄のプロンプトをコピーしておく
- DeepThinkと検索をオフにして、一度だけ再送信する
- 2回目は新しいチャットで試す。長いスレッドは重いリクエストになる
- 1分あけてビジーの拒否が2回出たら、同じプロンプトを別のホストの同じモデルに送る
- 混む時間帯は平日のUTC 01:00から04:00と06:00から10:00、DeepSeek自身のピーク料金の時間帯と考える
- キャッシュ削除、再インストール、VPNは省く。503の原因はあなたの端末にはない
よくある質問
DeepSeekの現在のステータスはどうなっていますか。
公式の答えはstatus.deepseek.comです。2026年9月27日時点ではインシデントはなく、2026年6月から9月のチャット稼働率は99.82%と99.64%でした。追跡しているのは、V4 Pro API、V4.1 Flash API、2つのチャットサービス、ファイルアップロード、検索の6つのコンポーネントです。ビジーによる拒否はインシデントではないので、ページは緑なのにアプリはビジー、ということが同時に成り立ちます。
DeepSeekはなぜいつも混んでいるのですか。
アプリが無料なので需要に値段がつかず、いちばん混むのは中国の勤務時間帯です。DeepSeekが平日のUTC 01:00から04:00と06:00から10:00にAPI利用者から料金を2倍取るのは、まさにそのためです。この時間帯以外と週末は半額で、これは負荷が低いというDeepSeek自身のサインです。
DeepSeekのサーバー混雑対策の拡張機能は効きますか。
再試行系の拡張機能は代わりに再生成を押すだけなので、手で再試行するのとまったく同じ頻度でしか効きません。HARPAのように、ビジーメッセージなしでDeepSeekを使えると謳う拡張機能は、自社のサーバーでモデルを動かしているため、独自のプライバシーポリシーを持つ別のホストです。効くのはその切り替えであり、ブラウザのボタンの形をしているかどうかは関係ありません。
VPNでDeepSeekのサーバー混雑は直りますか。
いいえ。この拒否はDeepSeekが高トラフィックで返す503で、リクエストが届いたあとに生成され、VPNが変えるのはリクエストの発信元であって空いているGPUの数ではありません。VPNが効くのはネットワークがDeepSeekを完全に遮断している場合だけで、その場合に出るのはビジーメッセージではなく接続エラーです。