DeepSeek(ディープシーク)の導入を検討するにあたり、「実際の料金はいくらかかるのか」「どのモデルを選べばコストパフォーマンスを最大化できるのか」と疑問を持つ方は多いはずです。結論から言うと、DeepSeekのAPI料金体系は時間帯(ピーク・オフピーク)によって価格が2段階に分かれており、オフピーク時はピーク時の半額で利用できる極めて合理的な仕組みを採用しています。
本記事では、公式ドキュメントに基づく確定料金をもとに、各モデルの特徴、ピーク時とオフピーク時の単価比較、費用を最小限に抑える実践テクニックまで徹底解説します。料金体系の基本をより多角的に把握したい方は、DeepSeekの料金プランを徹底解説!最新モデルの価格と選び方もあわせてご覧ください。
DeepSeekの料金プラン一覧と公式価格表
DeepSeekのAPIサービスは、処理内容と用途に応じて主に2種類のモデルが提供されています。高速かつ画像入力に対応した「deepseek-flash」と、より高度な推論や複雑なタスクに対応する「deepseek-v4-pro」です。
※トークンとは: AIがテキストを処理する際の最小単位のことです。英語では1単語前後、日本語では1文字〜数文字が1トークンに換算されます。
公式確定料金一覧表
以下の表は、DeepSeek公式料金ページ(確認日: 2026-09-23)で公開されている確定料金です。料金は100万トークン(1M tokens)あたりのUSD表記です。
| モデル名 | 時間帯区分 | 入力料金(キャッシュミス/1Mトークン) | 出力料金(1Mトークン) | 最大コンテキスト長 | 最大出力長 | 画像入力 |
|---|---|---|---|---|---|---|
| deepseek-flash | オフピーク | 0.15 USD | 0.6 USD | 1M(約100万) | 384K | 対応 |
| deepseek-flash | ピーク | 0.3 USD | 1.2 USD | 1M(約100万) | 384K | 対応 |
| deepseek-v4-pro | オフピーク | 0.66 USD | 1.98 USD | 1M(約100万) | 384K | 非対応 |
| deepseek-v4-pro | ピーク | 1.32 USD | 3.96 USD | 1M(約100万) | 384K | 非対応 |
※上記料金の出典: DeepSeek Official Pricing(確認日: 2026-09-23)。
ピーク時間帯とオフピーク時間帯の定義
DeepSeekの料金設定において最も特徴的なのが、リクエストを送信する時間帯によって単価が変動するダイナミックな料金体系です。
- ピーク時間帯: 平日 UTC 01:00-04:00、および UTC 06:00-10:00
- オフピーク時間帯: 上記以外の平日時間帯、および週末(土日・終日)
日本標準時(JST = UTC+9)に換算すると以下のようになります。
- ピーク時間帯(平日):
- 午前10:00 〜 午後13:00(JST)
- 午後15:00 〜 午後19:00(JST)
- オフピーク時間帯(平日・週末):
- 平日の深夜から早朝、および午後13:00〜15:00、夜19:00以降(JST)
- 土曜日・日曜日(終日)
オフピーク時間帯の単価は、ピーク時間帯のちょうど半額(50%)に設定されています。バッチ処理や夜間の自動データ処理などをオフピーク時間帯にスケジュールするだけで、API利用料金を半減させることが可能です。
提供モデルの詳細仕様
現在提供されているモデルの内部仕様と互換性は以下の通りです。
-
deepseek-flash
内部的には「DeepSeek-V4.1-Flash」が稼働しています。旧名称であるdeepseek-v4-flashを指定してリクエストを送信した場合でもシステム上で正常に受け付けられ、課金は一律でFlash料金が適用されます。コンテキスト長は1M(約100万トークン)、最大出力は384Kトークンです。また、画像入力(マルチモーダル)に対応しているのは現時点でこのflashモデルのみです。 -
deepseek-v4-pro
内部的には「DeepSeek-V4-Pro-0813」が稼働しています。高度な論理推論、プログラミング、学術的なテキスト解析などに最適化されています。flashと同様にコンテキスト長1M、最大出力384Kという極めて広大な処理能力を持っています(画像入力は非対応)。
アップデートの歴史やモデル更新の推移については、DeepSeekのアップデート履歴・最新更新情報まとめ【随時更新】でも詳しく紹介されています。
無料枠の実用性と利用時の制限
DeepSeekの利用を始めるにあたり、どのような無料利用枠や制約が存在するのかを把握しておくことは重要です。
WebインターフェースとAPIの違い
DeepSeekの公式ポータルでは、ブラウザ経由で利用できるチャットUIと、開発者向けのAPIプラットフォームが提供されています。
※API(Application Programming Interface)とは: 外部のプログラムやアプリケーションからDeepSeekのAIエンジンを直接呼び出して連携させるための仕組みです。
APIを利用する場合は従量課金制となっており、利用したトークン数とリクエスト時間帯に応じた金額が発生します。新規登録時の無料クレジット付与やキャンペーン内容については時期によって変更される可能性があるため、詳細はDeepSeek API公式ドキュメントを確認してください。
実用における注意点と制限
無料枠や低コスト運用を行う上で把握しておくべきポイントは以下の通りです。
-
コンテキストウィンドウの消費
両モデルとも最大1Mトークン(約100万トークン)という非常に大きなコンテキストウィンドウを提供していますが、大量のドキュメントを読み込ませるほど入力トークン数が増加します。 -
レートリミット(利用制限)
短時間に集中して大量のリクエストを送信した場合、一時的に制限(Rate Limit)がかかる場合があります。本番環境で大規模なトラフィックを処理する場合は、エラーハンドリングやリトライ処理を適切に実装する必要があります。 -
画像解析の制限
画像入力(マルチモーダル機能)はdeepseek-flashのみで利用可能です。deepseek-v4-proではテキストのみの受付となるため、画像認識や図表読み取りを行いたい場合は必ずflashモデルを選択してください。
セキュリティやデータ取り扱いに関する詳細は、DeepSeekの危険性は?安全性・情報漏洩リスクと対策を徹底解説で安全基準を確認しておくと安心です。
有料版・上位モデルの価値と費用対効果
deepseek-flash と deepseek-v4-pro のどちらを選択すべきか、それぞれの価値と費用対効果について解説します。
deepseek-flashが適しているユースケース
deepseek-flash は、非常に安価な料金設定(オフピーク時に入力0.15 USD/1Mトークン、出力0.6 USD/1Mトークン)でありながら、1Mコンテキストと画像入力に対応しています。
- カスタマーサポートのチャットボット(日常会話、FAQ対応)
- 大量のWeb記事や社内ドキュメントの要約・一次スクリーニング
- レシート、スクリーンショット、図面などの画像解析タスク
- リアルタイム性が求められる応答システム
Flashモデルの進化や詳細なベンチマークについては、【DeepSeek】V4.1 Flashリリース!高速・マルチモーダル対応を解説で深掘りされています。
deepseek-v4-proが適しているユースケース
deepseek-v4-pro は、オフピーク時に入力0.66 USD/1Mトークン、出力1.98 USD/1Mトークン、ピーク時に入力1.32 USD/1Mトークン、出力3.96 USD/1Mトークンと設定されています。
- 複雑なアルゴリズムの設計やコード生成・リファクタリング
- 専門的な法律文書、学術論文、財務諸表の深い論理的読解
- 多段階の思考を必要とする複雑な推論タスク(CoT: Chain of Thoughtなど)
- 高精度な翻訳やニュアンスを重視した長文コンテンツの執筆
プロモデルは入力・出力ともにFlashモデルの数倍の単価となりますが、高度な論理展開が必要なタスクでは手戻りを減らし、結果として開発工数やトータルコストを削減できる強みがあります。
他ツールとの料金比較・市場での位置づけ
AIモデルを選定する際、他社製品や一般的な選択肢と比べてどの程度の価格水準なのかは重要な比較基準です。
※注意: 他社製品の価格は為替や改定頻度が高いため、ここでは具体的な他社金額の断定は避け、DeepSeekの確定料金と相対的なコストパフォーマンスの観点から比較します。
| 項目 | deepseek-flash | deepseek-v4-pro | 一般的な他社フロンティアモデル |
|---|---|---|---|
| 入力料金(オフピーク) | 0.15 USD / 1M | 0.66 USD / 1M | 相対的に高額な傾向 |
| 出力料金(オフピーク) | 0.6 USD / 1M | 1.98 USD / 1M | 相対的に高額な傾向 |
| コンテキスト長 | 1Mトークン | 1Mトークン | 128K〜1Mトークン程度 |
| 最大出力長 | 384Kトークン | 384Kトークン | 4K〜128Kトークン程度 |
| 時間帯割引 | あり(オフピーク時50%引) | あり(オフピーク時50%引) | 時間帯別固定料金が一般的 |
| 画像入力 | 対応 | 非対応 | モデルにより異なる |
※DeepSeekの料金出典: DeepSeek API Pricing(確認日: 2026-09-23)。
DeepSeekの最大の特徴は、ベースとなる単価が極めて安価に設定されていることに加え、オフピーク時間帯に単価が半額になる仕組みがある点です。他社サービスでは終日均一料金が設定されていることが多いため、時間帯を工夫することで圧倒的に低いランニングコストを実現できます。
DeepSeekをお得に使い倒すコスト最適化のコツ
DeepSeekの料金体系を最大限に活かし、APIコストを抑えるための具体的なテクニックを紹介します。
1. オフピーク時間帯を活用したバッチ処理の自動化
DeepSeekのオフピーク時間帯(平日UTC 01:00-04:00・06:00-10:00以外、および土日終日)は、ピーク時と比べて料金が50%オフになります。
日本時間(JST)におけるオフピーク時間帯:
- 平日の24時間中、10:00-13:00と15:00-19:00を除くすべての時間(深夜・早朝・昼休み後・夜間)
- 土曜日および日曜日の全時間帯
即時応答が不要なバッチ処理(データの定期要約、レポート作成、ログ解析など)は、cronやタスクスケジューラーを用いて日本時間の夜間(19:00以降)や早朝、土日に実行するように設定することで、同一処理のコストを半減させることができます。
2. タスクに応じたモデルのハイブリッド運用
すべてのタスクを deepseek-v4-pro で処理するとコストが嵩みます。タスクの難易度に応じてモデルを使い分けるルーティング設計が効果的です。
- 前処理・データ抽出・画像認識:
deepseek-flashを利用(入力 0.15〜0.3 USD / 出力 0.6〜1.2 USD) - 複雑な論理推論・最終チェック:
deepseek-v4-proを利用(入力 0.66〜1.32 USD / 出力 1.98〜3.96 USD)
このようにパイプラインを分割することで、高精度を維持したまま全体のAPI支出を大幅に抑制できます。
3. プロンプトと出力トークン数の最適化
出力トークン単価は入力トークン単価の2〜4倍高いため、出力長を適切に制御することがコスト削減の鍵です。
- プロンプトで出力フォーマットを厳密に指定する(例: 「JSON形式でキーのみ出力」「箇条書きで3点以内で要約」など)
- APIリクエスト時のパラメータ
max_tokensを適切な上限値に設定する - 無駄な挨拶文や冗長な前置きを出力させないシステムプロンプトを設計する
最新の仕様やパラメータ設定については、DeepSeek公式ドキュメントを定期的に参照してください。
まとめ
DeepSeekの料金プランと活用法について重要なポイントをまとめます。
- 提供モデルは高速・画像対応の「deepseek-flash」と高度推論特化の「deepseek-v4-pro」の2種類で、いずれも最大1Mトークンのコンテキストと384Kの出力長を持つ
- 料金はピーク時間帯(平日UTC 01:00-04:00、06:00-10:00)とオフピーク時間帯の2段階制で、オフピーク時はすべての単価が半額(50%)になる
- flashモデルはオフピーク時に入力0.15 USD/1M・出力0.6 USD/1M、proモデルは入力0.66 USD/1M・出力1.98 USD/1Mと非常にリーズナブルな価格設定である
- 画像入力に対応しているのはflashモデルのみのため、マルチモーダル処理にはdeepseek-flashを選択する必要がある
- 定期バッチや非同期タスクをオフピーク時間帯(夜間や週末)にスケジュールすることで、運用コストを劇的に削減できる
公式料金および仕様の最新情報はDeepSeek公式料金ページにてご確認ください。
よくある質問
DeepSeekのAPI料金は時間帯によって変わりますか?
はい。平日UTC 01:00-04:00および06:00-10:00がピーク時間帯となり、それ以外の平日時間帯および週末はオフピーク時間帯として半額の料金で利用可能です。
deepseek-flashとdeepseek-v4-proの主な違いは何ですか?
deepseek-flash(DeepSeek-V4.1-Flash)は低価格で画像入力(マルチモーダル)に対応しています。一方、deepseek-v4-pro(DeepSeek-V4-Pro-0813)は高度な推論やテキスト処理に特化したハイエンドモデルです。両モデルともコンテキスト長1M、最大出力384Kをサポートしています。
古いモデル名(deepseek-v4-flashなど)でリクエストした場合はどうなりますか?
旧モデル名のdeepseek-v4-flashを指定した場合でもリクエストは受け付けられ、deepseek-flashの料金体系で課金されます。
DeepSeekの最新料金はどこで確認できますか?
公式の料金ドキュメント(https://api-docs.deepseek.com/quick_start/pricing)にて最新の確定情報が常時公開されています。利用前に必ず確認することをおすすめします。



