DeepSeek V4 Pro 対 Flash:コーディング、エージェントなど

deepseek pro 対 flash

DeepSeekでは現在、コンテキストウィンドウが100万トークンと共通しているものの、演算プロファイルが大きく異なる2つのV4モデルを提供しています。V4 Proに追加料金を支払ってまで選ぶべきでしょうか、それとも、より低価格なV4 Flashでも実際の作業を十分にこなせるのでしょうか?

この比較では、公式仕様、API価格、コーディングおよびエージェントのベンチマーク、処理速度、同時実行数、ならびに制御された同一プロンプトによるテストについて検証しています。また、DeepSeekが公表した結果と、独立した測定結果、および当社独自のAPI実行結果を区別して掲載しています。.

簡単な答え: V4 Flashは、レイテンシ、スループット、コストが重要な場合の実用的な出発点となります。V4 Proは、より多くのアクティブ容量を備え、難解な知識、長文コンテキスト、コーディング、および多段階のエージェントタスクにおいて、より優れた公式評価結果を示しています。.

両モデルとも、以下のリストに掲載されています。 グローバルGPT, これにより、個別の連携を維持することなく、比較しやすくなります。.

DeepSeek V4とは?

DeepSeek V4 は、オープンウェイト型の「エキスパート混合」モデル群です。その 公式モデルカード V4 Proの価格を 合計 1.6T / アクティブパラメータ 49B およびV4 Flashは 合計 284B / アクティブなパラメータ 13B. どちらも1Mトークンのコンテキストウィンドウに対応しており、MITライセンスを採用しています。.

DeepSeek V4 Pro 対 Flash:仕様比較

仕様V4 フラッシュV4 Pro
バージョンFlash-0731Pro-0813
パラメータ284B / 13B アクティブ1.6T / 49B アクティブ
文脈/出力1M / 384K1M / 384K
並行性2,500500

について 公式モデル・価格一覧ページ ツール呼び出し、JSON出力、Responses API、およびこれら両方に対するAnthropic互換APIのサポートを列挙しています。.

DeepSeek 公式 V4 Flash および V4 Pro モデルと価格表
DeepSeekの公式APIドキュメントでは、現在のV4 FlashおよびV4 Proのバージョン、利用制限、機能、価格について確認できます。.

価格とスループット

Flashのコストは、キャッシュミスが発生した入力トークン100万個あたり$0.14、出力トークン100万個あたり$0.28です。Proのコストは、それぞれ$0.435および$0.87です。Flashは約 68%の方が安い キャッシュされていない通常のトラフィックについては。.

価格に関する注意: DeepSeekは、APIの価格を全体的に引き上げる予定であると発表しています。予算を立てる前に、公式サイトを再度ご確認ください。.

ベンチマークが実際に示していること

最大負荷時、DeepSeekの報告によると、LiveCodeBench(93.5 対 91.6)、Codeforcesレーティング(3206 対 3052)、 Terminal Bench 2.0(67.9 対 56.9)、SWE Verified(80.6 対 79.0)、BrowseComp(83.4 対 73.2)、MRCR 1M(83.5 対 78.7)において、ProがFlashを上回っています。.

Artificial Analysisでは、V4 Pro 0813を個別に次のように掲載しています。 インテリジェンス・インデックス v4.1.1 における53 そして、について 1秒あたり83.2出力トークン. 確認時点では、Flash-0731の個別の詳細ページが利用できなかったため、これは独立した直接比較の結果ではありません。.

公式 DeepSeek · 全力

主なベンチマーク結果

LiveCodeBench93.5 対 91.6Pro 対 Flash
ターミナルベンチ 2.067.9 対 56.9Pro 対 Flash
ブラウズコンプ83.4 対 73.2Pro 対 Flash
MRCR 1M83.5 対 78.7Pro 対 Flash

プロバイダーから報告された結果です。実施環境およびサンプル範囲は、DeepSeekが公表した表に準じています。これらは当団体による実地評価のスコアではありません。.

人工分析53インテリジェンス・インデックス v4.1.1 · Pro版限定
測定された出力速度83.2 t/s人工知能分析・Pro限定
証拠の制限Flash非対応の商品詳細ページこれは独立した直接対決ではありません。.
DeepSeek V4 Pro 0813 の人工分析サマリー
「Artificial Analysis」は、Pro版限定の性能および速度に関する指標を報告しています。これは、Flash製品間の独立した比較ではありません。.

DeepSeek V4 Pro 対 Flash:実機テスト

どちらのモデルも、同じプロンプト、温度、入力、およびAPIルートを受け取ります。ローカルの経過時間には、ネットワークおよびプラットフォームのオーバーヘッドが含まれます。.

実機テスト 01 · コーディング

複数ファイルの価格設定に関するデバッグ

受賞製品:V4 Pro
V4 フラッシュ18.5秒 · 519トークン

初期段階で丸め誤差が見つかったが、パーセント変換を見落とし、誤った丸め関数をそのままにしてしまった。.

V4 Pro84.9秒 · 6,857トークン

3つの不具合をすべて発見し、修正済みのファイルと、ご依頼いただいた回帰テストを返送しました。.

タスクの設定: 複数のファイルにまたがるTypeScriptの価格設定に関するバグを特定し、パブリックAPIを維持しつつ、割引および通貨の四捨五入の挙動を修正し、回帰テストを提案する。.

ここからわかること: Flashは1つの重要な症状を特定したのに対し、Proは3つのファイルすべてにわたって相互に影響し合う不具合を追跡しました。.

編集部の評価: V4 Proはすべての受け入れ基準を満たしました。Flashについては、パッチを安全に使用できるようになる前に、素材の修正が必要でした。.

実機テスト 02 · エージェント

インシデントのトリアージと体系的な計画立案

僅差の判定
V4 フラッシュ51.6秒 · 1,656トークン

実用可能なガード付きプランを作成しましたが、要求されたJSONをMarkdownのコードフェンスで囲んでしまいました。.

V4 Pro111.6秒 · 9,172トークン

有効なJSONのみを返し、エビデンスの判定基準をより明確にし、それに伴う制約を厳格化しました。.

タスクの設定: 読み取り専用の証拠に基づいてインシデントの優先順位付けを行い、事実と仮定を区別し、承認が必要なアクションを特定し、検証計画を作成し、厳密に構造化された出力を生成する。.

ここからわかること: どちらのモデルも、読み取り専用という安全境界を遵守していた。実際の違いは、フォーマットの厳格さと、速度および出力の効率性とのトレードオフにあった。.

編集部の評価: 機械可読性の高い出力が重要な場合は「V4 Pro」を、人間が計画を確認でき、効率性を最優先する場合は「V4 Flash」をお選びください。.

実機テスト 03 · 日常業務

「厳格なJSON」に関する会議メモ

僅差の判定
V4 Flash · 18.6秒 · 418トークン

JSONは有効で処理も高速ですが、確定済みの予算ステータスを「未定」と誤ってラベル付けしてしまいました。.

V4 Pro · 220.9秒 · 17,244トークン

事実と不確実性のラベル付けがより正確に行われた、有効なJSON。.

タスクの設定: 日付付きのプロジェクトメモを、事実情報を追加することなく、固定のJSONスキーマに変換する。.

ここからわかること: Flashの方がはるかに効率的でした。Proはリスク状態をより正確に判定しました。.

編集部の評価: 「Pro」は自動化されたリスク判断用、「Flash」は人間による確認を伴う情報抽出用です。.

実機テスト 04 · 調査

証拠に基づく意思決定メモ

両方とも合格した
V4 フラッシュ・9.9秒・333トークン

ソースパックの範囲内に留まり、タスクベースのルーティングを作成した。.

V4 Pro · 60.4秒 · 4,189トークン

同様の推奨事項ですが、証拠の適用範囲や安全措置についてより明確な規定が設けられています。.

タスクの設定: 指定された資料パックのみを使用し、証拠の欠如を示す箇条書きを正確に3つ挙げて、180~230語のメモを作成してください。.

ここからわかること: 両者とも根拠のない主張に反論し、同じ勧告に達した。.

編集部の評価: どちらも合格でした。Proの方がわずかに精度が高く、Flashの方がはるかに効率的でした。.

実技試験 05 · 推論

自己チェック機能付き制約スケジューリング

受賞製品:V4 Pro
V4 フラッシュ・6.3秒・173トークン

「AMのみ」というルールにもかかわらず、PMにEを入力し、その後、そのスケジュールを有効とマークした。.

V4 Pro · 31.5秒 · 2,118トークン

有効なスケジュールを返し、すべての制約を正確に確認しました。.

タスクの設定: 5つの依存タスクを5つのスロットに割り当て、6つの制約を満たし、JSON形式でのみ結果を返し、すべてのルールについて自己チェックを行う。.

ここからわかること: Flash自身の検証結果が、そのスケジュールと矛盾していた。.

編集部の評価: V4 Proは、スケジュールもチェックも正しかったため、勝利を収めました。.

どのDeepSeek V4モデルを選ぶべきか?

コーディング

Flashから始めよう 独立した関数、テスト、SQL、および範囲が明確に限定された修正について。.

  • 複数のファイルによる曖昧さを解消するには、Pro版へアップグレードしてください。.
  • ターミナル操作が中心となる復旧作業には、Pro版をお勧めします。.

代理店

Flashから始めよう 要するに、セキュリティ対策が施されたツールチェーンのことです。.

  • 依存関係のあるステップが長い場合は、Proをご利用ください。.
  • 権限の設定はモデル外で行うようにしてください。.

日常の作業

Flashから始めよう 要約、情報抽出、メールの下書きなどに。.

  • 競合するドキュメントについては、Proをご利用ください。.
  • 重大な主張については、外部で検証を行う。.

DeepSeek V4 Pro 対 Flash:選び方

意思決定ダッシュボード · 5件の該当テスト

モデル名ではなく、補正コストに基づいて経路を決定する

Flashの利点5 / 5 速い
プロ級の勝利2つの圧勝
公式価格差~3.11×
作業量開始証拠以下の場合にはエスカレーションを行う
一括抽出フラッシュ5/5で高速化;同時接続数2,500リスクラベルが自動化を推進する
リポジトリのデバッグプロシードされた欠陥をすべて発見しましたトリアージ専用フラッシュ
ショート・ガード付きエージェントフラッシュ低コストで利用可能厳格なJSON形式が必須です
制約の自動化プロ有効なスケジュールと確認事項人間による校正は安上がりだ
エビデンスの統合どちらか両方とも合格したレイテンシの許容範囲で選択する

結論: 境界のあるボリュームについては、デフォルトでFlashを使用する。補正コストがトークンコストを上回る場合は、Pro版を購入する。.

よくある質問

DeepSeek V4 Flashはコーディングに適していますか?

はい。公式の結果によると、一部のコーディングテストでは、FlashはProに迫る成績を収めています。ただし、コーディングの範囲がターミナルの操作、ブラウジング、あるいはリポジトリの理解にまで及ぶと、Proの方が明らかに優位になります。.

V4 ProとFlashは、同じコンテキストウィンドウを使用していますか?

はい。DeepSeekでは、100万トークンのコンテキストウィンドウと、いずれの場合も最大384Kトークンの出力が指定されています。.

V4 Proは常に精度が高いのでしょうか?

どのモデルも常に正確というわけではありません。「Pro」はアクティブ容量が大きく、最も難易度の高い公式比較ではトップの成績を収めていますが、厳密に定義された日常的なタスクにおいては、実用上の違いはほとんど見られない場合があります。.

V4 Flashはどれくらい安いのですか?

2026年8月13日時点で確認された価格によると、キャッシュミス時の入出力トークンにおいて、Flashは約68%安くなっています。.

どちらのモデルも道具を使うことができますか?

はい。公式のAPI一覧表には、ツール呼び出し、JSON出力、レスポンスAPI、および両方のAnthropic互換APIのサポートが記載されています。.

実機テストでは、どちらのモデルの方が速かったのでしょうか?

V4 Flashは、5つのローカルAPI実行すべてにおいて処理速度が速かった。これらの実行時間はネットワークおよびプラットフォームのオーバーヘッドを含んでいるため、プロバイダー側の遅延ではない。.

V4 Proはなぜ、これほど多くの補完トークンを使用するのでしょうか?

テスト対象となったProルートでは、完了予算内にかなりの量の内部推論トークンが含まれていることが確認されました。これは難易度の高いタスクでは役立つ可能性がありますが、所要時間とトークン使用量が増加します。.

すべてのエージェントのワークフローでV4 Proを使用すべきでしょうか?

いいえ。短期間で、範囲が限定され、検証可能なツールチェーンを構築する場合は、まず「Flash」から始めましょう。エラーや相互に作用する制約の修正コストが高くなる場合は、「Pro」に移行してください。.

これらはDeepSeekの公式ベンチマーク結果なのでしょうか?

いいえ。この5枚のカードは、本記事における管理されたAPIテストの結果を示しています。公式のDeepSeekベンチマークおよびサードパーティによる人工分析データは、別途ラベルが付けられています。.

同じプロンプトを以下で比較してください グローバルGPT あるルートに決める前に。.

記事を共有する

関連記事