本文へスキップ
MameTechNews
AI

DeepSeekがV4-Proを正式公開、推論強度3段階とピーク料金へ

## POINTS

  • 8月16日からピーク/オフピーク課金が始まるため、バッチ処理はオフピークへ寄せたい
  • 推論強度をlow/high/maxで切替でき、単純作業と複雑エージェントをコスト分離できる
  • Responses API互換により、既存のCodex系クライアントからの移行検証が進めやすい

何が起きたか

DeepSeekはDeepSeek-V4-ProのGAを発表し、アプリ/Web(Expert Mode)とAPIで利用可能にした。モデル名は従来どおりdeepseek-v4-pro。エージェント能力の強化に加え、V4-Pro/V4-Flashで推論強度をlow/high/maxから選べる。Codex向けに最適化したOpenAI Responses API形式もネイティブ対応する。

背景

エージェント用途ではツール呼び出しや多段ワークフローでトークン消費が膨らむ。同社はピーク時間帯(UTC 01:00–04:00および06:00–10:00)とその他のオフピークで料金を分け、オフピークはピークの半額とした。新料金は2026年8月16日16:00 UTC発効。コンテキスト長は最大1M、最大出力は384K。

実務への影響

安価なエージェント基盤としての採用検討は続く一方、バッチや夜間ジョブはオフピークへ寄せ、対話系はピーク単価を前提に見積もる必要がある。現行のフラット料金からの上昇も織り込むこと。