本文へスキップ
MameTechNews
AI

DeepSeekがV4.1-Flashを公開、V4 Proは14日から新モデルへ誘導

## POINTS

  • 既存のdeepseek-v4-proは14日以降Flashへ誘導され、単価もFlash側に変わる
  • 大規模推論はコミュニティ対応待ち。2,000GPU級の配備は公式が相談窓口を案内している
  • キャッシュ圧縮が効くのは長コンテキストのエージェント作業。閑散時料金はピークの半額

DeepSeekは2026年9月10日、新しいモデル構造系列の最小サイズとなるV4.1-Flashを正式公開した。APIではモデル名をdeepseek-flashに切り替えれば利用できる。旧V4 FlashとV4 Flash Vision Expは退役し、互換のため既存のモデル名は当面新モデルへルーティングされる。公式はオープンソースコミュニティと推論対応を進めるとし、2,000GPUとストレージクラスタを持つ大規模配備は相談を呼びかけている。

新モデルは552BパラメータのMoEで、Causal Encoder-Decoderを採用する。入力時は8B、出力時は16Bだけが起動し、KVキャッシュは前世代比でHBM需要が4分の1、SSD需要が8分の1になる。エージェント用途ではキャッシュヒット課金の比重が大きいため、長コンテキスト作業の単価に効く。新料金は北京時間9月10日12時からで、閑散時はピークの半額。

北京時間9月14日12時以降、V4.1 Pro登場までの間、deepseek-v4-proへのリクエストはすべてV4.1-Flashへ送られ、Flash単価で課金される。公式は性能・費用・速度でV4 Proを上回ったとする。既存のPro固定呼び出しは、意図しないモデル置換と請求変更に注意する必要がある。