DeepSeekがV4.1-Flashを発表し値下げ|V4 Proの退役予告は撤回

画像の出典:DeepSeek公式ブログ

AI導入におけるコスト効率と推論性能のバランスは、多くの企業にとって最優先課題となっている中で、DeepSeekは2026年9月10日、新モデル「DeepSeek-V4.1-Flash」を発表しました。同社は新しいモデル構造系列の「最小サイズのモデル」と位置づけています。

本記事では、新モデルの技術的特徴や料金体系の変更、そして既存モデルからの移行に伴う影響について詳しく解説します。

新モデルV4.1-Flashの技術的概要と性能

構造の刷新と視覚理解への対応

DeepSeek-V4.1-Flashは、552B(5520億)パラメータを持つMoE(混合専門家モデル)を採用しています。特筆すべきは、新しいCausal Encoder-Decoder構造の導入です。これにより、入力時に8B(80億)、出力時に16B(160億)のパラメータのみを稼働させる仕組みとなり、計算リソースの最適化を実現しました。また、ネイティブでの視覚理解(画像認識)機能にも対応しており、マルチモーダルな業務プロセスへの適用範囲が広がっています。

KVキャッシュ圧縮による効率化

運用面での大きな改善として、KVキャッシュ(推論時に過去の計算結果を保持するメモリ領域)の圧縮技術が挙げられます。公式発表によると、前世代モデルと比較してHBM(広帯域メモリ)の使用量は1/4、SSDの使用量は1/8にまで削減されました。初代モデルと比較した場合は437分の1という大幅な効率化を達成しており、大規模な推論処理を行う際のインフラ負荷軽減が期待されます。

料金体系の改定とモデルの移行スケジュール

API利用料金の値下げ

新料金は2026年9月10日13時(日本時間)より適用されています。従来通りピーク時とオフピーク時の二段階料金制を採用しており、オフピーク時はピーク時の半額に設定されました。オフピーク時の単価は、入力(キャッシュミス時)が100万トークンあたり0.15ドル、キャッシュヒット時は0.003ドル、出力は0.60ドルです。旧モデルのV4 Flashと比較して、入力・出力ともに値下げが実施されています。

モデル名の整理とルーティングの変更

今回の発表に伴い、APIモデル名の整理が行われます。V4.1-FlashのAPIモデル名は「deepseek-flash」です。旧モデルの「deepseek-v4-flash」と「deepseek-v4-flash-vision-exp」は退役しましたが、互換性のため当面はこれらの名称での指定もV4.1-Flashへ転送されます。また、発表時点では日本時間9月14日13時以降に、既存の「deepseek-v4-pro」へのリクエストもすべてV4.1-Flashへルーティングされる予定とされていました。ただしDeepSeekは2026年9月12日にこの予定を取り消し、公式ドキュメントで「利用者の要望を受け、2026年9月14日以降もDeepSeek V4 ProのAPI提供を継続する。課金方法は変更しない」と案内しています(2026年9月12日時点)。

関連記事:DeepSeek APIが時間帯別料金へ移行|ピーク時は最大4.7倍に値上げ

パフォーマンス比較と公式データの解釈

公式の説明と、公式が出した比較表が食い違う

DeepSeekは、V4.1-Flashが性能・費用・速度・総時間の各指標でV4 Proを「全面的に超えた」と主張し、当初はこれを理由にV4 Proの退役を予定していました(前述のとおり、この予定は2026年9月12日に取り消されています)。しかし、公式に公開されたベンチマーク比較表を確認すると、GPQA Diamond(大学院レベルの難問)やHLE(Humanity's Last Exam=難問揃いの総合テスト)といった項目では、依然としてV4 Proのスコアが上回っていることが分かります。

他社モデルとは項目ごとに勝ち負けが分かれる

Terminal-Bench 2.1(90.6対GPT-5.6 Sol 88.8・Claude Opus 5 89.1)やAutomation-Bench(54.8対45.8・50.3)ではV4.1-Flashが上回る一方、同じTerminal-Benchでも3.0(30.0対34.4・43.3)と4.0(31.2対39.9・51.8)、ProgramBench(20.3対23.0・37.0)では下回っています。

導入にあたっての注意点

現在、V4.1-FlashはAPI経由での利用が可能ですが、Web版(chat.deepseek.com)や公式スマホアプリでの提供については公式発表に言及がありません。また、公式パートナーとしてWorkBuddyやOpenCodeが対応を開始しており、モデル自体はHugging Face上で公開されています。企業での導入を検討する際は、APIのルーティング変更に伴うコスト変動を事前に試算し、自社のユースケースに適合するかをベンチマーク結果と照らし合わせる必要があります。

まとめ

  • DeepSeek-V4.1-Flashは552BパラメータのMoEモデルで、視覚理解に対応。
  • API料金は値下げされ、オフピーク時は入力0.15ドル(キャッシュミス時)から利用可能。
  • KVキャッシュ圧縮により、前世代比でHBM使用量を1/4に削減。
  • 9月14日にV4 Proを切り替える予定は、2026年9月12日にDeepSeekが取り消した(提供継続・課金方法も変更なし)。
  • 性能は項目により他社モデルや旧モデルとの優劣があるため、用途に応じた選定が必要。

API経由で最新モデルの活用を検討し、コストと性能の最適化を進めてください。

💡 編集部の見解

DeepSeekが新モデル「V4.1-Flash」を発表し、API料金を値下げしました。同時に、これまでの上位モデルV4 Proを9月14日に退役させると発表しましたが、この予定は2026年9月12日に取り消されました。

  • 公式表の性能差:公式は性能・費用・速度・総時間の各指標でV4 Proを「全面的に超えた」と主張しますが、同じ発表に載ったベンチマーク表ではGPQA Diamond(90.9対92.4)とHLE(36.8対42.7)で旧V4 Proが上回っています。
  • 切り替え予定は撤回:当初は9月14日13時(日本時間)以降、deepseek-v4-proを指定しても新モデルが応答する予定でしたが、DeepSeekは9月12日にこれを取り消しました。現時点でコードの書き換えは不要です。

まずやること:自社のコードでdeepseek-v4-proを指定している箇所を検索したうえで、当面は現行のまま使えることを確認してください。なお、この継続提供の案内は2026年9月20日時点で公式の料金ページから削除されていますが、deepseek-v4-proは料金表に掲載されたままで、退役の告知は出ていません。

出典:DeepSeek公式ブログDeepSeek公式ブログ(中国語版)DeepSeek公式APIドキュメント(2026年9月)

メルマガ登録CTA B2(MCPカオスマップ無料プレゼント)