DeepSeek V4が正式版へ 旧API終了で価格の下限固まる
この記事の要点
DeepSeekはV4を正式版に移し、7月24日に旧モデルIDを廃止した。MITライセンスのオープンウェイトで、Flashは入力100万トークン0.14ドル。Kimi K3の無償公開と合わせ、オープンモデルが安価な下限と最前線の両方を押さえた。企業のコスト設計への影響を整理する。
結論
DeepSeekはV4系モデルをプレビューから正式版に移し、7月24日に旧モデルIDを廃止した。V4はMITライセンスのオープンウェイトで、Flashは入力100万トークンあたり0.14ドルと安い。同じ週にKimi K3の重みが無償公開されたことで、オープンモデルの層は、安定して安い選択肢と、無償で使える最前線級の選択肢の両方を揃えた。コマーシャルなモデルの価格に構造的な圧力がかかり続ける。
DeepSeek V4の料金は当メディアも時間帯別のAPI料金を導入した件で扱った。今回は正式版への移行と旧APIの終了が焦点で、運用面での対応が要る。
いつ・誰が・何を変えたか
DeepSeekは7月20日、V4系を正式版に移した。V4-Proは総パラメータ1.6兆で動くのは490億、V4-Flashは総284億で動くのは130億とされ、どちらもMITライセンスのオープンウェイトである。プレビュー開始の4月24日から3カ月弱での正式化にあたる。
運用上の節目は7月24日だ。旧モデルIDのdeepseek-chatとdeepseek-reasonerが協定世界時の同日15時59分で廃止された。これまでこれらの名前はV4-Flashへ内部で転送されていたが、後方互換が終わり、以降は旧名での呼び出しがエラーを返す。旧IDを使い続けている場合は、V4系のモデル名へ切り替える必要がある。
料金は、5月末にV4-Proの標準レートが約75%引き下げられ、恒久的な値下げとされた。V4-Flashは0.14ドル、V4-Proは0.435ドル、キャッシュ利用時はさらに下がる。ただし北京の業務時間帯は高い料金が適用される。数値は変わりうるため、最新は公式で確認してほしい。
現場の実務にどう効くか
コスト設計の観点では、V4系は高頻度で定型的な処理を安く回す層を担う。大量に発生する分類、要約、下書きの生成といった、AI予算の多くを占める処理に向く。ここにKimi K3のような最前線級の無償オプションが加わり、オープンモデルは低コストの量産処理と、能力が要る処理の両方を現実的に受け持てるようになった。判断材料はKimi K3の重み公開と自社運用の壁と合わせて見るとよい。
一方で、旧APIの終了は運用の教訓を残す。モデルのIDやバージョンに依存した実装は、提供元の移行スケジュールで動かなくなる。モデル名を設定で切り替えられるようにし、提供元の廃止予定を定期的に確認する運用が要る。オープンモデルの安さは、価格の据え置きで応じる最上位モデルの動きと対になっている。この点はClaude Opus 5を半額水準で提供する動きやGemini 3.5 Flashの一般提供による低コスト化と合わせて捉えたい。
コスト試算の目安も持っておきたい。月に数千万トークンを処理する現場なら、入力の単価が0.14ドルと5ドルでは、同じ処理量でも費用が桁で変わる。定型処理を安いモデルに寄せ、判断が要る処理だけ高性能モデルに回すだけで、AI予算の多くを占める部分を抑えられる。実際に切り替える前に、自社の代表的な処理でいくつかのモデルを走らせ、出力の品質と単価を並べて比べるとよい。ベンチマークの数値ではなく、自社の処理での実測が判断の土台になる。
安さだけで一社に固定せず、用途ごとにモデルを使い分け、切り替えられる構成にしておくことが、価格競争と移行リスクの両方に対する備えになる。
出典
よくある質問
DeepSeek V4の料金はいくらですか
V4-Flashが入力100万トークンあたり0.14ドル、V4-Proが0.435ドルとされ、キャッシュ利用時はさらに下がります。北京の業務時間帯は高い料金が適用されます。最新の料金は公式で確認してください。
7月24日に何が変わりましたか
旧モデルIDのdeepseek-chatとdeepseek-reasonerが協定世界時7月24日15時59分で廃止されました。以降は旧名での呼び出しがエラーを返すため、V4系のモデル名へ切り替える必要があります。