これまで『破壊的な安値』を武器に生成AI市場を揺るがしてきた中国DeepSeekが、収益化に向けた大きな舵切りを行いました。2026年8月13日に旗艦モデル『DeepSeek-V4-Pro-0813』の正式一般提供(GA)を開始した同社は、続く8月16日より時間帯別従量課金制(ピーク/オフピーク料金制)を導入しました。これにより、ピーク時の出力単価は従来の100万トークンあたり0.87ドルから3.96ドルへと約4.5倍に高騰しています。
DeepSeek-V4-ProのGAと4.5倍値上げの現実
今回の価格改定において最も注目すべきは、単なる値上げではなく『時間帯による価格差』が設定された点です。協定世界時(UTC)のピーク帯にリクエストを送ると従来比で約4.5倍のコストがかかる一方、オフピーク帯に処理を回せば定価の50%割引が適用されます。市場シェアを急拡大させた後にGA化と引き換えに回収フェーズに入る手法は、ITインフラでは定石ですが、格安モデルを前提にAIエージェントや問い合わせ自動化を組んでいた現場にとっては大きな打撃となります。
DeepSeek-V4-Pro-0813 の正式提供により、高度な推論機能と長文処理能力を安定提供する環境が整いました。持続可能なインフラ運用のためにピーク帯とオフピーク帯の新たな料金体系を採用します。
ベンチ比較が示す実力と自社モデルとの乖離
価格が急拡大した一方で、その性能が価格上昇に見合うものかどうかは慎重な見極めが必要です。公式発表ではエージェント評価の Terminal Bench 2.1 で 87.9、開発支援の DeepSWE で 62.7 という高い数値をアピールしています。しかし、第三者検証機関である Artificial Analysis の横断的ベンチマークにおいて、V4-Pro の総合スコアは 53点 に留まりました。
問題は、同社が2026年7月末に公開した無料の軽量モデル『V4-Flash』のスコアが 50点 であったことです。わずか3ポイントの性能差に対して、API単価が跳ね上がる構造となっています。さらに、V4-Pro が採用する思考モード(Thinking Mode)は回答の裏で多大な『思考トークン』を消費するため、1回あたりの実際のAPI請求額は表層のトークン単価以上に膨らみやすいという隠れた落とし穴が存在します。
格安AI依存の自動化ラインが抱える構造的リスク
今回の値上げ劇が教える最大の教訓は、特定モデルの異常な安値に依存したシステム設計の脆さです。例えば、月10万件のAPI呼出を伴う問い合わせ一次対応や見積チェックの自動化ラインを「格安だから」という理由で DeepSeek 単体に繋いでいた場合、単価改定だけで毎月のシステム運用費が数倍に跳ね上がります。
モデル提供ベンダの収益化タイミングひとつで利益率が削られる構造は、経営上避けなければなりません。単一の安価なAPIに業務を固着させるのではなく、処理の重要度に応じた切り替えや、バッチ処理化によるオフピーク帯の活用といった柔軟な設計があらかじめ求められます。
中小企業はどう構えるか|時間帯シフトと乗り換え判断
では、地方や中小企業の現場はこの変化にどう対処すべきでしょうか。まず行うべきは「即時性が求められない処理の洗い出し」です。夜間や早朝に回せるデータ整形・日次レポート生成・バックオフィス業務のAI処理をオフピーク時間帯(50%割引)にバッチで集中させれば、値上げの影響を大幅に緩和できます。
同時に、リアルタイム処理が必要な問い合わせ対応などについては、同等コスト帯の他社モデル(Gemini FlashやClaude Haiku等)へ速やかにプロンプトを切り替えられる『マルチモデル構成』を整えることがリスクヘッジとなります。
出典 / SOURCES
- DeepSeek-V4-Pro GA Release - DeepSeek API Docs
- DeepSeek officially launches V4-Pro AI model in August 2026 - Quartz
- DeepSeek's updated V4 Pro AI model struggles on benchmarks, shines in cybersecurity - South China Morning Post
※本記事は公開情報をもとに AI が自動で編集・要約し、出典を明記しています。正確性は各出典をご確認ください。