DeepSeekがV4.1-Flashを発表、ネイティブ視覚理解と低価格で市場に挑戦

V4.1-Flashの主な特徴と技術的進化

DeepSeekは2026年9月10日にV4.1-Flashを発表した。新しいアーキテクチャーファミリーの最小モデルとして位置づけられ、ネイティブな視覚理解機能を備えている。API名はdeepseek-flashとなり、5520億パラメーターのモデルで入力処理時には80億パラメーター、出力生成時には160億パラメーターがアクティブ化される設計だ。KVキャッシュは前世代の4分の1の高帯域メモリーと8分の1のSSDストレージで済むようになり、推論効率が大幅に向上している。SGLangとvLLMが初日からサポートを発表しており、開発者は既存の環境からすぐに移行できる。

価格戦略とV4-Proの移行

DeepSeekはAPI価格を引き下げ、オフピーク時間帯の料金はピーク時の半額になった。さらにV4-Proは段階的に廃止され、2026年9月14日の04:00UTCからdeepseek-v4-proへのリクエストはすべてV4.1-Flashにルーティングされる。料金もV4.1-Flashのレートが適用されるため、既存ユーザーはコストを下げながら新モデルを利用できる。推論労力を制御できる設計もあり、用途に応じて性能とコストのバランスを調整できる点が実用的だ。

背景と市場への影響

DeepSeekはこれまで低価格と高効率を武器に前沿モデル市場で存在感を示してきた。V4.1-Flashはその戦略をさらに強化し、ネイティブ視覚理解を加えることでマルチモーダル対応の競争に本格参入する。一部のユーザーからは他モデルの蒸留ではないかという指摘もあるが、効率性と低価格の両立は開発者にとって大きな魅力だ。中国発のモデルが国際市場で価格競争力を高めている状況は、他のプロバイダーにとっても価格と性能の最適化を迫られる展開となっている。