DeepSeek、新アーキテクチャ第一弾「V4.1-Flash」を発表 ネイティブ視覚理解を搭載
DeepSeekは2026年9月10日、「DeepSeek-V4.1-Flash」をリリースしました。同社はこれを、ネイティブな視覚理解を核に据えた新アーキテクチャファミリーの中で最小のモデルと位置づけています。自社の旧フラッグシップであるV4-Proを、性能・コスト・速度・処理完了までの総時間すべてで上回るとしており、価格もおよそ3分の1程度にまで引き下げられました。
詳細
- 新アーキテクチャ: 552BパラメータのMixture-of-Expertsモデルで、入力処理にはわずか8B、出力生成には16Bのアクティブパラメータしか使わない非対称な「因果的エンコーダー・デコーダー」構造を採用
- ネイティブなマルチモーダル理解: 視覚理解を後付けではなくモデルに内蔵。DeepSeekはこのファミリーを「より高い能力上限、より高速な推論、より高いスループット、そしてより大規模なモデルへのスケーリング」を狙って設計したと説明
- ベンチマーク結果: GPQA Diamondで90.9、Codeforcesレーティングで3471、Terminal-Bench 2.1で90.6、Chartography(ツール使用)で78.9、BabyVision(ツール使用)で89.6を記録
- メモリ効率の改善: KVキャッシュの必要容量を、前世代モデル比でHBMは約4分の1、SSDは約8分の1にまで削減
- 価格: 入力100万トークンあたり0.15ドル、出力100万トークンあたり0.60ドル。オフピーク料金はピーク料金の50%に設定され、旧V4-Flashより安く、V4-Proのおよそ3分の1の価格を実現
- 利用方法: モデルID「deepseek-flash」で利用可能。旧名称の「deepseek-v4-flash」「deepseek-v4-flash-vision-exp」は自動的にV4.1-Flashへルーティングされる
- エコシステム対応: WorkBuddy、CodeBuddy、OpenCodeといったパートナーがすでに新モデルに対応済みで、オープンソースでのデプロイオプションも計画中
その後
DeepSeekは、2026年9月14日以降、「deepseek-v4-pro」宛てのAPIリクエストはすべてV4.1-Flashの料金でV4.1-Flashへルーティングされる、V4-Proの段階的フェーズアウト計画を明らかにしました。ただしユーザーからの要望を受け、V4-ProのAPI自体は完全停止せずそれ以降も稼働を継続するとしており、既存の統合先には移行のための猶予が与えられています。今回のリリースは、7月のV4-Flash、8月のV4-Flash-Vision-Expプレビューに続く、DeepSeekのFlashラインにおける急速なリリースサイクルを引き継ぐものです。