DeepSeek ニュース 2026/09/10 AI判定 重要度:高

DeepSeek、新アーキテクチャ第一弾「V4.1-Flash」を発表 ネイティブ視覚理解を搭載

#DeepSeek#V4.1-Flash#LLM#API#マルチモーダル

DeepSeekは2026年9月10日、「DeepSeek-V4.1-Flash」をリリースしました。同社はこれを、ネイティブな視覚理解を核に据えた新アーキテクチャファミリーの中で最小のモデルと位置づけています。自社の旧フラッグシップであるV4-Proを、性能・コスト・速度・処理完了までの総時間すべてで上回るとしており、価格もおよそ3分の1程度にまで引き下げられました。

詳細

  • 新アーキテクチャ: 552BパラメータのMixture-of-Expertsモデルで、入力処理にはわずか8B、出力生成には16Bのアクティブパラメータしか使わない非対称な「因果的エンコーダー・デコーダー」構造を採用
  • ネイティブなマルチモーダル理解: 視覚理解を後付けではなくモデルに内蔵。DeepSeekはこのファミリーを「より高い能力上限、より高速な推論、より高いスループット、そしてより大規模なモデルへのスケーリング」を狙って設計したと説明
  • ベンチマーク結果: GPQA Diamondで90.9、Codeforcesレーティングで3471、Terminal-Bench 2.1で90.6、Chartography(ツール使用)で78.9、BabyVision(ツール使用)で89.6を記録
  • メモリ効率の改善: KVキャッシュの必要容量を、前世代モデル比でHBMは約4分の1、SSDは約8分の1にまで削減
  • 価格: 入力100万トークンあたり0.15ドル、出力100万トークンあたり0.60ドル。オフピーク料金はピーク料金の50%に設定され、旧V4-Flashより安く、V4-Proのおよそ3分の1の価格を実現
  • 利用方法: モデルID「deepseek-flash」で利用可能。旧名称の「deepseek-v4-flash」「deepseek-v4-flash-vision-exp」は自動的にV4.1-Flashへルーティングされる
  • エコシステム対応: WorkBuddy、CodeBuddy、OpenCodeといったパートナーがすでに新モデルに対応済みで、オープンソースでのデプロイオプションも計画中

その後

DeepSeekは、2026年9月14日以降、「deepseek-v4-pro」宛てのAPIリクエストはすべてV4.1-Flashの料金でV4.1-Flashへルーティングされる、V4-Proの段階的フェーズアウト計画を明らかにしました。ただしユーザーからの要望を受け、V4-ProのAPI自体は完全停止せずそれ以降も稼働を継続するとしており、既存の統合先には移行のための猶予が与えられています。今回のリリースは、7月のV4-Flash、8月のV4-Flash-Vision-Expプレビューに続く、DeepSeekのFlashラインにおける急速なリリースサイクルを引き継ぐものです。