Alibaba「Qwen3.7-Flash」公開──軽量・低価格な視覚言語モデル、エージェント性能を強化
Alibabaが、Qwen3.7シリーズの軽量・低コスト版として位置づけられる「Qwen3.7-Flash」を公開しました。同シリーズはすでにQwen3.7-Max(2026年5月)、Qwen3.7-Plus(2026年6月)が展開されており、Flashは最後発の効率重視モデルとなります。
詳細
- ネイティブ視覚言語モデル: テキストと画像を交互に受け取り、テキストを出力するネイティブなマルチモーダル構成。前世代Qwen3.6-Flashから包括的にアップグレードされている
- マルチモーダル基盤の強化: 汎用的な物体認識能力を強化したほか、実世界の知覚・空間認識能力もさらに向上
- エージェント機能の強化: Search AgentやCI Agentのようなシナリオ向けにマルチモーダルエージェント能力を大幅強化し、エンドツーエンドのタスク実行がより安定
- コーディング性能の最適化: マルチモーダルなコーディングタスクの精度も最適化
- コンテキスト長: 約100万トークンのコンテキストウィンドウと、最大65,536トークンの出力に対応し、長い複数画像シーケンスや長文ドキュメント、長時間のエージェント実行履歴を1回のリクエストで扱える
- 価格: 入力100万トークンあたり0.03ドル、出力100万トークンあたり0.13ドルと低価格に設定
- シリーズの位置づけ: Qwen3.7-Max(2026年5月)→Qwen3.7-Plus(2026年6月)に続く3.7世代の3モデル目で、内部スナップショット名は「qwen3.7-flash-2026-07-15」
使ってみるには
- Alibaba CloudのModel Studio(DashScope)経由のAPIで利用可能なほか、OpenRouterなどのサードパーティ経由でも提供されている
- 一般消費者向けチャットUIでの提供や、オープンウェイト化の有無については今のところ発表がなく、今後の続報が待たれる