Qwen ニュース 2025/01/28 AI判定 重要度:中

Alibaba「Qwen2.5-Max」発表──DeepSeek-V3を上回るとするMoEモデル

#Qwen#Alibaba#AI史

Alibabaが2025年1月28日、大規模MoEモデル「Qwen2.5-Max」を発表しました。DeepSeekがV3・R1で世界に衝撃を与えた直後というタイミングで投入されたモデルで、Arena-Hard・LiveBench・LiveCodeBench・GPQA-Diamondなどのベンチマークで DeepSeek-V3を上回り、一部指標ではGPT-4o級かそれ以上の性能を示したとAlibabaは説明しています。

詳細

  • アーキテクチャ: 大規模なMixture-of-Expertsモデルで、20兆トークン超で事前学習された後、教師ありファインチューニング(SFT)と人間フィードバックからの強化学習(RLHF)で仕上げられた
  • ベンチマーク: Arena-Hard・LiveBench・LiveCodeBench・GPQA-Diamondなどで DeepSeek-V3を上回り、MMLU-Proなどでも競争力のある結果を記録したとAlibabaは主張
  • 登場の背景: DeepSeekのV3・R1が業界に衝撃を与えた直後というタイミングでの発表であり、中国国内でのAI開発競争が激化していることを象徴する動きだった
  • 提供方法: Alibaba CloudのAPIとして提供開始。Qwen ChatでもモデルAPI利用が呼びかけられた

その後

Qwen2.5-MaxはAlibabaが「クローズドの最上位モデルでも世界トップ級に対抗できる」ことを示した一手となった。この路線はその後2025年4月の「Qwen3」、そして2026年に入ってからのQwen3.5・Qwen3.6・Qwen3.7と続く急速なモデル刷新へとつながっていく。