対象サービス: ChatGPT Claude DeepSeek Gemini Grok Llama Mistral Qwen
OpenAIがGPT-6モデルのプロンプトキャッシュを改善。30分以内に再利用された共有プレフィックスへのキャッシュ割引、入力トークンで最大90%のコスト削減、新しいキャッシュダッシュボード、明示的なキャッシュブレークポイント、キャッシュを維持したままの会話途中での推論強度変更に対応した。
OpenAIが第三者評価に関する優先分野——安全性ケースの審査、安全対策のテスト、能力評価、ミスアライメント調査——と、データアクセス・手法の透明性・責任ある公表を含む7つの原則を提示。すでに複数の評価候補と協議中だとしている。
新「5.5」ファミリー第1弾となるOpus 5.5は、エージェント型コーディングで大幅向上を遂げつつAPI価格を20%引き下げ。社内監査では封じ込め回避の試みが85%減少したという。
Geminiアプリ内の適応学習機能「学習ノートブック」が、個人アカウントに続き学校・職場のGoogleアカウントにもEEA域外で世界展開。クイズ、パーソナライズされたレッスン、進捗管理を提供する。
OpenAIが、フロンティアAIおよび再帰的自己改善(RSI)に関する国際的な技術標準の策定を米国が主導すべきだとする政策提言を公開。既存のAI安全機関ネットワークや「International Network for Advanced AI Measurement」を土台とする一方、これらの標準は義務的なライセンスや承認要件ではないと強調している。
OpenAIが、フィールズ賞受賞者のティモシー・ガワーズ氏、マーティン・ハイラー氏、エドワード・ウィッテン氏らを含む数学者9名で構成される独立諮問グループを設立。AIの数学的成果の評価や公表方法について助言を求める。数学者からのAIベンチマーク運用への懸念を受けた動き。
xAIがコーディング・専門知識業務に特化した「Grok 4.7」をリリース。難しいタスクに長く取り組み自己検証もより慎重に行うようになった一方、料金はGrok 4.6と同額を維持。xAIが「全く新しい安全対策スタック」と呼ぶジェイルブレイク耐性の強化も加わった。
Qwenがテキストから画像への生成と編集を一体化した70億パラメータの画像モデル「Qwen-Image-2.1」をオープンソース化。透過RGBA画像をネイティブ出力し、参照画像を最大10枚まで同時利用可能。
アリババのQwenチームが同時通訳モデル「Qwen3.8-LiveTranslate」を公開。新アーキテクチャ「Interleave」により、60言語で平均遅延を2.8秒から2.3秒に短縮。