対象サービス: ChatGPT Claude DeepSeek Gemini Grok Llama Mistral Qwen
Meta Superintelligence Labsは、コンシューマー向けGPU1枚やMacでも動作し、常時稼働するローカルエージェントを実現するApache 2.0ライセンスの300億パラメータモデル「Muse Glimmer」を公開しました。投機的デコーディングやマルチモーダル入力にも対応します。
Anthropicは、Claude Fable 5が生物学関連の質問をより能力の低いOpus 5へ振り分ける判断基準となる安全分類器の「憲法(constitution)」を書き直し、危険な用途は引き続きブロックしつつ、不要なフォールバックを約85%削減した。
OpenAIが開発中モデル「Astra」の予備的な内部サイバーセキュリティ評価結果を公表。Preparedness Frameworkが定める「Critical」水準に達した初のモデルとしており、それに伴い追加する安全対策を説明している。
xAIが新しい画像生成・編集モデル「Imagine Image 2.0」を発表。文字組みやレイアウト、複数参照画像を使った編集、キャラクターの一貫性を保ったワールド構築に対応し、grok.com/imagineのQuality Modeとして提供開始。
OpenAIが公開した新レポート「Signals」は、144カ国のChatGPT利用データを分析。仕事での使い方は「質問する」から「作業をこなす」へとシフトし、ラテンアメリカではマルチメディア利用が急増、35歳以上の利用者層も急速に拡大している。
OpenAIによると、更新版のGPT-5.6 Solは金融・医療・法律分野での事実誤りをGPT-5.5 Instant比で約68%削減。GPT-5.6 LunaはFree/Goユーザーのデフォルトモデルとなり、無制限チャットと新しい「Think」ボタンが来週提供開始予定。
Googleが、Geminiの旅行プラン作成の仕組みを解説。Maps・Hotels・Flightsから得たリアルタイムデータを活用し、Gmail内の既存予約と照合したうえで、Gemini Sparkエージェントがブラウザ上で航空会社サイトの予約フォームまで自動入力する。
OpenAIとアメリカ心理学会(APA)が青少年のメンタルヘルスとAI安全性に関する提携を発表。危機対応リソースや保護者向け機能、年齢推定モデルなど「具体的」とされる内容の大半は既存のChatGPT機能の再掲であり、新規の取り組みは日程未定のまま。
Anthropicがベータ版「Inference hooks」をClaude Enterprise向けに公開。組織が用意した独自のAIセキュリティサーバーが、claude.ai・Cowork・Claude Codeを横断してすべての管理対象プロンプトを推論実行前にリアルタイムで許可・拒否できるようになりました。