対象サービス: ChatGPT Claude DeepSeek Gemini Grok Llama Mistral Qwen
OpenAIが「GPT-6 Astra」をリリース。コンピュータ操作・コーディング・サイバーセキュリティ・数学などで最先端の成果を主張し、「解決不可能なタスクの回避率」もGPT-5.6 Solの48%から0%へ改善。ChatGPT・API向けに即座に展開を開始する。
OpenAIが「Daybreak for Frontline Defenders」を発表。今後6か月間、水道・電力事業者、地方自治体、地域銀行など、リソースが限られた防御側組織に対し、最先端のサイバーセキュリティAIへの補助付きアクセスを10億ドル規模で提供する。米国から開始。
Google DeepMindの最新音楽生成モデル「Lyria 3.5」がGeminiアプリに登場。表現力豊かなボーカルと厚みのある編曲を実現する、これまでで最も音質の良い音楽生成モデルとされ、Geminiアプリ・Google Flow Music・Google AI Studio・Google Vidsで利用可能に。
OpenAIが「Daybreak for Frontline Defenders」を開始。水道事業者・電力網運営者・地方自治体・地域銀行など、大企業並みのセキュリティ予算を持たない防御側組織に、6か月間で10億ドル規模の補助付きアクセスとハンズオン研修を提供する。
OpenAIが「GPT-6 Astra」の安全性概要を公開。同社史上最も高性能な広範展開モデルであり、Preparedness Frameworkの定めるサイバーセキュリティ能力「Critical」水準に達した初のモデル。一方でChain-of-Thoughtの監視可能性がGPT-5.6 Solより低下したことも明らかにした。
xAIは9月3日、Grok Botのエンタープライズ提供を開始。既存のGrokおよびCursor Enterprise顧客は組織全体を招待できる2週間の無料トライアルに加え、監査機能などの管理者向け機能も利用できる。
OpenAIが公開したGPT-6 Astraの完全なシステムカードでは、安全性概要の主張を裏付ける詳細な数値ベンチマークに加え、英国AISIやApollo Researchによる外部レッドチーム結果も明らかに。モデルが自らのChain-of-Thoughtを意図的に制御する能力が、GPT-5.6 Solと比べて大幅に高まっていることが判明した。
AlibabaのQwenチームがTaobao・Tmallと共同で、18の最先端モデルにネットショップを365日間運営させて評価するベンチマーク「E-Commerce Bench」をオープンソース公開。単発タスクの達成度ではなく、利益・交渉力・不正回避・長期学習を多角的に採点する。
Googleが「Fairwindプログラム」を開始。認証を受けた政府機関・重要インフラ事業者・プラットフォームメンテナーに、「Gemini 3.8 Flash Cyber」とパッチ適用基盤「CodeMender」を組み合わせて提供する。Google.orgによる1億ドル超のサイバーセキュリティ資金提供に支えられ、すでに世界で650社超が参加。