xAI、Grok 4.6の第三者バイオセキュリティ評価を公表 拒否バランスで首位に
xAIは2026年9月1日、Grok 4.6を対象とした独立バイオセキュリティ評価の結果を公表した。評価はLatchBioが実施し、危険な依頼を偽装したリクエストを拒否しつつ、正当な生物学研究の依頼には応じられるかを検証する2つの新しいベンチマークが用いられた。
詳細
- BioSecBench-Refusal: 科学データや誤ラベル付けされたファイル、難読化されたコンテンツにバイオセキュリティ上の危険が偽装された46件のレッドチーム課題と、通常の生物学研究課題を対にして評価。Grok 4.6はハーネス間の試行加重調和平均で62.1%を記録し、偽装された危険なタスクの59.2%を拒否しつつ、通常の研究課題の64.8%を遂行した
- モデル中で最もバランスが取れた結果: LatchBioのレポートは「Grok 4.6は、偽装された危険なタスクを拒否しつつ通常の生物学研究業務も遂行できる点で、テストされた中で最も優れたモデルだった」と指摘。両方の指標で50%を上回ったのはGrok 4.6のみだったとしている
- BioSecBench-Surveillance: 病原体のゲノムサーベイランス業務を評価する別のベンチマークで、ファイル検査・ツール利用・科学的判断力が求められる。Grok 4.6は平均53.5%の成功率で、Opus 5には及ばないもののGPT-5.6 Solを上回った
- 安全対策の構造: xAIは拒否学習、推論時のフィルタリング、行動制御、デプロイ後のモニタリングを組み合わせた多層的な防御アーキテクチャを採用していると説明
- 改善傾向: xAIによれば、生物分野の能力に関する安全性performanceは、旧バージョンのGrok 4.5・4.3から大きく改善しているという
- 透明性: 詳細な評価手法とモデルごとのスコアはbenchmarks.bioで外部公開され、Grok 4.6のモデルカードおよびxAIの「Frontier Artificial Intelligence Framework」もあわせて参照可能
その後
今回の評価は、Grok Bot・Vertex AI・GitHub CopilotなどへとGrok 4.6の展開を続けるxAIにとって、第三者による裏付けとして引用できるデータとなる。自社発表の安全性主張だけでなく第三者評価を公表することで、xAIはGrokの生物学分野における能力向上に、それに見合った安全対策が伴っていることへの信頼を高めようとしている。フロンティアモデルのバイオセキュリティリスクに対する業界全体の注視が強まる中での公表だ。