AnthropicがClaude Sonnet 5.5を発表。Terminal-Bench 4.0のスコアが10.3%から70.6%へ急上昇し、実務評価ベンチマークGDPval-AAではOpus 5.5にわずか2ポイント差まで迫る。トークン単価は同じながら、タスクあたりの実効コストは最大30%削減。
AnthropicのClaude Sonnet 5.5がGitHub Copilotで一般提供開始。機能追加やバグ修正といった日常的な開発業務向けに設計されており、Sonnet 5と同等のコーディング性能を、大幅に少ない手順・トークン数・ツール呼び出しで実現する。