Devinの音声通話がライブ音声モデルへ、接続と同時に通話画面に直行
Cognitionは2026年9月16日付のDevinリリースノートで、音声通話をライブ音声モデル上で動作するように刷新しました。これまでのやや順番待ち的な音声モードから、より実際の電話に近い体験へと近づいています。
詳細
- 通話にライブ音声モデルを採用: これまでの音声処理パイプラインに代わり、Devinとの音声通話がライブ音声モデル上で動作するようになり、より自然で低遅延なやり取りを狙う
- 通話開始が高速化: 通話を開始すると、読み込み画面を挟まず、接続中は呼び出し音が鳴りながらそのまま通話コントロール画面に入るようになった
- 入力開始と同時にセッションが起動: ユーザーがコンポーザーに入力し始めた瞬間からセッションの起動が始まるため、メッセージを送信する頃にはDevinがすでに準備を終えていることが多い
- 書式を保持したコピー: メッセージのコピーが、メールやドキュメントに貼り付けた際には書式を保持し、コードエディタに貼り付けた場合は引き続きMarkdownとして貼り付けられるようになった
- 送信ショートカットを設定可能に: 「設定 → Personal → 送信ショートカット」から、EnterキーとCmd/Ctrl+Enterのどちらでメッセージを送信するか選択できるようになった
- セキュリティスキャンが常時実施に: Devin Reviewは、すべてのレビューで必ずセキュリティ上の不具合をチェックするようになり、これまであった任意の「Security scan」トグルは廃止された
- その他のインターフェース改善: スキップされた質問には「回答なし」という汎用表示ではなく実際に何が聞かれたかが表示されるようになり、VMに問題があるセッションはサイドバーに直接「Reboot VM」アクションが表示されるようになったほか、セッションダイアログのデザインもアプリ全体のスタイルに合わせて刷新された
その後
今回のライブ音声化は、Cognitionがすでに提供していたハンズフリー操作向けの音声モードをさらに一歩進め、リクエストと待機を繰り返すやり取りから、より自然な電話に近い体験へと近づけるものです。ユーザーが入力を始めた瞬間からセッションのウォームアップが始まる仕組みと合わせて、開発者の意図表明からDevinが実際に作業を始めるまでのあらゆる段階でレイテンシを削り続けるCognitionの姿勢がうかがえます。詳細はDevinのリリースノート(docs.devin.ai/release-notes/overview)で確認できます。