GoogleはGemini Audioファミリーに新しいGemini 3.5モデルを追加し、音声コマンドの文字起こしを強化した。このアップデートは、会話中のフィラー語を自動的に除去し、音声だけでテキストを編集できる文字起こし機能を提供する。

新しいGemini 3.5 Transcribeは85以上の言語を認識でき、カスタマイズ可能な辞書で専門用語を保持し、同時に3人の話者を区別して単語レベルのタイムスタンプを付与する。Googleはこのモデルが従来のChirp 3に比べてはるかに低い語彙エラー率と多言語性能を実現していると述べている。

本アプリは本日、macOSのGeminiアプリで英語として、Androidでは選択された国でRambler音声入力機能と共に利用可能で、開発者はGemini API経由でプレビューアクセスを取得できる。ただしGemini 3.5 Proは遅れて6月にリリースされる見込みで、Chromeとの統合は未発表だ。