Changelog Update
Gemini 3.5 Transcribe の一般提供(GA): Gemini の音声理解に基づいて、2 つの専用の音声テキスト変換モデルをリリースしました。
- Gemini 3.5 Transcribe(
gemini-3.5-transcribe): 85 以上の言語にわたる発話ベースの言語検出、話者ダイアリゼーション、単語レベルのタイムスタンプ、カスタム語彙バイアス(最大 1,000 語)を備えた、高精度で低遅延の非ストリーミング音声テキスト変換。 - Gemini 3.5 Transcribe Live(
gemini-3.5-transcribe-live): Live API を使用した WebSocket 経由の低レイテンシの双方向ストリーミング音声文字変換。暫定的な音声文字変換イベントと最終的な音声文字変換イベント、スマート音声文字変換モード、複数の音声検出(VAD)戦略をサポートします。
開始するには、音声文字起こしガイド、ライブ文字起こしガイド、Gemini 3.5 Transcribe モデルのページをご覧ください。
- Gemini 3.5 Transcribe(