Back to feed

Changelog Update

Sep 25, 2026
Google/Gemini APIAPIv3.5
  • Gemini 3.5 Transcribe tersedia secara umum (GA): Merilis dua model speech-to-text khusus berdasarkan pemahaman audio Gemini:

    • Gemini 3.5 Transcribe (gemini-3.5-transcribe): Speech-to-text non-streaming dengan akurasi tinggi dan latensi rendah dengan deteksi bahasa berbasis ucapan di lebih dari 85 bahasa, diarisasi speaker, stempel waktu tingkat kata, dan penyesuaian kosakata kustom (hingga 1.000 istilah).
    • Gemini 3.5 Transcribe Live (gemini-3.5-transcribe-live): Streaming dua arah ucapan-ke-teks dengan latensi rendah melalui WebSockets menggunakan Live API, yang mendukung peristiwa transkripsi sementara dan akhir, Mode transkripsi smart, dan beberapa strategi Voice Activity Detection (VAD).

    Untuk memulai, lihat Panduan transkripsi audio, Panduan transkripsi instan, dan Halaman model Gemini 3.5 Transcribe.