Changelog Update
Disponibilité générale de Gemini 3.5 Transcribe : deux modèles de reconnaissance vocale dédiés basés sur la compréhension audio de Gemini ont été lancés :
- Gemini 3.5 Transcribe (
gemini-3.5-transcribe) : transcription non continue de haute précision et à faible latence avec détection de la langue basée sur les énoncés dans plus de 85 langues, identification des locuteurs, codes temporels au niveau des mots et pondération du vocabulaire personnalisé (jusqu'à 1 000 termes). - Gemini 3.5 Transcribe Live (
gemini-3.5-transcribe-live) : Transcription de la parole en texte en streaming bidirectionnel à faible latence sur WebSockets à l'aide de l'API Live, avec prise en charge des événements de transcription provisoires et définitifs, du mode de transcription intelligente et de plusieurs stratégies de détection d'activité vocale (VAD).
Pour commencer, consultez le guide de transcription audio, le guide de transcription instantanée et la page du modèle Gemini 3.5 Transcribe.
- Gemini 3.5 Transcribe (