Changelog Update
نسخه ۳.۵ نرمافزار جمینی ترنسکریپت (Gemini Transcribe) بهطور عمومی در دسترس است (GA) : دو مدل اختصاصی تبدیل گفتار به متن بر اساس درک صوتی جمینی منتشر شد:
- Gemini 3.5 Transcribe (
gemini-3.5-transcribe): تبدیل گفتار به متن غیر استریمینگ با دقت بالا، تأخیر کم و تشخیص زبان مبتنی بر گفتار در بیش از ۸۵ زبان، قابلیت diarization گوینده، مهر زمانی در سطح کلمه و بایاس واژگان سفارشی (تا ۱۰۰۰ اصطلاح). - Gemini 3.5 Transcribe Live (
gemini-3.5-transcribe-live): استریمینگ دوطرفه و کمتاخیر گفتار به متن از طریق WebSockets با استفاده از Live API، پشتیبانی از رویدادهای رونویسی موقت و نهایی، حالت رونویسی هوشمند و استراتژیهای تشخیص فعالیت صوتی چندگانه (VAD).
برای شروع، به راهنمای رونویسی صوتی ، راهنمای رونویسی زنده و صفحه مدل رونویسی Gemini 3.5 مراجعه کنید.
- Gemini 3.5 Transcribe (