Back to feed

Changelog Update

Sep 17, 2026
Google/Gemini APIAPIv3.5
  • نسخه ۳.۵ نرم‌افزار جمینی ترنسکریپت (Gemini Transcribe) به‌طور عمومی در دسترس است (GA) : دو مدل اختصاصی تبدیل گفتار به متن بر اساس درک صوتی جمینی منتشر شد:

    • Gemini 3.5 Transcribe ( gemini-3.5-transcribe ): تبدیل گفتار به متن غیر استریمینگ با دقت بالا، تأخیر کم و تشخیص زبان مبتنی بر گفتار در بیش از ۸۵ زبان، قابلیت diarization گوینده، مهر زمانی در سطح کلمه و بایاس واژگان سفارشی (تا ۱۰۰۰ اصطلاح).
    • Gemini 3.5 Transcribe Live ( gemini-3.5-transcribe-live ): استریمینگ دوطرفه و کم‌تاخیر گفتار به متن از طریق WebSockets با استفاده از Live API، پشتیبانی از رویدادهای رونویسی موقت و نهایی، حالت رونویسی هوشمند و استراتژی‌های تشخیص فعالیت صوتی چندگانه (VAD).

    برای شروع، به راهنمای رونویسی صوتی ، راهنمای رونویسی زنده و صفحه مدل رونویسی Gemini 3.5 مراجعه کنید.