Back to feed

Changelog Update

Sep 20, 2026
Google/Gemini APIAPIv3.5
  • ‫Gemini 3.5 Transcribe זמין לכלל המשתמשים (GA): השקנו שני מודלים ייעודיים של המרת דיבור לטקסט שמבוססים על יכולות ההבנה של אודיו ב-Gemini:

    • ‫Gemini 3.5 Transcribe (gemini-3.5-transcribe): תמלול דיבור לטקסט עם רמת דיוק גבוהה, זמן אחזור נמוך, ללא סטרימינג, עם זיהוי שפה שמבוסס על אמירות ביותר מ-85 שפות, זיהוי דוברים, חותמות זמן ברמת המילה והטיה של אוצר מילים מותאם אישית (עד 1,000 מונחים).
    • ‫Gemini 3.5 Transcribe Live (gemini-3.5-transcribe-live): הזרמת דיבור לטקסט דו-כיוונית עם השהיה נמוכה באמצעות WebSockets דרך Live API, עם תמיכה באירועי תמלול זמניים וסופיים, במצב תמלול חכם ובמספר אסטרטגיות של זיהוי פעילות קולית (VAD).

    כדי להתחיל, אפשר לעיין במדריך לתמלול אודיו, במדריך לתמלול בזמן אמת ובדף המודל Gemini 3.5 Transcribe.