Back to feed

Changelog Update

Jun 3, 2026
Google/Gemini APIAPIv2.0-generate
  • השקנו את veo-2.0-generate-001, מודל ליצירת סרטונים מטקסט ומתמונות שזמין לכלל המשתמשים (GA). המודל הזה מסוגל ליצור סרטונים מפורטים עם ניואנסים אומנותיים. מידע נוסף זמין במאמרי העזרה של Veo.
  • השקנו את gemini-2.0-flash-live-001, גרסת טרום-השקה פתוחה של מודל Live API עם חיוב מופעל.

    • ניהול סשנים ואמינות משופרים

      • המשך סשן: הסשנים נשארים פעילים גם אם יש שיבושים זמניים ברשת. ה-API תומך עכשיו באחסון של מצב הסשן בצד השרת (למשך עד 24 שעות) ומספק נקודות אחיזה (session_resumption) להתחברות מחדש ולהמשך מהמקום שבו הפסקתם.
      • סשנים ארוכים יותר באמצעות דחיסת הקשר: אפשר לנהל אינטראקציות ארוכות יותר מעבר למגבלות הזמן הקודמות. אפשר להגדיר דחיסה של חלון ההקשר באמצעות מנגנון של חלון הזזה כדי לנהל באופן אוטומטי את אורך ההקשר, וכך למנוע סיומים פתאומיים בגלל מגבלות ההקשר.
      • התראה על ניתוק חלק: תקבלו הודעה משרת GoAway שמציינת מתי חיבור עומד להיסגר, כדי שתוכלו לטפל בניתוק בצורה חלקה לפני שהוא יסתיים.
    • שליטה רבה יותר בדינמיקה של האינטראקציות

    • זיהוי פעילות קולית (VAD) שניתן להגדרה: אפשר לבחור רמות רגישות או להשבית לחלוטין את זיהוי הפעילות הקולית האוטומטי ולהשתמש באירועי לקוח חדשים (activityStart, activityEnd) לשליטה ידנית בהפעלה.

    • הגדרת טיפול בהפרעות: קובעת אם קלט של משתמש צריך להפריע לתגובה של המודל.

    • כיסוי הפעלה שניתן להגדרה: אתם יכולים לבחור אם ה-API יעבד את כל קלט האודיו והווידאו באופן רציף, או רק יתעד אותו כשהמערכת מזהה שהמשתמש מדבר.

    • רזולוציית מדיה שניתנת להגדרה: אפשר לבחור את הרזולוציה של מדיה להזנה כדי לבצע אופטימיזציה לאיכות או לשימוש באסימונים.

    • פלט ותכונות עשירים יותר

    • אפשרויות מורחבות של קול ושפה: אפשר לבחור מתוך שני קולות חדשים ו-30 שפות חדשות לפלט אודיו. עכשיו אפשר להגדיר את שפת הפלט ב-speechConfig.

    • הזרמת טקסט: קבלת תשובות טקסט בהדרגה בזמן שהן נוצרות, כדי להציג אותן למשתמשים מהר יותר.

    • דוחות על השימוש בטוקנים: תוכלו לקבל תובנות לגבי השימוש באמצעות ספירת טוקנים מפורטת שמופיעה בשדה usageMetadata של הודעות השרת, עם פירוט לפי אופן השימוש ושלבי ההנחיה או התשובה.