Back to feed

Changelog Update

Jul 10, 2026
Google/Gemini APIAPIv2.0-generate
  • השקנו את veo-2.0-generate-001, מודל ליצירת סרטונים מטקסט ומתמונות שזמין לכלל המשתמשים (GA). המודל הזה יכול ליצור סרטונים מפורטים עם ניואנסים אומנותיים. מידע נוסף זמין במאמרי העזרה של Veo.
  • השקנו את gemini-2.0-flash-live-001, גרסת טרום-השקה פתוחה של מודל Live API עם חיוב מופעל.

    • ניהול סשנים ואמינות משופרים

      • המשך סשן: הסשנים נשארים פעילים גם אם יש שיבושים זמניים ברשת. ה-API תומך עכשיו באחסון של מצב הסשן בצד השרת (למשך עד 24 שעות) ומספק נקודות אחיזה (session_resumption) להתחברות מחדש ולהמשך מהמקום שבו הפסקתם.
      • סשנים ארוכים יותר באמצעות דחיסת הקשר: אפשר לנהל אינטראקציות ממושכות יותר מעבר למגבלות הזמן הקודמות. הגדרת דחיסה של חלון ההקשר באמצעות מנגנון חלון הזזה לניהול אוטומטי של אורך ההקשר, כדי למנוע סיומים פתאומיים בגלל מגבלות ההקשר.
      • התראה על ניתוק חלק: תקבלו הודעה משרת GoAway שמציינת מתי חיבור עומד להיסגר, כדי שתוכלו לטפל בניתוק בצורה חלקה לפני שהוא יסתיים.
    • שליטה רבה יותר בדינמיקה של האינטראקציות

    • זיהוי פעילות קולית (VAD) שניתן להגדרה: אפשר לבחור רמות רגישות או להשבית לחלוטין את זיהוי הפעילות הקולית האוטומטי ולהשתמש באירועי לקוח חדשים (activityStart, activityEnd) לשליטה ידנית בהפעלה.

    • הגדרת טיפול בהפרעות: קובעת אם קלט של משתמש צריך להפריע לתגובה של המודל.

    • כיסוי הפעלה שניתן להגדרה: אתם יכולים לבחור אם ה-API יעבד את כל קלט האודיו והווידאו באופן רציף, או רק יתעד אותו כשהמערכת מזהה שהמשתמש מדבר.

    • רזולוציית מדיה שניתנת להגדרה: אפשר לבחור את הרזולוציה של מדיה להזנה כדי לבצע אופטימיזציה לאיכות או לשימוש באסימונים.

    • פלט ותכונות עשירים יותר

    • אפשרויות מורחבות של קול ושפה: אפשר לבחור מתוך שני קולות חדשים ו-30 שפות חדשות לפלט אודיו. עכשיו אפשר להגדיר את שפת הפלט ב-speechConfig.

    • הזרמת טקסט: קבלת תשובות טקסט בהדרגה בזמן שהן נוצרות, כדי להציג אותן למשתמשים מהר יותר.

    • דוחות על השימוש בטוקנים: תוכלו לקבל תובנות לגבי השימוש באמצעות ספירת טוקנים מפורטת שמופיעה בשדה usageMetadata של הודעות השרת, עם פירוט לפי אופן השימוש ושלבי ההנחיה או התשובה.