גוגל השיקה ב-1 בספטמבר יכולת חדשה בשם "הבנת וידאו אגנטית" ב-Gemini, שמאפשרת למודל לבחור בעצמו אילו קטעי וידאו לבדוק ובאיזה אופן – במקום לעבד כל סרטון בקצב פריימים קבוע כפי שנעשה עד כה. המודל סורק, בודק ומחפש קטעים רלוונטיים בווידאו, בשמע ובתמלול, ומחליט כמה "תשומת לב" להשקיע בכל קטע לפי הצורך.
לפי גוגל, הגישה החדשה מפחיתה את צריכת הטוקנים עד 88% ואת עלות הניתוח עד 66%, תוך שיפור דיוק של עד 7% – עם ההשפעה הבולטת ביותר על סרטונים ארוכים, מהדרכות בנות 10 דקות ועד הרצאות ואירועים באורך של כמה שעות. היכולת תומכת גם באיתור רגעים ספציפיים בשבריר שנייה, חיפוש בתוך וידאו ארוך, זיהוי חריגות וספירת אובייקטים ופעולות בדיוק גבוה יותר.
הפיצ'ר זמין כרגע כתצוגה מקדימה (preview) דרך ה-API ב-Google AI Studio ובפלטפורמת הסוכנים הארגונית, למודלים Gemini 3.7 Flash, 3.6 Flash ו-3.5 Flash-Lite, ללא תוספת תשלום מעבר לתמחור הרגיל. גוגל מתכננת להרחיב אותו בהמשך לאפליקציית Gemini ולתכונת "Ask YouTube" בעמודי הצפייה של יוטיוב.
מקורות: Google Blog

₿ אהבת את הפוסט?
אפשר לשלוח לי ביטקוין ישירות לכתובת שלי. סרקו את הקוד, או העתיקו את הכתובת:
bc1qsn043qmlv4ejxydeknkfm9u6e93e6tegmq9x85
שימו לב: העברה on-chain כרוכה בעמלת רשת שאינה תלויה בסכום, ולכן סכומים קטנים מאוד אינם כדאיים.