החברה הסינית דיפסיק פרסמה השבוע את V4.1 Flash, מודל שפה חדש שמבוסס על ארכיטקטורה א-סימטרית ראשונה מסוגה בשם Causal Encoder-Decoder (CED). הרעיון המרכזי: להפריד בין עיבוד הקלט לבין ייצור הפלט, כך שהזיכרון הדרוש לשמירת הקשר ארוך (KV Cache) יורד לכרבע בהשוואה לדגם הקודם. עבור חברות שמריצות מודלים בהיקף גדול, זה לא רק שיפור טכני אלא הוזלה ממשית של עלויות התפעול.
מבחינת מבנה, מדובר במודל MoE (תמהיל מומחים) עם גב של 552 מיליארד פרמטרים, שמפעיל בפועל כ-8 מיליארד פרמטרים בעיבוד הקלט ו-16 מיליארד בייצור הפלט. חלון ההקשר מגיע למעל מיליון טוקנים. מחיר השימוש משתנה לפי שעות היממה: בשעות שפל דיפסיק גובה 0.003 דולר למיליון טוקני קלט שנשמרו במטמון, 0.15 דולר למיליון כשאין פגיעה במטמון, ו-0.60 דולר למיליון טוקני פלט — ובשעות עומס המחירים כפולים.
לפי מדד Artificial Analysis Intelligence Index, הדגם מקבל ציון 40 ומוביל בין מודלים בקוד פתוח במבחנים כמו Terminal-Bench 2.1 ו-DeepSWE. חברת VentureBeat מדווחת שבחלק ממבחני הקידוד התוצאות עוקפות את GPT-5.6 Sol של OpenAI ואת Claude Opus 5 של אנתרופיק — חשוב לזכור שאלו תוצאות ממבחני צד שלישי ולא הכרזה עצמאית, אך עדיין מדובר בהשוואה סלקטיבית שכדאי להתייחס אליה בזהירות.
מקורות: VentureBeat

₿ אהבת את הפוסט?
אפשר לשלוח לי ביטקוין ישירות לכתובת שלי. סרקו את הקוד, או העתיקו את הכתובת:
bc1qsn043qmlv4ejxydeknkfm9u6e93e6tegmq9x85
שימו לב: העברה on-chain כרוכה בעמלת רשת שאינה תלויה בסכום, ולכן סכומים קטנים מאוד אינם כדאיים.