AMD הודיעה על הסכם לרכישת Taalas, סטארט-אפ שבבים מטורונטו שהוקם ב-2023 בידי מהנדסים לשעבר מ-Tenstorrent ומ-AMD עצמה. תנאי העסקה לא פורסמו. הגישה הייחודית של Taalas היא צריבת משקלי מודל AI ישירות במעגלי השבב, במקום לטעון אותם מזיכרון חיצוני בזמן ריצה — מה שמצמצם דרמטית את הזמן והחשמל הנדרשים להעברת נתונים בין הזיכרון ליחידות החישוב.
השבב הנוכחי של החברה, HC1, מקודד מודל שלם בגודל 8 מיליארד פרמטרים (כמו Llama 3.1 8B) על גבי כ-53 מיליארד טרנזיסטורים, ולפי החברה מגיע לקצב של כ-17,000 טוקנים בשנייה למשתמש בצריכת הספק של כ-200 וואט בלבד. הדור הבא, HC2, מיועד לתמוך במודלים בני 20 מיליארד פרמטרים. תהליך הייצור מתאים רק 2 משכבות המתכת מתוך כ-100 בתהליך הליבה לכל מודל, ומייצר שבב ייעודי במפעלי TSMC בתוך כחודשיים בלבד — קצב מהיר משמעותית מפיתוח שבב מאפס.
מדובר בהתמקדות בביצועי הסקה (inference) בלבד, לא באימון מודלים, ולכן היתרון מוגבל למודלים קבועים וידועים מראש. AMD מתכננת לשלב את הטכנולוגיה במפת הדרכים שלה לצד מאיצי Instinct, פלטפורמת Helios ומעבדי EPYC, במהלך שמשקף את התחרות הגוברת סביב עלות ויעילות של הרצת מודלי AI בקנה מידה.
מקורות: The Register

₿ אהבת את הפוסט?
אפשר לשלוח לי ביטקוין ישירות לכתובת שלי. סרקו את הקוד, או העתיקו את הכתובת:
bc1qsn043qmlv4ejxydeknkfm9u6e93e6tegmq9x85
שימו לב: העברה on-chain כרוכה בעמלת רשת שאינה תלויה בסכום, ולכן סכומים קטנים מאוד אינם כדאיים.