המקור הרשמי דיווח על עדכון: b10704: CUDA: שימוש במסלול המהיר mm_ids_helper לכל n_expert_used. המסלול האופטימלי מחלק שורות וורפ לפי טוקן, ודורש שwarp_size % n_expert_used יהיה 0, עם יוצא דופן אחד קבוע של 6 עד 8. כל ספירה אחרת חוזרת למסלול הכללי, שבודק טוקנים אחד אחד עם הפחתת וורפ לכל טוקן, בכל אחד מהקטעים של n_expert. קבוצה של שורות מחולקת את הוורפ, והגוף של הלולאה מגן על השורות המלאות עם iex, ומכליל לכוח של שתיים.
אירוע בינה קנוני
אופטימיזציה CUDA מקצרת עיבוד הפקודות ל-2600 בשנייה.
אופטימיזציה חדשה תומכת ב-10 מומחים ומאיצה עיבוד בקשות ל-2600 ת/ש על RTX PRO 6000.
31 באוג׳ 20261 טענות מאומתות1 מקורות1 תצפיות
עדכון רשמי מדווח על התפתחות בנוגע ל-b10704: CUDA: להשתמש בדרך המהירה של mm_ids_helper לכל n_expert_used. משמעות הפיתוח תלויה בטווח והראיות שצוינו על ידי המקור.
קראו את עדכון המקור הרשמי ווודאו את היקפו, הראיות והזמן לפני שתפעילו אותו.
ידע מקושר
ישויות שמושפעות מהאירוע
שרשרת ראיות
המקורות שמאחורי האירוע
הצגה מערכתית
פתיחת הכתבה