Qeravio
אירוע בינה קנוני

CUDA מאפשר כעת זרימות מקבילות לכל חלקה עבור מספר GPUs.

אופטימיזציה CUDA עובדת כעת על פי חלוקה בהגדרות מרובות GPU, ומפיצה בעיות אופטימיזציה גרפיות קודמות.

4 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
מה קרה

מקור רשמי דיווח על עדכון: b10782. CUDA: אפשר זרמים מקבילים לכל חלוקה ברבים של GPU. CUDA: אפשר זרמים מקבילים לכל חלוקה ברבים של GPU (#28198). CUDA: אפשר אופטימיזציה של CUDA לכל חלוקה ברבים של GPU. המשמר הקודם גרם לרב-GPU לדלג על אופטימיזציה של הגרף. הגרף כבר מחולק לפי מכשיר, והאופטימיזציה לא מתבצעת על כל המודל אלא פעם אחת לכל חלוקה, ולכן צריכה להיות מותרת. עם זאת, האירוע ggml_cuda_concurrent_event שייך ל-GPU שהיה פעיל בעת יצירתו. אם ההליך התבצע בעת ש-GPU 0 היה פעיל, הוא יישאר כך, ובמהלך יצירת האירוע עבור ה-GPU השני יתקבל על ידי GPU 0.

למה זה חשוב

העדכון הרשמי מדווח על פיתוח של b10782: CUDA: אפשרות להריץ זרמים מקבילים לכל חצייה במערכות GPU מרובות. חשיבותו מעשית תלויה בטווח והראיות שצוינו על ידי המקור.

מה כדאי לבדוק בהמשך

קראו את עדכון המקור הרשמי ווודאו את היקפו, הראיות והזמן לפני שתפעילו אותו.

ידע מקושר

ישויות שמושפעות מהאירוע

שרשרת ראיות

המקורות שמאחורי האירוע