המקור הרשמי דיווח על שחרור v0.16.0. זהו שחרור משמעותי. הגרסה 0.16.0 מביאה שדרוגים גדולים לשירות עם עומס גבוה, דקודינג מהיר יותר, ודגמי Qwen מדור אחרון. הנקודות הבולטות כוללות מנוע יותר מסוגל עם חיתוך רציף תומך בחתיכות מראש, תשומת לב מדורגת, שיחות מרובות סיבובים, עומסי עבודה מעורבים, ותזמון טוקנים חכם יותר. זה משפר את היקף העיבוד תוך שימוש טוב יותר בזיכרון ה-GPU. בנוסף, הוספו תכונות לדקודינג מהיר יותר עם דגמים משערים, היפוך n-gram, היפוך עצמי של MTP, ודפוסי בלוקים של DFlash2 ו-DSpark.
אירוע בינה קנוני
המנוע החדש כולל עיבוד רציף, פירוק מהיר יותר ותמיכה ב-Qwen2.5-VL.
גרסה 0.16.0 מביאה תמיכה ב-AMDGPU ו-WebGPU. היא מוסיפה מודלים Granite ומשפרת עיבוד של קלטי חזות רב-תמונות.
23 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
עדכון רשמי חדש מדווח על התפתחות הקשורה לגרסה v0.16.0. חשיבותה תלויה בטווח ובראיות שמציג המקור.
קראו את עדכון המקור הרשמי ולאמת את היקף, הראיות והזמן המפורטים לפני שתפעילו אותו.
ידע מקושר
ישויות שמושפעות מהאירוע
שרשרת ראיות
המקורות שמאחורי האירוע
הצגה מערכתית
פתיחת הכתבה