Qeravio
אירוע בינה קנוני

TRL v1.14.0 הוסיף גרעין Triton לlog-probs ואנטרופיה, והסיר שישה מאמנים ניסיוניים.

גרסה v1.14.0 של TRL הוסרה שישה מאמנים ניסיוניים, בהם GRPOWithReplayBufferTrainer ו-BCOTrainer.

25 בספט׳ 20261 טענות מאומתות1 מקורות1 תצפיות
מה קרה

המקור הרשמי דיווח על עדכון v1.14.0. התכונה trl.losses הוסרה: DPO, KTO ו-GRPO זורמים כעת את log-probs שלהם. ייבוא FusedLinearDPOLoss, FusedLinearKTOLoss, FusedLinearGRPOLoss ו-FusedLinearJSDLoss מ-trl.losses כבר לא עובד. המודול שהוצג בגרסה 1.13 הוסר. בגרסה 1.13 הוכנסה פונקציית chunked_loss של Liger ל-trl.losses כפעולה זמנית, ולא כיעד קבוע. הבעיה שהיא נועדה לפתור היא שמחלקות אלה יישמו מחדש את מתמטיקת האובדן של כל מאמן, כך ש-TRL הכילה שני עותקים של כל נוסחה, ופרקים נדדו. הנדידה זו גרמה לבעיות.

למה זה חשוב

עדכון רשמי חדש מדווח על התפתחות בנוגע לגרסה v1.14.0. חשיבותו תלויה בטווח ובראיות המובאות על ידי המקור.

מה כדאי לבדוק בהמשך

קראו את עדכון המקור הרשמי ולאמת את היקף, הראיות והזמן המפורטים לפני שתפעילו אותו.

ידע מקושר

ישויות שמושפעות מהאירוע

שרשרת ראיות

המקורות שמאחורי האירוע