לא נמצא חיבור אינטרנט
פיקוד העורף (יש להיכנס למרחב המוגן)
טוען...

טוען נתונים...

ניוז קליק

Reinforcement Learning With Metacognitive Feedback Is Offered As A Next-Gen Way To Shape AI LLMs

19/07/2026-10:15 19/07/2026-10:20 מחשבים וטכנולוגיה Forbes Innovation דיווח

Reinforcement Learning With Metacognitive Feedback Is Offered As A Next-Gen Way To Shape AI LLMs
New method to tune LLMs is RLMF, reinforcement learning with metacognitive feedback. It is akin to RLAIF and somewhat like RLHF. An AI Insider analysi
סיכום מאמר
"פיתוח תכשיטי AI: שיטה חדשנית לגיבוש LLMs בעזרת למידת רפלקסיה עם פידבק מטא-קוגניטיבי חברות טכנולוגיה חדשותיות מציגות שיטה חדשה לגיבוש LLMs, המשלבת למידת רפלקסיה עם פידבק מטא-קוגניטיבי. שיטה זו, ידועה כ-RLMF, נחשבת לדרך חדשה לפיתוח תכשיטי AI, ומציעה תכשיטים חדשים ל-LMMS. השיטה, המבוססת על רעיונות של RLAIF ו-RLHF, מאפשרת ל-LMMS ללמוד ולשפר את עצמן, ולהפוך ליותר חכמות ומודעות. בעזרת RLMF, LLMs יכולות ללמוד להכיר את חולשותיהן ולשפר את עצמן, ולהפוך ליותר חכמות ומודעות. שיטה זו עשויה לשנות את דרך פיתוח ה-LMMS, ולהביא לשיפורים משמעותיים באיכות ה-LMMS.
תוכן זה נוצר על ידי בינה מלאכותית.

עוד מאמרים בנושא