instruction-following
instruction-following टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
मिलते-जुलते विषय
वे विषय जो अक्सर एक ही रिपॉजिटरी पर instruction-following के साथ आते हैं।
हाल में उभरे
पिछले 90 दिनों में बनी और instruction-following टैग वाली रिपॉजिटरी।
पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।
- #1
Stanford के Alpaca मॉडल को प्रशिक्षित करने और डेटा उत्पन्न करने के लिए कोड और दस्तावेज़।
★ 30,241-5पिछले 7 दिनों में स्टार का बदलाव - #2
मल्टीमॉडल लार्ज लैंग्वेज मॉडल्स पर नवीनतम प्रगति।
★ 17,996+2पिछले 7 दिनों में स्टार का बदलाव - #3
लार्ज फाउंडेशन मॉडल के फाइन-ट्यूनिंग और इन्फरेंस के लिए एक एक्स्टेंसिबल टूलकिट। सभी के लिए लार्ज मॉडल।
★ 8,488+3पिछले 7 दिनों में स्टार का बदलाव - #4
LLM एजेंटों पर अवश्य पढ़ने योग्य पेपर।
★ 3,108-2पिछले 7 दिनों में स्टार का बदलाव - #5
निर्देश-पालन करने वाले भाषा मॉडल के लिए एक स्वचालित मूल्यांकनकर्ता। मानव-सत्यापित, उच्च-गुणवत्ता, सस्ती और तेज़।
★ 2,012-1पिछले 7 दिनों में स्टार का बदलाव - #6★ 1,385-1पिछले 7 दिनों में स्टार का बदलाव
- #7
यह रिपॉजिटरी "A Survey on Knowledge Distillation of Large Language Models" के लिए पेपर एकत्र करती है। हम KD को नॉलेज एलिसिटेशन और डिस्टिलेशन एल्गोरिदम में विभाजित करते हैं, और LLM के स्किल और वर्टिकल डिस्टिलेशन का पता लगाते हैं।
★ 1,306+1पिछले 7 दिनों में स्टार का बदलाव - #8
निर्देश-पालन करने वाले LLMs (ChatGPT, LLaMA, Alpaca) को प्रशिक्षित करने के लिए ओपन-सोर्स डेटासेट का एक संग्रह
★ 1,153-1पिछले 7 दिनों में स्टार का बदलाव - #9
RLHF और विकल्पों के लिए एक सिमुलेशन फ्रेमवर्क। मानव डेटा एकत्र किए बिना अपनी RLHF विधि विकसित करें।
★ 844-1पिछले 7 दिनों में स्टार का बदलाव - #10★ 794+0पिछले 7 दिनों में स्टार का बदलाव
- #11
टेक्स्ट जनरेशन और वर्गीकरण के लिए निर्देश-आधारित प्रॉम्प्ट।
★ 537+0पिछले 7 दिनों में स्टार का बदलाव