मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

tatsu-lab/alpaca_farm

@tatsu-lab

RLHF और विकल्पों के लिए एक सिमुलेशन फ्रेमवर्क। मानव डेटा एकत्र किए बिना अपनी RLHF विधि विकसित करें।

स्टार
844
फ़ोर्क
66
भाषा
Python
लाइसेंस
Apache-2.0
आख़िरी push
2 वर्ष पहले
Pythondeep-learninglarge-language-modelsnatural-language-processinginstruction-followingreinforcement-learning-from-human-feedback

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।