मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें

opendilab/awesome-RLHF

@opendilab

ह्यूमन फीडबैक के साथ रीइंफोर्समेंट लर्निंग संसाधनों की एक क्यूरेटेड सूची (लगातार अपडेट की जाती है)

स्टार
4,424
फ़ोर्क
260
भाषा
लाइसेंस
Apache-2.0
आख़िरी push
4 माह पहले
deep-learninglarge-language-modelsdeep-reinforcement-learningreinforcement-learningrlhfhuman-feedback

अभी कोई संबंधित intel नहीं

यह रिपॉजिटरी radar द्वारा ट्रैक किए जाने वाले किसी भी स्रोत में अभी तक नहीं आई है। कलेक्टर एक शेड्यूल पर चलता है — जब यह इस रिपॉजिटरी को कवर करे तब वापस देखें।