मुख्य सामग्री पर जाएँ
buildradar
साइन इन करें
विषय · safe-reinforcement-learning-from-human-feedback

safe-reinforcement-learning-from-human-feedback

safe-reinforcement-learning-from-human-feedback टैग वाली ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।

रिपॉजिटरी
1
कुल स्टार
1,613
औसत स्टार
1,613
हिस्सा
0.00%

वे विषय जो अक्सर एक ही रिपॉजिटरी पर safe-reinforcement-learning-from-human-feedback के साथ आते हैं।

हाल में उभरे

पिछले 90 दिनों में बनी और safe-reinforcement-learning-from-human-feedback टैग वाली रिपॉजिटरी।

पिछले 90 दिनों में इस विषय के टैग वाली कोई नई रिपॉजिटरी नहीं आई।

  • safe-rlhf@PKU-Alignment

    Safe RLHF: Safe Reinforcement Learning from Human Feedback के माध्यम से प्रतिबंधित वैल्यू एलाइनमेंट

    1,613+0पिछले 7 दिनों में स्टार का बदलाव
← विषयों पर वापस