reinforcement-learning-from-human-feedback
Repositórios de código aberto acompanhados marcados com reinforcement-learning-from-human-feedback, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de reinforcement-learning-from-human-feedback no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com reinforcement-learning-from-human-feedback.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Framework de RL agentic fácil de usar, escalável e de alto desempenho baseado em Ray (PPO, DAPO, REINFORCE++, VLM, TIS, vLLM, Ray e Async RL)
★ 9.969+9Variação de estrelas nos últimos 7 dias - #2
Safe RLHF: Alinhamento de valor restrito via Aprendizado por Reforço Seguro a partir de Feedback Humano
★ 1.613+1Variação de estrelas nos últimos 7 dias - #3
Um framework de simulação para RLHF e alternativas. Desenvolva seu método RLHF sem coletar dados humanos.
★ 844-1Variação de estrelas nos últimos 7 dias