Pular para o conteúdo principal
buildradar
Sign in
Tópico · reinforcement-learning-from-human-feedback

reinforcement-learning-from-human-feedback

Repositórios de código aberto acompanhados marcados com reinforcement-learning-from-human-feedback, ordenados por estrelas.

Repositórios
3
Total de estrelas
12.426
Média de estrelas
4.142
Participação
0,00%

Tópicos que aparecem com frequência ao lado de reinforcement-learning-from-human-feedback no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com reinforcement-learning-from-human-feedback.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • OpenRLHF@OpenRLHF

    Framework de RL agentic fácil de usar, escalável e de alto desempenho baseado em Ray (PPO, DAPO, REINFORCE++, VLM, TIS, vLLM, Ray e Async RL)

    9.969+9Variação de estrelas nos últimos 7 dias
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Alinhamento de valor restrito via Aprendizado por Reforço Seguro a partir de Feedback Humano

    1.613+1Variação de estrelas nos últimos 7 dias
  • alpaca_farm@tatsu-lab

    Um framework de simulação para RLHF e alternativas. Desenvolva seu método RLHF sem coletar dados humanos.

    844-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos