Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning-from-human-feedback

reinforcement-learning-from-human-feedback

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning-from-human-feedback, sortiert nach Sternen.

Repos
3
Sterne gesamt
12.426
Sterne im Schnitt
4.142
Anteil
0,00%

Themen, die häufig gemeinsam mit reinforcement-learning-from-human-feedback am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit reinforcement-learning-from-human-feedback getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • OpenRLHF@OpenRLHF

    Ein benutzerfreundliches, skalierbares und leistungsstarkes Agentic-RL-Framework basierend auf Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+9Sterne-Änderung der letzten 7 Tage
  • safe-rlhf@PKU-Alignment

    Safe RLHF: Restriktive Werteausrichtung durch sicheres Reinforcement Learning aus menschlichem Feedback

    1.613+1Sterne-Änderung der letzten 7 Tage
  • alpaca_farm@tatsu-lab

    Ein Simulationsframework für RLHF und Alternativen. Entwickeln Sie Ihre RLHF-Methode ohne das Sammeln von menschlichen Daten.

    844-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen