Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning-algorithms

reinforcement-learning-algorithms

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning-algorithms, sortiert nach Sternen.

Repos
21
Sterne gesamt
39.604
Sterne im Schnitt
1.886
Anteil
0,00%

Themen, die häufig gemeinsam mit reinforcement-learning-algorithms am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit reinforcement-learning-algorithms getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • PyTorch-Version von Stable Baselines, zuverlässige Implementierungen von Reinforcement-Learning-Algorithmen.

    13.758+29Sterne-Änderung der letzten 7 Tage
  • deep-reinforcement-learning@udacity

    Repository für das Deep Reinforcement Learning Nanodegree-Programm

    5.176+0Sterne-Änderung der letzten 7 Tage
  • DI-engine@opendilab

    OpenDILab Decision AI Engine. Das umfassendste Reinforcement-Learning-Framework.

    3.642+4Sterne-Änderung der letzten 7 Tage
  • PPO-PyTorch@nikhilbarhate99

    Minimale Implementierung von PPO (Proximal Policy Optimization) mit gekappter Zielfunktion in PyTorch

    2.381+6Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste fantastischer modellbasierter RL-Ressourcen (laufend aktualisiert)

    1.393+0Sterne-Änderung der letzten 7 Tage
  • PPO-for-Beginners@ericyangyu

    Eine einfache und gut strukturierte PPO-Implementierung. Basiert auf meiner Medium-Serie: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.269+1Sterne-Änderung der letzten 7 Tage
  • ARPO@RUC-NLPIR

    [ICLR 2026] Agentic Reinforced Policy Optimization (ARPO)

    1.114+4Sterne-Änderung der letzten 7 Tage
  • purejaxrl@luchris429

    Sehr schnelle End-to-End-Jax-RL-Implementierungen

    1.102+2Sterne-Änderung der letzten 7 Tage
  • UI-Venus@inclusionAI

    UI-Venus ist ein nativer UI-Agent, der entwickelt wurde, um präzises GUI-Element-Grounding und effektive Navigation nur mit Screenshots als Eingabe durchzuführen.

    1.037+20Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Ressourcen zu Decision Transformer (wird laufend aktualisiert).

    916+1Sterne-Änderung der letzten 7 Tage
  • course-content-dl@NeuromatchAcademy

    NMA-Kurs für Deep Learning

    812+1Sterne-Änderung der letzten 7 Tage
  • POMDPs.jl@JuliaPOMDP

    MDPs und POMDPs in Julia – Eine Schnittstelle zum Definieren, Lösen und Simulieren vollständig und teilweise beobachtbarer Markov-Entscheidungsprozesse auf diskreten und kontinuierlichen Räumen.

    766+0Sterne-Änderung der letzten 7 Tage
  • stable-baselines3-contrib@Stable-Baselines-Team

    Contrib-Paket für Stable-Baselines3 – Experimenteller Reinforcement-Learning-Code (RL)

    736+4Sterne-Änderung der letzten 7 Tage
  • Dies ist ein Projekt über einen Algorithmus zum autonomen Hindernisausweichen für UAVs mittels Deep Reinforcement Learning.

    730+2Sterne-Änderung der letzten 7 Tage
  • disco_rl@google-deepmind

    Begleitcode zur Nature-Veröffentlichung „Discovering State-of-the-art Reinforcement Algorithms“

    728+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von großartigen Ressourcen zum explorativen Reinforcement Learning (wird laufend aktualisiert)

    723+0Sterne-Änderung der letzten 7 Tage
  • UAV-DDPG@fangvv

    Code zum Paper 'Computation Offloading Optimization for UAV-assisted Mobile Edge Computing: A Deep Deterministic Policy Gradient Approach'.

    722+0Sterne-Änderung der letzten 7 Tage
  • Rofunc@Skylark0924

    🤖 Das vollständige Python-Paket für Robot Learning from Demonstration und Roboter-Manipulation

    720+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Monte-Carlo-Tree-Search-Papern mit Implementierungen.

    715+1Sterne-Änderung der letzten 7 Tage
  • Eine PyTorch-Bibliothek zum Erstellen von Deep-Reinforcement-Learning-Agenten.

    657+1Sterne-Änderung der letzten 7 Tage
  • dLLM-RL@Gen-Verse

    [ICLR 2026] Offizieller Code für TraceRL: Revolutionierung des Post-Trainings für Diffusion LLMs, die Basis der SOTA TraDo-Serie.

    520+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen