Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning

reinforcement-learning

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.

304 Repos
  • Asynchronous Advantage Actor-Critic (A3C) Algorithmus für Super Mario Bros

    1.111-1Sterne-Änderung der letzten 7 Tage
  • purejaxrl@luchris429

    Sehr schnelle End-to-End-Jax-RL-Implementierungen

    1.102+2Sterne-Änderung der letzten 7 Tage
  • skrl@Toni-SM

    Modulare Reinforcement-Learning-Bibliothek (implementiert in PyTorch, JAX und NVIDIA Warp) mit Unterstützung für Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground und andere Umgebungen.

    1.095+6Sterne-Änderung der letzten 7 Tage
  • DexterousHands@PKU-MARL

    Dies ist eine Bibliothek, die Aufgaben zur Manipulation mit zwei geschickten Händen über Isaac Gym bereitstellt.

    1.093+6Sterne-Änderung der letzten 7 Tage
  • xuance@agi-brain

    XuanCe: Eine umfassende und einheitliche Deep-Reinforcement-Learning-Bibliothek

    1.083+3Sterne-Änderung der letzten 7 Tage
  • Ein Index von Algorithmen für Offline Reinforcement Learning (offline-rl)

    1.078+3Sterne-Änderung der letzten 7 Tage
  • Stable-Retro@Farama-Foundation

    Ein Fork von gym-retro mit zusätzlichen Spielen, Emulatoren und unterstützten Plattformen

    1.077-4Sterne-Änderung der letzten 7 Tage
  • sumo-rl@LucasAlegre

    Reinforcement-Learning-Umgebungen für die Ampelsteuerung mit SUMO. Kompatibel mit Gymnasium, PettingZoo und gängigen RL-Bibliotheken.

    1.074+2Sterne-Änderung der letzten 7 Tage
  • Books@Rishabh-creator601

    Bücher / PDFs / EPUBs für verschiedene Programmierbereiche. Lesen, wachsen und genießen 😊😊😊😊

    1.065+8Sterne-Änderung der letzten 7 Tage
  • Wesentlicher Leitfaden, um bei AI/ML/DL/CV auf dem Laufenden zu bleiben

    1.063+0Sterne-Änderung der letzten 7 Tage
  • judgeval@JudgmentLabs

    Der Continuous-Improvement-Stack für Agenten. Unsere Umgebungsdaten und Evaluierungen treiben die Verbesserung und Überwachung von Agenten voran.

    1.060+1Sterne-Änderung der letzten 7 Tage
  • Online-3D-BPP-PCT@alexfrom0815

    Code-Implementierung von „Learning Efficient Online 3D Bin Packing on Packing Configuration Trees“. Wir schlagen vor, die praktische Anwendbarkeit des Online 3D Bin Packing Problem (BPP) durch das Lernen auf einem hierarchischen Packkonfigurationsbaum zu verbessern, wodurch das Deep-Reinforcement-Learning-Modell (DRL) in der Lage ist, praktisch mit Einschränkungen umzugehen und selbst bei kontinuierlichem Lösungsraum gute Leistungen zu erbringen.

    1.047+1Sterne-Änderung der letzten 7 Tage
  • GPTSwarm@metauto-ai

    🐝 Die ersten selbstverbessernden Agenten mit RL / Prompt-Optimierung

    1.042+2Sterne-Änderung der letzten 7 Tage
  • Vollständiger Lernpfad für Agent-Ingenieure · Von Grund auf KI-Engineering meistern · 20 Phasen, 503 Lektionen · Vollständige chinesische Übersetzung + begleitende Website + animierte Erklärungsvideos · Leitfaden zur Ausbildung zum KI-Agenten-Ingenieur

    1.039+27Sterne-Änderung der letzten 7 Tage
  • rl-tools@rl-tools

    Die schnellste Deep-Reinforcement-Learning-Bibliothek

    1.033+4Sterne-Änderung der letzten 7 Tage
  • rl-book@ZhiqingXiao

    Quellcode für das Buch „Reinforcement Learning: Theory and Python Implementation“

    1.033+2Sterne-Änderung der letzten 7 Tage
  • rl-mpc-locomotion@silvery107

    Deep RL für die MPC-Steuerung der Fortbewegung von vierbeinigen Robotern

    1.022+2Sterne-Änderung der letzten 7 Tage
  • sample-factory@alex-petrenko

    Durchsatzstarkes, synchrones und asynchrones Reinforcement Learning

    1.022+5Sterne-Änderung der letzten 7 Tage
  • DeepRec@imsheridan

    Sammlung klassischer und neuester Forschungsarbeiten sowie Materialien zu Empfehlungssystemen und CTR-Prädiktion

    1.016+0Sterne-Änderung der letzten 7 Tage
  • overcooked_ai@HumanCompatibleAI

    Eine Benchmark-Umgebung für vollständig kooperative Mensch-KI-Leistung.

    1.002+3Sterne-Änderung der letzten 7 Tage
  • Großartige Game-AI-Materialien zum Multi-Agent Reinforcement Learning

    979+2Sterne-Änderung der letzten 7 Tage
  • Step-Audio-EditX@stepfun-ai

    Ein leistungsstarkes 3B-Parameter-LLM-basiertes Reinforcement-Learning-Audiobearbeitungsmodell, das sich hervorragend für die Bearbeitung von Emotionen, Sprechstil und Paralinguistik eignet und robuste Zero-Shot-Text-to-Speech bietet

    972+3Sterne-Änderung der letzten 7 Tage
  • Gymnasium-Robotics@Farama-Foundation

    Eine Sammlung von Robotik-Simulationsumgebungen für Reinforcement Learning

    963+2Sterne-Änderung der letzten 7 Tage
  • Machine Learning Open Source University

    955+1Sterne-Änderung der letzten 7 Tage
  • Liste des molekularen und materiellen Designs unter Verwendung von Generative AI und Deep Learning

    952+1Sterne-Änderung der letzten 7 Tage
  • AgileRL@AgileRL

    Optimierung von Reinforcement Learning mit RLOps. State-of-the-Art-RL-Algorithmen und -Tools mit 10-mal schnellerem Training durch evolutionäre Hyperparameter-Optimierung.

    950+2Sterne-Änderung der letzten 7 Tage
  • verl-omni@verl-project

    Multimodales RL-Trainingsframework für Diffusions- und Omni-Modelle

    949+56Sterne-Änderung der letzten 7 Tage
  • GibsonEnv@StanfordVL

    Gibson Environments: Real-World-Wahrnehmung für embodied Agents

    947+1Sterne-Änderung der letzten 7 Tage
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    946Sterne-Änderung der letzten 7 Tage
  • mushroom-rl@MushroomRL

    Python-Bibliothek für Reinforcement Learning.

    944+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen