reinforcement-learning
Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.
- #181
Asynchronous Advantage Actor-Critic (A3C) Algorithmus für Super Mario Bros
★ 1.111-1Sterne-Änderung der letzten 7 Tage - #182★ 1.102+2Sterne-Änderung der letzten 7 Tage
- #183
Modulare Reinforcement-Learning-Bibliothek (implementiert in PyTorch, JAX und NVIDIA Warp) mit Unterstützung für Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground und andere Umgebungen.
★ 1.095+6Sterne-Änderung der letzten 7 Tage - #184
Dies ist eine Bibliothek, die Aufgaben zur Manipulation mit zwei geschickten Händen über Isaac Gym bereitstellt.
★ 1.093+6Sterne-Änderung der letzten 7 Tage - #185★ 1.083+3Sterne-Änderung der letzten 7 Tage
- #186
Ein Index von Algorithmen für Offline Reinforcement Learning (offline-rl)
★ 1.078+3Sterne-Änderung der letzten 7 Tage - #187
Ein Fork von gym-retro mit zusätzlichen Spielen, Emulatoren und unterstützten Plattformen
★ 1.077-4Sterne-Änderung der letzten 7 Tage - #188
Reinforcement-Learning-Umgebungen für die Ampelsteuerung mit SUMO. Kompatibel mit Gymnasium, PettingZoo und gängigen RL-Bibliotheken.
★ 1.074+2Sterne-Änderung der letzten 7 Tage - #189
Bücher / PDFs / EPUBs für verschiedene Programmierbereiche. Lesen, wachsen und genießen 😊😊😊😊
★ 1.065+8Sterne-Änderung der letzten 7 Tage - #190
Wesentlicher Leitfaden, um bei AI/ML/DL/CV auf dem Laufenden zu bleiben
★ 1.063+0Sterne-Änderung der letzten 7 Tage - #191
Der Continuous-Improvement-Stack für Agenten. Unsere Umgebungsdaten und Evaluierungen treiben die Verbesserung und Überwachung von Agenten voran.
★ 1.060+1Sterne-Änderung der letzten 7 Tage - #192
Code-Implementierung von „Learning Efficient Online 3D Bin Packing on Packing Configuration Trees“. Wir schlagen vor, die praktische Anwendbarkeit des Online 3D Bin Packing Problem (BPP) durch das Lernen auf einem hierarchischen Packkonfigurationsbaum zu verbessern, wodurch das Deep-Reinforcement-Learning-Modell (DRL) in der Lage ist, praktisch mit Einschränkungen umzugehen und selbst bei kontinuierlichem Lösungsraum gute Leistungen zu erbringen.
★ 1.047+1Sterne-Änderung der letzten 7 Tage - #193★ 1.042+2Sterne-Änderung der letzten 7 Tage
- #194
Vollständiger Lernpfad für Agent-Ingenieure · Von Grund auf KI-Engineering meistern · 20 Phasen, 503 Lektionen · Vollständige chinesische Übersetzung + begleitende Website + animierte Erklärungsvideos · Leitfaden zur Ausbildung zum KI-Agenten-Ingenieur
★ 1.039+27Sterne-Änderung der letzten 7 Tage - #195★ 1.033+4Sterne-Änderung der letzten 7 Tage
- #196
Quellcode für das Buch „Reinforcement Learning: Theory and Python Implementation“
★ 1.033+2Sterne-Änderung der letzten 7 Tage - #197
Deep RL für die MPC-Steuerung der Fortbewegung von vierbeinigen Robotern
★ 1.022+2Sterne-Änderung der letzten 7 Tage - #198
Durchsatzstarkes, synchrones und asynchrones Reinforcement Learning
★ 1.022+5Sterne-Änderung der letzten 7 Tage - #199
Sammlung klassischer und neuester Forschungsarbeiten sowie Materialien zu Empfehlungssystemen und CTR-Prädiktion
★ 1.016+0Sterne-Änderung der letzten 7 Tage - #200
Eine Benchmark-Umgebung für vollständig kooperative Mensch-KI-Leistung.
★ 1.002+3Sterne-Änderung der letzten 7 Tage - #201
Großartige Game-AI-Materialien zum Multi-Agent Reinforcement Learning
★ 979+2Sterne-Änderung der letzten 7 Tage - #202
Ein leistungsstarkes 3B-Parameter-LLM-basiertes Reinforcement-Learning-Audiobearbeitungsmodell, das sich hervorragend für die Bearbeitung von Emotionen, Sprechstil und Paralinguistik eignet und robuste Zero-Shot-Text-to-Speech bietet
★ 972+3Sterne-Änderung der letzten 7 Tage - #203
Eine Sammlung von Robotik-Simulationsumgebungen für Reinforcement Learning
★ 963+2Sterne-Änderung der letzten 7 Tage - #204
Machine Learning Open Source University
★ 955+1Sterne-Änderung der letzten 7 Tage - #205
Liste des molekularen und materiellen Designs unter Verwendung von Generative AI und Deep Learning
★ 952+1Sterne-Änderung der letzten 7 Tage - #206
Optimierung von Reinforcement Learning mit RLOps. State-of-the-Art-RL-Algorithmen und -Tools mit 10-mal schnellerem Training durch evolutionäre Hyperparameter-Optimierung.
★ 950+2Sterne-Änderung der letzten 7 Tage - #207★ 949+56Sterne-Änderung der letzten 7 Tage
- #208★ 947+1Sterne-Änderung der letzten 7 Tage
- #209
PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama
★ 946—Sterne-Änderung der letzten 7 Tage - #210
Python-Bibliothek für Reinforcement Learning.
★ 944+0Sterne-Änderung der letzten 7 Tage