reinforcement-learning
Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.
- #211★ 943+6Sterne-Änderung der letzten 7 Tage
- #212
UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle
★ 935+17Sterne-Änderung der letzten 7 Tage - #213
🦁 Eine forschungsfreundliche Codebasis für schnelle Experimente mit Multi-Agenten-Reinforcement-Learning in JAX
★ 934+2Sterne-Änderung der letzten 7 Tage - #214
Die Multi-Agent Resource Optimization (MARO) Plattform ist eine Instanz von Reinforcement Learning as a Service (RaaS) für reale Ressourcenoptimierungsprobleme.
★ 923+2Sterne-Änderung der letzten 7 Tage - #215
Zusammenfassung wichtiger Paper und Blogs über Diffusionsmodelle zum Erlernen des Themas. Detaillierte Liste aller veröffentlichten Paper zu Diffusions-Robotik.
★ 920+1Sterne-Änderung der letzten 7 Tage - #216
UniLab: Eine heterogene Architektur für Roboter-RL jenseits von GPU-dominierten Paradigmen
★ 918+23Sterne-Änderung der letzten 7 Tage - #217
PyBullet CartPole- und Quadrotor-Umgebungen mit symbolischer A-priori-Dynamik von CasADi für lernbasiertes Steuern und Reinforcement Learning
★ 917+4Sterne-Änderung der letzten 7 Tage - #218
Eine kuratierte Liste von Ressourcen zu Decision Transformer (wird laufend aktualisiert).
★ 916+0Sterne-Änderung der letzten 7 Tage - #219
👉 CARLA-Ressourcen wie Tutorials, Blogs, Code usw. https://github.com/carla-simulator/carla
★ 915-1Sterne-Änderung der letzten 7 Tage - #220★ 905+1Sterne-Änderung der letzten 7 Tage
- #221
Eine PyTorch-Bibliothek für alles rund um Reinforcement Learning (RL) für Combinatorial Optimization (CO)
★ 900+1Sterne-Änderung der letzten 7 Tage - #222★ 900+0Sterne-Änderung der letzten 7 Tage
- #223
Eine kuratierte Liste fantastischer Ressourcen zum Thema Deep Reinforcement Learning
★ 900+1Sterne-Änderung der letzten 7 Tage - #224
Tien Kung-Lab: Direkter IsaacLab-Workflow für Roboter auf Beinen
★ 883+11Sterne-Änderung der letzten 7 Tage - #225
🕹️ Eine vielseitige Sammlung skalierbarer Reinforcement-Learning-Umgebungen in JAX
★ 861+2Sterne-Änderung der letzten 7 Tage - #226
KI-Tool für das molekulare Design für De-novo-Design, Scaffold-Hopping, R-Gruppen-Ersatz, Linker-Design und Molekülobservierung.
★ 853+3Sterne-Änderung der letzten 7 Tage - #227★ 850+0Sterne-Änderung der letzten 7 Tage
- #228★ 848+3Sterne-Änderung der letzten 7 Tage
- #229★ 841+0Sterne-Änderung der letzten 7 Tage
- #230
🌟 Eine kuratierte Sammlung kostenloser, hochwertiger KI-Tools 🤖, APIs 🔗, Datensätze 📊 und Lernressourcen 📚 zu Machine Learning 🧠, Deep Learning 🧩, generativer KI 🎨, NLP 💬 und Data Science 📈. Entwickelt, um Entwicklern 👩💻, Forschern 🔬 und Kreativen ✨ dabei zu helfen, schneller mit KI zu experimentieren und Anwendungen zu entwickeln ⚡.
★ 840+27Sterne-Änderung der letzten 7 Tage - #231
Python-Implementierungen von Contextual-Bandits-Algorithmen
★ 838+0Sterne-Änderung der letzten 7 Tage - #232
🚀🚀🚀 Eine Sammlung großartiger öffentlicher Projekte zu Large Language Models (LLM), Vision Language Models (VLM), Vision Language Action (VLA), AI Generated Content (AIGC) sowie den zugehörigen Datensätzen und Anwendungen.
★ 815+1Sterne-Änderung der letzten 7 Tage - #233
Dieses Repository dient als Baseline für sicheres bestärkendes Lernen (Safe Reinforcement Learning).
★ 813+0Sterne-Änderung der letzten 7 Tage - #234
Eine kuratierte Liste fantastischer NVIDIA Isaac Gym-Frameworks, -Paper, -Software und -Ressourcen
★ 797+2Sterne-Änderung der letzten 7 Tage - #235
Eine kuratierte Sammlung von Artikeln, technischen Berichten, Frameworks und Tools zur On-Policy-Distillation (OPD) von großen Sprachmodellen
★ 791+31Sterne-Änderung der letzten 7 Tage - #236
MobileGym: Eine verifizierbare und hochparallele Simulationsplattform für die Forschung zu mobilen GUI-Agenten · Im Browser laufender Android-Emulator · Browser-hosted Android Simulator · Verifizierbare Evaluierung · Skalierbares Online-RL-Training
★ 786+10Sterne-Änderung der letzten 7 Tage - #237
BFM_Zero: Ein prompt-steuerbares Verhaltensgrundlagenmodell für die Steuerung humanoider Roboter mittels unüberwachten bestärkenden Lernens
★ 776+15Sterne-Änderung der letzten 7 Tage - #238
MDPs und POMDPs in Julia – Eine Schnittstelle zum Definieren, Lösen und Simulieren vollständig und teilweise beobachtbarer Markov-Entscheidungsprozesse auf diskreten und kontinuierlichen Räumen.
★ 766+1Sterne-Änderung der letzten 7 Tage - #239
Sammlung von Roboterumgebungen basierend auf der PyBullet-Physik-Engine und gymnasium.
★ 765+1Sterne-Änderung der letzten 7 Tage - #240
Multi-Objective-Gymnasium-Umgebungen für Reinforcement Learning
★ 760-1Sterne-Änderung der letzten 7 Tage