Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning

reinforcement-learning

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.

305 Repos
  • tdmpc2@nicklashansen

    Code für „TD-MPC2: Scalable, Robust World Models for Continuous Control“

    943+6Sterne-Änderung der letzten 7 Tage
  • UniRL@Tencent-Hunyuan

    UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle

    935+17Sterne-Änderung der letzten 7 Tage
  • Mava@instadeepai

    🦁 Eine forschungsfreundliche Codebasis für schnelle Experimente mit Multi-Agenten-Reinforcement-Learning in JAX

    934+2Sterne-Änderung der letzten 7 Tage
  • maro@microsoft

    Die Multi-Agent Resource Optimization (MARO) Plattform ist eine Instanz von Reinforcement Learning as a Service (RaaS) für reale Ressourcenoptimierungsprobleme.

    923+2Sterne-Änderung der letzten 7 Tage
  • Zusammenfassung wichtiger Paper und Blogs über Diffusionsmodelle zum Erlernen des Themas. Detaillierte Liste aller veröffentlichten Paper zu Diffusions-Robotik.

    920+1Sterne-Änderung der letzten 7 Tage
  • UniLab@Motphys

    UniLab: Eine heterogene Architektur für Roboter-RL jenseits von GPU-dominierten Paradigmen

    918+23Sterne-Änderung der letzten 7 Tage
  • safe-control-gym@learnsyslab

    PyBullet CartPole- und Quadrotor-Umgebungen mit symbolischer A-priori-Dynamik von CasADi für lernbasiertes Steuern und Reinforcement Learning

    917+4Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Ressourcen zu Decision Transformer (wird laufend aktualisiert).

    916+0Sterne-Änderung der letzten 7 Tage
  • 👉 CARLA-Ressourcen wie Tutorials, Blogs, Code usw. https://github.com/carla-simulator/carla

    915-1Sterne-Änderung der letzten 7 Tage
  • hok_env@tencent-ailab

    Honor of Kings AI Open Environment von Tencent

    905+1Sterne-Änderung der letzten 7 Tage
  • rl4co@ai4co

    Eine PyTorch-Bibliothek für alles rund um Reinforcement Learning (RL) für Combinatorial Optimization (CO)

    900+1Sterne-Änderung der letzten 7 Tage
  • iris@eloialonso

    Transformers sind mustereffiziente Weltmodelle. ICLR 2023, unter den besten 5%.

    900+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste fantastischer Ressourcen zum Thema Deep Reinforcement Learning

    900+1Sterne-Änderung der letzten 7 Tage
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab: Direkter IsaacLab-Workflow für Roboter auf Beinen

    883+11Sterne-Änderung der letzten 7 Tage
  • jumanji@instadeepai

    🕹️ Eine vielseitige Sammlung skalierbarer Reinforcement-Learning-Umgebungen in JAX

    861+2Sterne-Änderung der letzten 7 Tage
  • REINVENT4@MolecularAI

    KI-Tool für das molekulare Design für De-novo-Design, Scaffold-Hopping, R-Gruppen-Ersatz, Linker-Design und Molekülobservierung.

    853+3Sterne-Änderung der letzten 7 Tage
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: Humanoid Shadowing and Imitation from Humans

    850+0Sterne-Änderung der letzten 7 Tage
  • JaxMARL@bold-lab-ai

    Multi-Agent Reinforcement Learning mit JAX

    848+3Sterne-Änderung der letzten 7 Tage
  • openrl@OpenRL-Lab

    Einheitliches Reinforcement-Learning-Framework

    841+0Sterne-Änderung der letzten 7 Tage
  • 🌟 Eine kuratierte Sammlung kostenloser, hochwertiger KI-Tools 🤖, APIs 🔗, Datensätze 📊 und Lernressourcen 📚 zu Machine Learning 🧠, Deep Learning 🧩, generativer KI 🎨, NLP 💬 und Data Science 📈. Entwickelt, um Entwicklern 👩‍💻, Forschern 🔬 und Kreativen ✨ dabei zu helfen, schneller mit KI zu experimentieren und Anwendungen zu entwickeln ⚡.

    840+27Sterne-Änderung der letzten 7 Tage
  • contextualbandits@david-cortes

    Python-Implementierungen von Contextual-Bandits-Algorithmen

    838+0Sterne-Änderung der letzten 7 Tage
  • 🚀🚀🚀 Eine Sammlung großartiger öffentlicher Projekte zu Large Language Models (LLM), Vision Language Models (VLM), Vision Language Action (VLA), AI Generated Content (AIGC) sowie den zugehörigen Datensätzen und Anwendungen.

    815+1Sterne-Änderung der letzten 7 Tage
  • Dieses Repository dient als Baseline für sicheres bestärkendes Lernen (Safe Reinforcement Learning).

    813+0Sterne-Änderung der letzten 7 Tage
  • awesome-isaac-gym@robotlearning123

    Eine kuratierte Liste fantastischer NVIDIA Isaac Gym-Frameworks, -Paper, -Software und -Ressourcen

    797+2Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Sammlung von Artikeln, technischen Berichten, Frameworks und Tools zur On-Policy-Distillation (OPD) von großen Sprachmodellen

    791+31Sterne-Änderung der letzten 7 Tage
  • mobilegym@Purewhiter

    MobileGym: Eine verifizierbare und hochparallele Simulationsplattform für die Forschung zu mobilen GUI-Agenten · Im Browser laufender Android-Emulator · Browser-hosted Android Simulator · Verifizierbare Evaluierung · Skalierbares Online-RL-Training

    786+10Sterne-Änderung der letzten 7 Tage
  • BFM-Zero@LeCAR-Lab

    BFM_Zero: Ein prompt-steuerbares Verhaltensgrundlagenmodell für die Steuerung humanoider Roboter mittels unüberwachten bestärkenden Lernens

    776+15Sterne-Änderung der letzten 7 Tage
  • POMDPs.jl@JuliaPOMDP

    MDPs und POMDPs in Julia – Eine Schnittstelle zum Definieren, Lösen und Simulieren vollständig und teilweise beobachtbarer Markov-Entscheidungsprozesse auf diskreten und kontinuierlichen Räumen.

    766+1Sterne-Änderung der letzten 7 Tage
  • panda-gym@qgallouedec

    Sammlung von Roboterumgebungen basierend auf der PyBullet-Physik-Engine und gymnasium.

    765+1Sterne-Änderung der letzten 7 Tage
  • MO-Gymnasium@Farama-Foundation

    Multi-Objective-Gymnasium-Umgebungen für Reinforcement Learning

    760-1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen