Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning

reinforcement-learning

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.

305 Repos
  • DI-drive@opendilab

    Decision-Intelligence-Plattform für die Simulation autonomen Fahrens.

    638+1Sterne-Änderung der letzten 7 Tage
  • mlimpl@vincen-github

    Dieses Repository sammelt Code zur Implementierung gängiger Algorithmen im Bereich des maschinellen Lernens. Die meisten basieren auf Numpy, Pandas oder Torch. Sie können Ihr Verständnis vertiefen oder den Code an Ihre Bedürfnisse anpassen.

    635+0Sterne-Änderung der letzten 7 Tage
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: Open-Source-RL für LLMs und Agentenszenarien

    634+9Sterne-Änderung der letzten 7 Tage
  • ma-gym@koulanurag

    Eine Sammlung von Multi-Agenten-Umgebungen basierend auf OpenAI gym.

    633+0Sterne-Änderung der letzten 7 Tage
  • virtualhome@xavierpuigf

    API zum Ausführen von VirtualHome, einem Multi-Agenten-Haushaltssimulator

    632+2Sterne-Änderung der letzten 7 Tage
  • robohive@vikashplus

    Ein einheitliches Framework für robotergestütztes Lernen

    631+0Sterne-Änderung der letzten 7 Tage
  • Implementierung des walk-these-ways-Projekts auf Unitree Go2

    623+3Sterne-Änderung der letzten 7 Tage
  • VisualThinker-R1-Zero@turningpoint-ai

    Erkunden Sie den multimodalen „Aha-Moment“ am 2B-Modell.

    623+0Sterne-Änderung der letzten 7 Tage
  • DiffPhysDrone@HenryHuYu

    Veröffentlicht in Nature Machine Intelligence! Der erste echte Roboter (Quadrokopter) auf Basis von differenzierbarem Physik-Training.

    614+9Sterne-Änderung der letzten 7 Tage
  • ML-2021-notes@chsiang426

    Kursnotizen zur Vorlesung Machine Learning 2021 Spring von Professor Hung-yi Lee an der National Taiwan University (NTU).

    603+3Sterne-Änderung der letzten 7 Tage
  • recogdrive@xiaomi-research

    [ICLR 2026] ReCogDrive: Ein verstärktes kognitives Framework für End-to-End autonomes Fahren.

    599+4Sterne-Änderung der letzten 7 Tage
  • Relevante Fachartikel zum Thema Reinforcement Learning, einschließlich klassischer Publikationen und aktueller Beiträge von Top-Konferenzen.

    595+0Sterne-Änderung der letzten 7 Tage
  • Relax@redai-studio

    Eine asynchrone Reinforcement-Learning-Engine für skaliertes Omni-Modal Post-Training.

    592+11Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Forschungsarbeiten zu Reinforcement Learning für die Videogenerierung

    591+1Sterne-Änderung der letzten 7 Tage
  • Graph-R1@LHRLAB

    [ICML 2026] Offizielle Ressourcen zu Graph-R1: Ein Framework für agentisches GraphRAG mittels End-to-End Reinforcement Learning.

    591+1Sterne-Änderung der letzten 7 Tage
  • AAAI-2024-Papers@DmitryRyumin

    AAAI 2024 Papers: Eine umfassende Sammlung innovativer Forschungsarbeiten einer der führenden Konferenzen für künstliche Intelligenz, inklusive Code-Implementierungen.

    591+1Sterne-Änderung der letzten 7 Tage
  • crafter@danijar

    Benchmarking des Spektrums von Agentenfähigkeiten.

    586+0Sterne-Änderung der letzten 7 Tage
  • safety-gymnasium@PKU-Alignment

    NeurIPS 2023: Safety-Gymnasium: Ein einheitlicher Benchmark für sicheres Reinforcement Learning.

    580+1Sterne-Änderung der letzten 7 Tage
  • OmniDrones@btx0424
    578+3Sterne-Änderung der letzten 7 Tage
  • TextRL@voidful

    Implementierung von ChatGPT RLHF (Reinforcement Learning with Human Feedback) auf jedem Generierungsmodell in Huggingfaces Transformer (blommz-176B/bloom/gpt/bart/T5/MetaICL)

    564+0Sterne-Änderung der letzten 7 Tage
  • Deep Reinforcement Learning (PPO) im autonomen Fahren (Carla) [von Grund auf]

    563-1Sterne-Änderung der letzten 7 Tage
  • Meta Agents Research Environments ist eine umfassende Plattform zur Evaluierung von KI-Agenten in dynamischen, realistischen Szenarien. Im Gegensatz zu statischen Benchmarks bietet diese Plattform sich entwickelnde Umgebungen, in denen Agenten ihre Strategien bei neuen Informationen anpassen müssen, um reale Herausforderungen abzubilden.

    551+3Sterne-Änderung der letzten 7 Tage
  • awesome-ai@hades217

    Eine kuratierte Liste von Ressourcen zur künstlichen Intelligenz (Kurse, Tools, Apps, Open-Source-Projekte)

    548-1Sterne-Änderung der letzten 7 Tage
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] LLM-Post-Training-Suite – mit ReasonFlux, ReasonFlux-PRM und ReasonFlux-Coder.

    542+0Sterne-Änderung der letzten 7 Tage
  • flybody@TuragaLab

    MuJoCo-Modell eines Fruchtfliegenkörpers und Aufgaben für Reinforcement Learning zur Fortbewegung

    539+2Sterne-Änderung der letzten 7 Tage
  • umi-on-legs@real-stanford

    UMI on Legs: Mobilität für Manipulationsrichtlinien durch manipulationszentrierte Ganzkörper-Controller

    536+3Sterne-Änderung der letzten 7 Tage
  • Kuratierte Liste öffentlich zugänglicher Machine-Learning-Kurse von CalTech, Columbia, Berkeley, MIT und Stanford.

    535+1Sterne-Änderung der letzten 7 Tage
  • morl-baselines@LucasAlegre

    Implementierungen von Multi-Objective Reinforcement Learning Algorithmen.

    533+1Sterne-Änderung der letzten 7 Tage
  • InterMimic@Sirui-Xu

    [CVPR 2025 Highlight] InterMimic: Auf dem Weg zur universellen Ganzkörpersteuerung für physikbasierte Mensch-Objekt-Interaktionen.

    528+1Sterne-Änderung der letzten 7 Tage
  • gym-mtsim@AminHP

    Ein universeller, flexibler und benutzerfreundlicher Simulator sowie eine OpenAI Gym-Handelsumgebung für die MetaTrader 5-Plattform (von OpenAI Gym genehmigt).

    524+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen