Zum Hauptinhalt springen
buildradar
Sign in
Thema · reinforcement-learning

reinforcement-learning

Erfasste Open-Source-Repos mit dem Tag reinforcement-learning, sortiert nach Sternen.

Repos
305
Sterne gesamt
1.292.198
Sterne im Schnitt
4.237
Anteil
0,07%

Themen, die häufig gemeinsam mit reinforcement-learning am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit reinforcement-learning getaggt wurden.

  • agent-apprenticeship@ray-r-ren

    Das lebendige Ökosystem, in dem KI-Agenten Aufgaben durch Workflow-Schleifen erledigen, sich durch iterative Ausführung verbessern, von Mentor-Agenten oder Menschen bewertet werden und abgeschlossene Arbeit in wiederverwendbare Berufserfahrung und Daten umwandeln, um zukünftige Agenten zu verbessern.

    1.334
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    697
  • 人形机器人运动智能论文、开源项目、产业与求职知识库

    502
  • EvoTrace@jinzijian

    Compile real-world Claude Code and Codex trajectories into verified, tradable post-training assets.

    160
  • OraRL@HVision-NKU

    🎬 OraRL — Annotations as Rollouts for efficient, scalable reinforcement learning of unified video MLLMs.

    152
  • Liste von Informatikkursen mit Videovorlesungen.

    83.389+163Sterne-Änderung der letzten 7 Tage
  • unsloth@unslothai

    Lokale UI zum Ausführen und Trainieren von LLMs und Diffusionsmodellen, einschließlich Qwen3.8, Kimi K3, MiniMax-H3, Gemma 4, DeepSeek-V4, FLUX und mehr.

    75.515+337Sterne-Änderung der letzten 7 Tage
  • 🧑‍🏫 60+ Implementierungen/Tutorials von Deep-Learning-Papieren mit Nebennotizen 📝; inkl. transformers (original, xl, switch, feedback, vit, ...), optimizers (adam, adabelief, sophia, ...), gans (cyclegan, stylegan2, ...), 🎮 Reinforcement Learning (ppo, dqn), capsnet, Distillation, ... 🧠

    67.389+21Sterne-Änderung der letzten 7 Tage
  • Lerne es. Baue es. Versende es für andere.

    52.098+1.149Sterne-Änderung der letzten 7 Tage
  • ai-agent-book@bojieli

    《Vertiefung des AI Agent: Designprinzipien und ingenieurtechnische Praxis》(Li Bo Jie)Open-Source-Hauptrepo: Vollständiger Text des Buches, kompilierte PDF-Version und zu den Kapiteln passender Code

    44.381+1.022Sterne-Änderung der letzten 7 Tage
  • ray@ray-project

    Ray ist ein AI-Rechen-Engine. Ray besteht aus einem Core-Distributed-Runtime und einer Reihe von AI-Bibliotheken zur Beschleunigung von ML-Workloads.

    43.688+41Sterne-Änderung der letzten 7 Tage
  • sglang@sgl-project

    SGLang ist ein hochleistungsfähiges Serving‑Framework für große Sprach‑ und multimodale Modelle.

    33.538+791Sterne-Änderung der letzten 7 Tage
  • applied-ml@eugeneyan

    📚 Papers & Tech‑Blogs von Unternehmen, die ihre Arbeit zu Data Science & Machine Learning in der Produktion teilen.

    30.107+10Sterne-Änderung der letzten 7 Tage
  • d2l-en@d2l-ai

    Interaktives Deep-Learning-Buch mit Multi-Framework-Code, Mathematik und Diskussionen. Wird an 500 Universitäten in 70 Ländern eingesetzt, darunter Stanford, MIT, Harvard und Cambridge.

    29.512+30Sterne-Änderung der letzten 7 Tage
  • FinGPT@AI4Finance-Foundation

    FinGPT: Open-Source Financial Large Language Models! Revolutionize 🔥 Wir veröffentlichen das trainierte Modell auf HuggingFace.

    21.201+17Sterne-Änderung der letzten 7 Tage
  • machine-learning-for-trading@stefan-jansen

    Code für Machine Learning for Trading, 3. Auflage — von der Datensammlung bis zur Live-Ausführung.

    20.762+43Sterne-Änderung der letzten 7 Tage
  • ml-agents@Unity-Technologies

    Das Unity Machine Learning Agents Toolkit (ML-Agents) ist ein Open-Source-Projekt, mit dem Spiele und Simulationen als Umgebungen zum Trainieren intelligenten Agenten mittels Deep Reinforcement Learning und Imitation Learning dienen können.

    19.655+2Sterne-Änderung der letzten 7 Tage
  • agent-lightning@microsoft

    Der ultimative Trainer für KI-Agenten.

    17.959+56Sterne-Änderung der letzten 7 Tage
  • Dies ist die Homepage eines neuen Buches mit dem Titel „Mathematical Foundations of Reinforcement Learning“.

    17.663+53Sterne-Änderung der letzten 7 Tage
  • leedl-tutorial@datawhalechina

    Deep Learning-Tutorial von Li Hung-yi (von Prof. Li Hung-yi empfohlen 👍, Apple-Buch 🍎), PDF-Download-Adresse: https://github.com/datawhalechina/leedl-tutorial/releases

    16.747+8Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von Kursen, Büchern, Videovorlesungen und Papers zur künstlichen Intelligenz (KI).

    16.306+44Sterne-Änderung der letzten 7 Tage
  • Python-Implementierung von Reinforcement Learning: An Introduction

    14.758+0Sterne-Änderung der letzten 7 Tage
  • bullet3@bulletphysics

    Bullet Physics SDK: Echtzeit-Kollisionserkennung und Multiphysik-Simulation für VR, Spiele, visuelle Effekte, Robotik, maschinelles Lernen usw.

    14.711+7Sterne-Änderung der letzten 7 Tage
  • easy-rl@datawhalechina

    Chinesisches Tutorial zum Reinforcement Learning (Pilz-Buch 🍄), Online-Leseadresse: https://datawhalechina.github.io/easy-rl/

    14.600+8Sterne-Änderung der letzten 7 Tage
  • PyTorch-Version von Stable Baselines, zuverlässige Implementierungen von Reinforcement-Learning-Algorithmen.

    13.758+21Sterne-Änderung der letzten 7 Tage
  • Tauchen Sie ein in Deep Learning, Reinforcement Learning, Machine Learning, Computer Vision und NLP anhand dieser spannenden Vorlesungen!

    12.939+3Sterne-Änderung der letzten 7 Tage
  • Gymnasium@Farama-Foundation

    Eine Standard-API für Reinforcement-Learning-Umgebungen mit einem Agenten, inklusive gängiger Referenzumgebungen und zugehöriger Hilfsprogramme (ehemals Gym)

    12.451+21Sterne-Änderung der letzten 7 Tage
  • wandb@wandb

    Die AI-Entwicklerplattform. Nutzen Sie Weights & Biases zum Trainieren und Fine-Tuning von Modellen sowie zur Verwaltung von der Experimentierung bis zur Produktion.

    11.249+4Sterne-Änderung der letzten 7 Tage
  • amazon-sagemaker-examples@aws

    Beispiel-Jupyter-Notebooks zur Demonstration des Erstellens, Trainierens und Deployens von Machine-Learning-Modellen mit Amazon SageMaker.

    10.983+2Sterne-Änderung der letzten 7 Tage
  • ART@OpenPipe

    Agent Reinforcement Trainer: Trainieren Sie mehrstufige Agenten für reale Aufgaben mit GRPO. Geben Sie Ihren Agenten ein On-the-Job-Training. Reinforcement Learning für Qwen3.6, GPT-OSS, Llama und mehr!

    10.689+10Sterne-Änderung der letzten 7 Tage
  • cleanrl@vwxyzjn

    Hochwertige Ein-Datei-Implementierung von Deep-Reinforcement-Learning-Algorithmen mit forschungsfreundlichen Funktionen (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.358+19Sterne-Änderung der letzten 7 Tage
  • OpenRLHF@OpenRLHF

    Ein benutzerfreundliches, skalierbares und leistungsstarkes Agentic-RL-Framework basierend auf Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    9.969+9Sterne-Änderung der letzten 7 Tage
  • Einfache Tutorials für Reinforcement Learning, Morvan Python Chinesischer AI-Unterricht

    9.508-2Sterne-Änderung der letzten 7 Tage
  • Sana@NVlabs

    SANA: Effiziente hochauflösende Bildsynthese mit Linear Diffusion Transformer

    8.925+37Sterne-Änderung der letzten 7 Tage
  • machine_learning_examples@lazyprogrammer

    Eine Sammlung von Beispielen und Tutorials zum maschinellen Lernen.

    8.917+1Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen