Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning

reinforcement-learning

Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.

305 repositori
  • DI-drive@opendilab

    Platform Kecerdasan Keputusan untuk simulasi Autonomous Driving.

    638+0Perubahan bintang dalam 7 hari terakhir
  • mlimpl@vincen-github

    Repositori ini mengumpulkan beberapa kode yang merangkum algoritma yang umum digunakan di bidang machine learning. Sebagian besar didasarkan pada Numpy, Pandas, atau Torch. Anda dapat memperdalam pemahaman tentang model dan algoritma terkait atau memodifikasinya untuk mendapatkan kode kustom Anda sendiri dengan merujuk pada repositori ini.

    635+0Perubahan bintang dalam 7 hari terakhir
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: RL Open-Source untuk LLM dan Skenario Agen

    634+11Perubahan bintang dalam 7 hari terakhir
  • ma-gym@koulanurag

    Kumpulan lingkungan multi-agen berdasarkan OpenAI gym.

    633+0Perubahan bintang dalam 7 hari terakhir
  • virtualhome@xavierpuigf

    API untuk menjalankan VirtualHome, Simulator Rumah Tangga Multi-Agen

    632+2Perubahan bintang dalam 7 hari terakhir
  • robohive@vikashplus

    Kerangka kerja terpadu untuk pembelajaran robot

    631+0Perubahan bintang dalam 7 hari terakhir
  • VisualThinker-R1-Zero@turningpoint-ai

    Jelajahi “Aha Moment” Multimodal pada Model 2B

    623+0Perubahan bintang dalam 7 hari terakhir
  • Deploy proyek walk-these-ways pada Unitree Go2

    623+3Perubahan bintang dalam 7 hari terakhir
  • DiffPhysDrone@HenryHuYu

    Dipublikasikan di Nature Machine Intelligence! Robot nyata pertama (quadrotor) yang berbasis pada pelatihan fisika terdiferensiasi.

    615+9Perubahan bintang dalam 7 hari terakhir
  • ML-2021-notes@chsiang426

    Catatan kuliah kursus "Machine Learning 2021 Spring" oleh Profesor Li Hung-yi dari National Taiwan University (NTU)

    603+4Perubahan bintang dalam 7 hari terakhir
  • recogdrive@xiaomi-research

    [ICLR 2026] ReCogDrive: Kerangka Kerja Kognitif Berbasis Penguatan untuk Mengemudi Otonom Ujung-ke-Ujung

    601+4Perubahan bintang dalam 7 hari terakhir
  • Relax@redai-studio

    Mesin Reinforcement Learning Asinkron untuk Post-Training Omni-Modal berskala besar.

    597+12Perubahan bintang dalam 7 hari terakhir
  • Makalah terkait reinforcement learning, termasuk makalah klasik dan terbaru di konferensi terkemuka.

    595+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah tentang reinforcement learning untuk pembuatan video

    593+1Perubahan bintang dalam 7 hari terakhir
  • AAAI-2024-Papers@DmitryRyumin

    Makalah AAAI 2024: Jelajahi koleksi komprehensif makalah penelitian inovatif yang dipresentasikan di salah satu konferensi kecerdasan buatan terkemuka. Integrasikan implementasi kode dengan mulus untuk pemahaman yang lebih baik. ⭐ Rasakan garis terdepan kemajuan dalam kecerdasan buatan dengan repositori ini!

    591+0Perubahan bintang dalam 7 hari terakhir
  • Graph-R1@LHRLAB

    [ICML 2026] Sumber daya resmi untuk "Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning".

    591+1Perubahan bintang dalam 7 hari terakhir
  • crafter@danijar

    Tolok ukur spektrum kemampuan agen

    587+1Perubahan bintang dalam 7 hari terakhir
  • safety-gymnasium@PKU-Alignment

    NeurIPS 2023: Safety-Gymnasium: Tolok Ukur Reinforcement Learning Aman yang Terpadu

    580+1Perubahan bintang dalam 7 hari terakhir
  • OmniDrones@btx0424
    578+4Perubahan bintang dalam 7 hari terakhir
  • TextRL@voidful

    Implementasi ChatGPT RLHF (Reinforcement Learning with Human Feedback) pada model bangkitan apa pun di transformer huggingface (bloomz-176B/bloom/gpt/bart/T5/MetaICL)

    564+0Perubahan bintang dalam 7 hari terakhir
  • Deep Reinforcement Learning (PPO) dalam Mengemudi Otonom (Carla) [dari awal]

    563-1Perubahan bintang dalam 7 hari terakhir
  • Meta Agents Research Environments adalah platform komprehensif yang dirancang untuk mengevaluasi agen AI dalam skenario yang dinamis dan realistis. Tidak seperti tolok ukur statis, platform ini memperkenalkan lingkungan yang terus berkembang di mana agen harus menyesuaikan strategi mereka saat informasi baru tersedia, mencerminkan tantangan di dunia nyata.

    551+4Perubahan bintang dalam 7 hari terakhir
  • awesome-ai@hades217

    Daftar kurasi sumber daya kecerdasan buatan (Kursus, Alat, Aplikasi, Proyek Sumber Terbuka)

    549-1Perubahan bintang dalam 7 hari terakhir
  • ReasonFlux@Gen-Verse

    [NeurIPS 2025 Spotlight] Suite pasca-pelatihan LLM — menampilkan ReasonFlux, ReasonFlux-PRM, dan ReasonFlux-Coder.

    542+0Perubahan bintang dalam 7 hari terakhir
  • flybody@TuragaLab

    Model tubuh lalat buah MuJoCo dan tugas RL lokomosi

    539+4Perubahan bintang dalam 7 hari terakhir
  • umi-on-legs@real-stanford

    UMI on Legs: Membuat Kebijakan Manipulasi Menjadi Seluler dengan Pengontrol Seluruh Tubuh Berpusat pada Manipulasi

    539+2Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi kursus teknik machine learning yang dapat diakses publik dari CalTech, Columbia, Berkeley, MIT, dan Stanford.

    535+0Perubahan bintang dalam 7 hari terakhir
  • morl-baselines@LucasAlegre

    Implementasi algoritma Multi-Objective Reinforcement Learning.

    533+1Perubahan bintang dalam 7 hari terakhir
  • InterMimic@Sirui-Xu

    [CVPR 2025 Highlight] InterMimic: Menuju Kontrol Seluruh Tubuh Universal untuk Interaksi Manusia-Objek Berbasis Fisika

    528+1Perubahan bintang dalam 7 hari terakhir
  • gym-mtsim@AminHP

    Simulator serbaguna, fleksibel, dan mudah digunakan beserta lingkungan trading OpenAI Gym untuk platform trading MetaTrader 5 (Disetujui oleh OpenAI Gym)

    524+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik