reinforcement-learning
Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.
- #271★ 638+0Perubahan bintang dalam 7 hari terakhir
- #272
Repositori ini mengumpulkan beberapa kode yang merangkum algoritma yang umum digunakan di bidang machine learning. Sebagian besar didasarkan pada Numpy, Pandas, atau Torch. Anda dapat memperdalam pemahaman tentang model dan algoritma terkait atau memodifikasinya untuk mendapatkan kode kustom Anda sendiri dengan merujuk pada repositori ini.
★ 635+0Perubahan bintang dalam 7 hari terakhir - #273
RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: RL Open-Source untuk LLM dan Skenario Agen
★ 634+11Perubahan bintang dalam 7 hari terakhir - #274★ 633+0Perubahan bintang dalam 7 hari terakhir
- #275
API untuk menjalankan VirtualHome, Simulator Rumah Tangga Multi-Agen
★ 632+2Perubahan bintang dalam 7 hari terakhir - #276★ 631+0Perubahan bintang dalam 7 hari terakhir
- #277
Jelajahi “Aha Moment” Multimodal pada Model 2B
★ 623+0Perubahan bintang dalam 7 hari terakhir - #278
Deploy proyek walk-these-ways pada Unitree Go2
★ 623+3Perubahan bintang dalam 7 hari terakhir - #279
Dipublikasikan di Nature Machine Intelligence! Robot nyata pertama (quadrotor) yang berbasis pada pelatihan fisika terdiferensiasi.
★ 615+9Perubahan bintang dalam 7 hari terakhir - #280
Catatan kuliah kursus "Machine Learning 2021 Spring" oleh Profesor Li Hung-yi dari National Taiwan University (NTU)
★ 603+4Perubahan bintang dalam 7 hari terakhir - #281
[ICLR 2026] ReCogDrive: Kerangka Kerja Kognitif Berbasis Penguatan untuk Mengemudi Otonom Ujung-ke-Ujung
★ 601+4Perubahan bintang dalam 7 hari terakhir - #282
Mesin Reinforcement Learning Asinkron untuk Post-Training Omni-Modal berskala besar.
★ 597+12Perubahan bintang dalam 7 hari terakhir - #283
Makalah terkait reinforcement learning, termasuk makalah klasik dan terbaru di konferensi terkemuka.
★ 595+0Perubahan bintang dalam 7 hari terakhir - #284
Daftar kurasi makalah tentang reinforcement learning untuk pembuatan video
★ 593+1Perubahan bintang dalam 7 hari terakhir - #285
Makalah AAAI 2024: Jelajahi koleksi komprehensif makalah penelitian inovatif yang dipresentasikan di salah satu konferensi kecerdasan buatan terkemuka. Integrasikan implementasi kode dengan mulus untuk pemahaman yang lebih baik. ⭐ Rasakan garis terdepan kemajuan dalam kecerdasan buatan dengan repositori ini!
★ 591+0Perubahan bintang dalam 7 hari terakhir - #286
[ICML 2026] Sumber daya resmi untuk "Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning".
★ 591+1Perubahan bintang dalam 7 hari terakhir - #287★ 587+1Perubahan bintang dalam 7 hari terakhir
- #288
NeurIPS 2023: Safety-Gymnasium: Tolok Ukur Reinforcement Learning Aman yang Terpadu
★ 580+1Perubahan bintang dalam 7 hari terakhir - #289★ 578+4Perubahan bintang dalam 7 hari terakhir
- #290
Implementasi ChatGPT RLHF (Reinforcement Learning with Human Feedback) pada model bangkitan apa pun di transformer huggingface (bloomz-176B/bloom/gpt/bart/T5/MetaICL)
★ 564+0Perubahan bintang dalam 7 hari terakhir - #291
Deep Reinforcement Learning (PPO) dalam Mengemudi Otonom (Carla) [dari awal]
★ 563-1Perubahan bintang dalam 7 hari terakhir - #292
Meta Agents Research Environments adalah platform komprehensif yang dirancang untuk mengevaluasi agen AI dalam skenario yang dinamis dan realistis. Tidak seperti tolok ukur statis, platform ini memperkenalkan lingkungan yang terus berkembang di mana agen harus menyesuaikan strategi mereka saat informasi baru tersedia, mencerminkan tantangan di dunia nyata.
★ 551+4Perubahan bintang dalam 7 hari terakhir - #293
Daftar kurasi sumber daya kecerdasan buatan (Kursus, Alat, Aplikasi, Proyek Sumber Terbuka)
★ 549-1Perubahan bintang dalam 7 hari terakhir - #294
[NeurIPS 2025 Spotlight] Suite pasca-pelatihan LLM — menampilkan ReasonFlux, ReasonFlux-PRM, dan ReasonFlux-Coder.
★ 542+0Perubahan bintang dalam 7 hari terakhir - #295★ 539+4Perubahan bintang dalam 7 hari terakhir
- #296
UMI on Legs: Membuat Kebijakan Manipulasi Menjadi Seluler dengan Pengontrol Seluruh Tubuh Berpusat pada Manipulasi
★ 539+2Perubahan bintang dalam 7 hari terakhir - #297
Daftar kurasi kursus teknik machine learning yang dapat diakses publik dari CalTech, Columbia, Berkeley, MIT, dan Stanford.
★ 535+0Perubahan bintang dalam 7 hari terakhir - #298
Implementasi algoritma Multi-Objective Reinforcement Learning.
★ 533+1Perubahan bintang dalam 7 hari terakhir - #299
[CVPR 2025 Highlight] InterMimic: Menuju Kontrol Seluruh Tubuh Universal untuk Interaksi Manusia-Objek Berbasis Fisika
★ 528+1Perubahan bintang dalam 7 hari terakhir - #300
Simulator serbaguna, fleksibel, dan mudah digunakan beserta lingkungan trading OpenAI Gym untuk platform trading MetaTrader 5 (Disetujui oleh OpenAI Gym)
★ 524+0Perubahan bintang dalam 7 hari terakhir