Lompat ke konten utama
buildradar
Sign in
Topik · reinforcement-learning

reinforcement-learning

Repositori open source terpantau bertanda reinforcement-learning, diurutkan berdasarkan bintang.

305 repositori
  • vowpal_wabbit@VowpalWabbit

    Vowpal Wabbit adalah sistem pembelajaran mesin yang mendorong batas pembelajaran mesin dengan teknik seperti online, hashing, allreduce, reductions, learning2search, active, dan interactive learning.

    8.708+2Perubahan bintang dalam 7 hari terakhir
  • pysc2@google-deepmind

    Lingkungan pembelajaran StarCraft II

    8.309+2Perubahan bintang dalam 7 hari terakhir
  • PaLM-rlhf-pytorch@lucidrains

    Implementasi RLHF (Reinforcement Learning with Human Feedback) di atas arsitektur PaLM. Pada dasarnya seperti ChatGPT tetapi menggunakan PaLM

    7.866-1Perubahan bintang dalam 7 hari terakhir
  • maths-cs-ai-compendium@HenryNdubuaku

    Menjadi peneliti/insinyur AI/ML yang mahir dengan buku teks tidak konvensional yang mencakup matematika, komputasi, dan ML dengan pendekatan intuitif.

    7.400+21Perubahan bintang dalam 7 hari terakhir
  • Daftar bacaan untuk topik penelitian dalam machine learning multimodal.

    6.926+1Perubahan bintang dalam 7 hari terakhir
  • Kumpulan makalah, blog, dan proyek LLM, dengan fokus pada OpenAI o1 🍓 dan teknik penalaran.

    6.902+3Perubahan bintang dalam 7 hari terakhir
  • Practical_RL@yandexdataschool

    Kursus pembelajaran penguatan (reinforcement learning) di lapangan.

    6.566+0Perubahan bintang dalam 7 hari terakhir
  • 🔬 Daftar pilihan LLM, strategi deep learning & alat luar biasa di pasar keuangan.

    6.475+23Perubahan bintang dalam 7 hari terakhir
  • Mooncake@kvcache-ai

    Mooncake adalah platform layanan untuk Kimi, layanan LLM terkemuka yang disediakan oleh Moonshot AI.

    6.470+40Perubahan bintang dalam 7 hari terakhir
  • Daftar terkurasi dari metode self-supervised yang luar biasa

    6.414+1Perubahan bintang dalam 7 hari terakhir
  • PufferLib@PufferAI

    Meningkatkan reinforcement learning

    6.321+8Perubahan bintang dalam 7 hari terakhir
  • VLM-R1@om-ai-lab

    Menyelesaikan Pemahaman Visual dengan VLM yang Diperkuat

    6.018+4Perubahan bintang dalam 7 hari terakhir
  • rllm@rllm-org

    Mendemokratisasi Reinforcement Learning untuk LLM.

    5.813+5Perubahan bintang dalam 7 hari terakhir
  • AReaL@areal-project

    Jembatan RL untuk aplikasi Agent berbasis LLM. Dibuat sederhana & fleksibel.

    5.712+9Perubahan bintang dalam 7 hari terakhir
  • open_spiel@google-deepmind

    OpenSpiel adalah koleksi lingkungan dan algoritma untuk penelitian dalam reinforcement learning umum serta pencarian/perencanaan dalam permainan.

    5.452+8Perubahan bintang dalam 7 hari terakhir
  • Framework robot peliharaan berkaki empat sumber terbuka untuk mengembangkan robot berkaki empat gaya Boston Dynamics yang sempurna untuk STEM, pendidikan coding & robotika, aplikasi robotika IoT, layanan aplikasi robotika yang diperkaya AI, penelitian, dan pengembangan kit robotika DIY.

    5.246+15Perubahan bintang dalam 7 hari terakhir
  • xtuner@InternLM

    Mesin pelatihan generasi berikutnya yang dibangun untuk model MoE skala ultra-besar.

    5.188+3Perubahan bintang dalam 7 hari terakhir
  • deep-reinforcement-learning@udacity

    Repositori untuk program Nanodegree Deep Reinforcement Learning.

    5.176+0Perubahan bintang dalam 7 hari terakhir
  • EasyR1@hiyouga

    EasyR1: Kerangka kerja pelatihan RL multi-modalitas yang efisien dan dapat diskalakan berdasarkan veRL.

    5.141+5Perubahan bintang dalam 7 hari terakhir
  • reasoning-from-scratch@rasbt

    Mengimplementasikan penalaran LLM di PyTorch dari awal, langkah demi langkah.

    5.138+49Perubahan bintang dalam 7 hari terakhir
  • deep-rl-class@huggingface

    Repositori ini berisi kursus Deep Reinforcement Learning dari Hugging Face.

    5.006+10Perubahan bintang dalam 7 hari terakhir
  • LLM-RL-Visualized@changyeyu

    100+ peta algoritma LLM / RL orisinal, karya penulis 《大模型算法》.

    4.838+12Perubahan bintang dalam 7 hari terakhir
  • trlx@CarperAI

    Repositori untuk pelatihan terdistribusi model bahasa dengan Reinforcement Learning via Human Feedback (RLHF).

    4.754-1Perubahan bintang dalam 7 hari terakhir
  • RLinf@RLinf

    RLinf: Infrastruktur Reinforcement Learning untuk Embodied AI dan Agentic AI

    4.705+31Perubahan bintang dalam 7 hari terakhir
  • dm_control@google-deepmind

    Tumpukan perangkat lunak Google DeepMind untuk simulasi berbasis fisika dan lingkungan Reinforcement Learning, menggunakan MuJoCo.

    4.681+6Perubahan bintang dalam 7 hari terakhir
  • DouZero@kwai

    [ICML 2021] DouZero: Menguasai DouDizhu dengan Deep Reinforcement Learning Berbasis Self-Play | AI DouDizhu

    4.659+5Perubahan bintang dalam 7 hari terakhir
  • alpha-zero-general@suragnair

    Implementasi bersih berbasis AlphaZero untuk game apa pun di framework apa pun + tutorial + Othello/Gobang/TicTacToe/Connect4 dan lainnya

    4.512+5Perubahan bintang dalam 7 hari terakhir
  • awesome-RLHF@opendilab

    Daftar kurasi sumber daya reinforcement learning with human feedback (diperbarui secara berkala).

    4.424+2Perubahan bintang dalam 7 hari terakhir
  • ElegantRL@AI4Finance-Foundation

    Deep Reinforcement Learning yang sangat paralel.

    4.359+2Perubahan bintang dalam 7 hari terakhir
  • hands-on-modern-rl@walkinglabs

    Kurikulum praktis sumber terbuka yang menjembatani kesenjangan dari konsep dasar RL ke penyelarasan LLM, RLVR, dan sistem agen tingkat lanjut.

    4.199+54Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik