Lompat ke konten utama
buildradar
Sign in
Topik · ppo

ppo

Repositori open source terpantau bertanda ppo, diurutkan berdasarkan bintang.

Repositori
26
Total bintang
86.096
Rata-rata bintang
3.311
Porsi
0,00%

Topik yang sering muncul berdampingan dengan ppo di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda ppo.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • easy-rl@datawhalechina

    Tutorial pembelajaran penguatan (Reinforcement Learning) dalam bahasa Mandarin (Buku Jamur🍄), alamat baca daring: https://datawhalechina.github.io/easy-rl/

    14.592+28Perubahan bintang dalam 7 hari terakhir
  • tianshou@thu-ml

    Pustaka deep reinforcement learning PyTorch yang elegan.

    10.945+11Perubahan bintang dalam 7 hari terakhir
  • cleanrl@vwxyzjn

    Implementasi file tunggal berkualitas tinggi dari algoritma Deep Reinforcement Learning dengan fitur yang ramah penelitian (PPO, DQN, C51, DDPG, TD3, SAC, PPG)

    10.339+36Perubahan bintang dalam 7 hari terakhir
  • Tutorial Reinforcement learning sederhana, pengajaran AI bahasa Mandarin oleh 莫烦Python.

    9.510+7Perubahan bintang dalam 7 hari terakhir
  • deep-reinforcement-learning@udacity

    Repositori untuk program Nanodegree Deep Reinforcement Learning.

    5.176+0Perubahan bintang dalam 7 hari terakhir
  • ElegantRL@AI4Finance-Foundation

    Deep Reinforcement Learning yang sangat paralel.

    4.357+1Perubahan bintang dalam 7 hari terakhir
  • hands-on-modern-rl@walkinglabs

    Kurikulum praktis sumber terbuka yang menjembatani kesenjangan dari konsep dasar RL ke penyelarasan LLM, RLVR, dan sistem agen tingkat lanjut.

    4.145+94Perubahan bintang dalam 7 hari terakhir
  • FinRL-Trading@AI4Finance-Foundation

    FinRL-X: Infrastruktur Modular AI-Native untuk Perdagangan Kuantitatif

    3.607+25Perubahan bintang dalam 7 hari terakhir
  • DeepRL@ShangtongZhang

    Implementasi modular algoritma Deep RL dalam PyTorch.

    3.449+2Perubahan bintang dalam 7 hari terakhir
  • DRL-Pytorch@XinJingHao

    Implementasi PyTorch yang bersih, tangguh, dan terpadu untuk algoritma Deep Reinforcement Learning (DRL) populer (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3.437+4Perubahan bintang dalam 7 hari terakhir
  • PPO-PyTorch@nikhilbarhate99

    Implementasi minimal dari clipped objective Proximal Policy Optimization (PPO) di PyTorch

    2.376+0Perubahan bintang dalam 7 hari terakhir
  • on-policy@marlbenchmark

    Ini adalah implementasi resmi dari Multi-Agent PPO (MAPPO).

    2.087+2Perubahan bintang dalam 7 hari terakhir
  • SLM-Lab@kengz

    Kerangka kerja Deep Reinforcement Learning modular di PyTorch. Pustaka pendamping buku "Foundations of Deep Reinforcement Learning".

    1.362-1Perubahan bintang dalam 7 hari terakhir
  • PPO-for-Beginners@ericyangyu

    Implementasi PPO yang sederhana dan bergaya baik. Berdasarkan seri Medium saya: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1.268+3Perubahan bintang dalam 7 hari terakhir
  • LearningHumanoidWalking@rohanpsingh

    Melatih robot humanoid untuk lokomosi menggunakan Reinforcement Learning

    1.207+1Perubahan bintang dalam 7 hari terakhir
  • purejaxrl@luchris429

    Implementasi Jax RL End-to-End yang Sangat Cepat

    1.100+2Perubahan bintang dalam 7 hari terakhir
  • xuance@agi-brain

    XuanCe: Pustaka Deep Reinforcement Learning yang Komprehensif dan Terpadu

    1.081+1Perubahan bintang dalam 7 hari terakhir
  • HALOs@ContextualAI

    Pustaka dengan implementasi yang dapat diperluas dari DPO, KTO, PPO, ORPO, dan fungsi loss yang sadar manusia (HALO) lainnya.

    910+0Perubahan bintang dalam 7 hari terakhir
  • rl-starter-files@lcswillems

    File awal RL untuk langsung melatih, memvisualisasikan, dan mengevaluasi agen tanpa menulis baris kode apa pun

    728+1Perubahan bintang dalam 7 hari terakhir
  • Repositori ini berisi sebagian besar implementasi PyTorch untuk algoritma deep reinforcement learning klasik, termasuk DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, dan TRPO. (Algoritma lainnya masih dalam pengembangan)

    696+0Perubahan bintang dalam 7 hari terakhir
  • oat@sail-sg

    OAT: Framework yang ramah riset untuk penyelarasan daring LLM, mencakup reinforcement learning, preference learning, dan lainnya.

    670-1Perubahan bintang dalam 7 hari terakhir
  • Pustaka PyTorch untuk membangun agen deep reinforcement learning.

    657+1Perubahan bintang dalam 7 hari terakhir
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) & AutoTool (ICML 2026), DemyAgent: RL Open-Source untuk LLM dan Skenario Agen

    625+1Perubahan bintang dalam 7 hari terakhir
  • LLamaTuner@jianzhnie

    Finetuning LLM yang mudah dan efisien. (Mendukung LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon) Pelatihan dan deployment kuantisasi efisien untuk model bahasa besar.

    621+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah tentang reinforcement learning untuk pembuatan video

    590+2Perubahan bintang dalam 7 hari terakhir
  • Deep Reinforcement Learning (PPO) dalam Mengemudi Otonom (Carla) [dari awal]

    564+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik