본문으로 건너뛰기
buildradar
Sign in
토픽 · ppo

ppo

ppo 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
26
총 스타
86,096
평균 스타
3,311
비중
0.00%

같은 리포지토리에 ppo 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 ppo 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • easy-rl@datawhalechina

    강화학습 중국어 튜토리얼 (버섯책🍄), 온라인 읽기 주소: https://datawhalechina.github.io/easy-rl/

    14,592+28최근 7일 스타 변화
  • tianshou@thu-ml

    우아한 PyTorch 심층 강화학습 라이브러리입니다.

    10,945+11최근 7일 스타 변화
  • cleanrl@vwxyzjn

    연구 친화적인 기능(PPO, DQN, C51, DDPG, TD3, SAC, PPG)을 갖춘 고품질의 단일 파일 심층 강화 학습 알고리즘 구현

    10,339+36최근 7일 스타 변화
  • 간단한 강화학습 튜토리얼, 莫烦Python 중국어 AI 교육

    9,510+7최근 7일 스타 변화
  • deep-reinforcement-learning@udacity

    심층 강화 학습(Deep Reinforcement Learning) 나노degree 프로그램 저장소

    5,176+0최근 7일 스타 변화
  • ElegantRL@AI4Finance-Foundation

    대규모 병렬 심층 강화학습. 🔥

    4,357+1최근 7일 스타 변화
  • hands-on-modern-rl@walkinglabs

    🚀 기초 RL 개념부터 LLM 정렬, RLVR, 고급 Agentic 시스템까지의 간극을 메우는 오픈소스 실습 커리큘럼

    4,145+94최근 7일 스타 변화
  • FinRL-Trading@AI4Finance-Foundation

    FinRL-X: 퀀트 트레이딩을 위한 AI 네이티브 모듈형 인프라

    3,607+25최근 7일 스타 변화
  • DeepRL@ShangtongZhang

    PyTorch로 구현된 모듈화된 심층 강화학습 알고리즘

    3,449+2최근 7일 스타 변화
  • DRL-Pytorch@XinJingHao

    인기 있는 Deep Reinforcement Learning (DRL) 알고리즘들의 깔끔하고 견고하며 통합된 PyTorch 구현 (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)

    3,437+4최근 7일 스타 변화
  • PPO-PyTorch@nikhilbarhate99

    PyTorch를 이용한 클리핑된 목적 함수 기반 PPO(Proximal Policy Optimization) 최소 구현

    2,376+0최근 7일 스타 변화
  • on-policy@marlbenchmark

    Multi-Agent PPO(MAPPO)의 공식 구현체입니다.

    2,087+2최근 7일 스타 변화
  • SLM-Lab@kengz

    PyTorch 기반의 모듈식 심층 강화학습 프레임워크입니다. "Foundations of Deep Reinforcement Learning" 도서의 동반 라이브러리입니다.

    1,362-1최근 7일 스타 변화
  • PPO-for-Beginners@ericyangyu

    간단하고 스타일이 잘 적용된 PPO 구현. 내 Medium 시리즈 기반: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1,268+3최근 7일 스타 변화
  • LearningHumanoidWalking@rohanpsingh

    강화 학습을 사용하여 보행을 위한 휴머노이드 로봇 훈련

    1,207+1최근 7일 스타 변화
  • purejaxrl@luchris429

    매우 빠른 엔드투엔드 Jax 강화학습 구현체

    1,100+2최근 7일 스타 변화
  • xuance@agi-brain

    XuanCe: 포괄적이고 통합된 심층 강화 학습 라이브러리

    1,081+1최근 7일 스타 변화
  • HALOs@ContextualAI

    DPO, KTO, PPO, ORPO 및 기타 인간 맞춤형 손실 함수(HALO)의 확장 가능한 구현을 제공하는 라이브러리

    910+0최근 7일 스타 변화
  • rl-starter-files@lcswillems

    코드를 한 줄도 작성하지 않고 에이전트를 즉시 학습, 시각화 및 평가할 수 있는 RL 스타터 파일

    728+1최근 7일 스타 변화
  • DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO 등 고전적인 심층 강화 학습 알고리즘의 PyTorch 구현체

    696+0최근 7일 스타 변화
  • oat@sail-sg

    OAT: 강화 학습, 선호도 학습 등을 포함하는 LLM 온라인 정렬을 위한 연구 친화적 프레임워크

    670-1최근 7일 스타 변화
  • 심층 강화 학습 에이전트 구축을 위한 PyTorch 라이브러리입니다.

    657+1최근 7일 스타 변화
  • Open-AgentRL@Gen-Verse

    RLAnything (ICML 2026) 및 AutoTool (ICML 2026), DemyAgent: LLM 및 에이전트 시나리오를 위한 오픈소스 강화학습

    625+1최근 7일 스타 변화
  • LLamaTuner@jianzhnie

    LLM의 쉽고 효율적인 미세 조정 (Llama, Llama2, Llama3, Qwen, Baichuan, GLM, Falcon 지원). 대형 모델의 고효율 양자화 훈련 및 배포

    621+0최근 7일 스타 변화
  • 비디오 생성을 위한 강화 학습 논문 모음

    590+2최근 7일 스타 변화
  • 자율 주행(Carla)을 위한 심층 강화 학습(PPO) [처음부터 구현]

    564+1최근 7일 스타 변화
← 토픽 목록으로