ppo
ppo 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 ppo 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 ppo 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 14,592+28최근 7일 스타 변화
- #2★ 10,945+11최근 7일 스타 변화
- #3★ 10,339+36최근 7일 스타 변화
- #4
간단한 강화학습 튜토리얼, 莫烦Python 중국어 AI 교육
★ 9,510+7최근 7일 스타 변화 - #5
심층 강화 학습(Deep Reinforcement Learning) 나노degree 프로그램 저장소
★ 5,176+0최근 7일 스타 변화 - #6★ 4,357+1최근 7일 스타 변화
- #7
🚀 기초 RL 개념부터 LLM 정렬, RLVR, 고급 Agentic 시스템까지의 간극을 메우는 오픈소스 실습 커리큘럼
★ 4,145+94최근 7일 스타 변화 - #8
FinRL-X: 퀀트 트레이딩을 위한 AI 네이티브 모듈형 인프라
★ 3,607+25최근 7일 스타 변화 - #9★ 3,449+2최근 7일 스타 변화
- #10
인기 있는 Deep Reinforcement Learning (DRL) 알고리즘들의 깔끔하고 견고하며 통합된 PyTorch 구현 (Q-learning, Duel DDQN, PER, C51, Noisy DQN, PPO, DDPG, TD3, SAC, ASL)
★ 3,437+4최근 7일 스타 변화 - #11
PyTorch를 이용한 클리핑된 목적 함수 기반 PPO(Proximal Policy Optimization) 최소 구현
★ 2,376+0최근 7일 스타 변화 - #12★ 2,087+2최근 7일 스타 변화
- #13
PyTorch 기반의 모듈식 심층 강화학습 프레임워크입니다. "Foundations of Deep Reinforcement Learning" 도서의 동반 라이브러리입니다.
★ 1,362-1최근 7일 스타 변화 - #14
간단하고 스타일이 잘 적용된 PPO 구현. 내 Medium 시리즈 기반: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.
★ 1,268+3최근 7일 스타 변화 - #15
강화 학습을 사용하여 보행을 위한 휴머노이드 로봇 훈련
★ 1,207+1최근 7일 스타 변화 - #16★ 1,100+2최근 7일 스타 변화
- #17★ 1,081+1최근 7일 스타 변화
- #18★ 910+0최근 7일 스타 변화
- #19
코드를 한 줄도 작성하지 않고 에이전트를 즉시 학습, 시각화 및 평가할 수 있는 RL 스타터 파일
★ 728+1최근 7일 스타 변화 - #20
DQN, DDQN, Dueling Network, DDPG, SAC, A2C, PPO, TRPO 등 고전적인 심층 강화 학습 알고리즘의 PyTorch 구현체
★ 696+0최근 7일 스타 변화 - #21★ 670-1최근 7일 스타 변화
- #22
심층 강화 학습 에이전트 구축을 위한 PyTorch 라이브러리입니다.
★ 657+1최근 7일 스타 변화 - #23
RLAnything (ICML 2026) 및 AutoTool (ICML 2026), DemyAgent: LLM 및 에이전트 시나리오를 위한 오픈소스 강화학습
★ 625+1최근 7일 스타 변화 - #24
LLM의 쉽고 효율적인 미세 조정 (Llama, Llama2, Llama3, Qwen, Baichuan, GLM, Falcon 지원). 대형 모델의 고효율 양자화 훈련 및 배포
★ 621+0최근 7일 스타 변화 - #25
비디오 생성을 위한 강화 학습 논문 모음
★ 590+2최근 7일 스타 변화 - #26
자율 주행(Carla)을 위한 심층 강화 학습(PPO) [처음부터 구현]
★ 564+1최근 7일 스타 변화