소유자 · opendilab
opendilab
opendilab의 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
리포지토리 16개
- #1
인간 피드백 기반 강화 학습(RLHF) 리소스 모음 (지속 업데이트)
★ 4,424+2최근 7일 스타 변화 - #2★ 3,642+1최근 7일 스타 변화
- #3
PPO x Family DRL 튜토리얼 코스(의사결정 지능 입문 공개강좌: 알고리즘 이론 정리, 코드 로직 이해, 의사결정 AI 응용 실습을 돕는 8개의 강좌)
★ 2,616+2최근 7일 스타 변화 - #4
[NeurIPS 2023 Spotlight] LightZero: 일반 순차적 의사결정 시나리오에서의 몬테카를로 트리 탐색을 위한 통합 벤치마크 (멋진 MCTS)
★ 1,642+4최근 7일 스타 변화 - #5
RL에서의 Diffusion Model 관련 리소스 모음 (지속 업데이트)
★ 1,635+2최근 7일 스타 변화 - #6
엄선된 멋진 모델 기반 RL 리소스 목록(지속 업데이트)
★ 1,393+0최근 7일 스타 변화 - #7★ 1,393+0최근 7일 스타 변화
- #8★ 929+0최근 7일 스타 변화
- #9
Decision Transformer 리소스 모음 (지속적으로 업데이트됨)
★ 916+0최근 7일 스타 변화 - #10
탐색적 강화학습(Exploration RL) 리소스 큐레이션 목록 (지속 업데이트)
★ 723+0최근 7일 스타 변화 - #11
[CoRL 2022] InterFuser: 해석 가능한 센서 퓨전 Transformer를 사용한 안전 강화 자율 주행
★ 652-1최근 7일 스타 변화 - #12★ 639+1최근 7일 스타 변화
- #13
다중 모달 강화 학습(Multi-Modal Reinforcement Learning) 리소스 엄선 목록 (지속적으로 업데이트됨)
★ 620+1최근 7일 스타 변화 - #14
LLM Riddles 게임의 오픈 소스 재현 및 데모
★ 587+0최근 7일 스타 변화 - #15★ 541+0최근 7일 스타 변화
- #16★ 519+0최근 7일 스타 변화