rl
rl 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
MobileGym: 모바일 GUI 에이전트 연구를 위한 검증 가능하고 고도로 병렬화된 시뮬레이션 플랫폼 · 브라우저에서 실행되는 안드로이드 시뮬레이터 · Browser-hosted Android Simulator · 검증 가능한 평가 · 확장 가능한 온라인 RL 학습
★ 786+10최근 7일 스타 변화 - #32
Stable-Baselines3용 기여 패키지 - 실험적 강화 학습(RL) 코드
★ 736+5최근 7일 스타 변화 - #33
구현 코드가 포함된 몬테카를로 트리 탐색(MCTS) 논문 모음
★ 715+1최근 7일 스타 변화 - #34
실제 파노라마 이미지를 활용한 강화학습 AI 연구 플랫폼
★ 713+1최근 7일 스타 변화 - #35★ 704+4최근 7일 스타 변화
- #36
Python 및 Tensorflow를 이용한 역강화학습(IRL) 알고리즘 구현. Deep MaxEnt, MaxEnt, LPIRL 포함
★ 681+2최근 7일 스타 변화 - #37
강화 학습을 적용한 C++ 기반 하스스톤 시뮬레이터
★ 680+1최근 7일 스타 변화 - #38
BenchMARL은 다중 에이전트 강화학습(MARL) 벤치마킹 라이브러리입니다. 재현성과 표준화라는 두 가지 핵심 원칙을 바탕으로 다양한 MARL 알고리즘, 태스크, 모델을 신속하게 비교할 수 있습니다.
★ 656+2최근 7일 스타 변화 - #39
Long Chain-of-Thought 추론의 최신 연구 동향
★ 647-1최근 7일 스타 변화 - #40★ 589+3최근 7일 스타 변화
- #41
sim2real을 포함한 4족 보행 로봇용 ROS2-Control 구현
★ 567+3최근 7일 스타 변화 - #42
Meta Agents Research Environments는 동적이고 현실적인 시나리오에서 AI 에이전트를 평가하기 위한 포괄적인 플랫폼입니다. 정적 벤치마크와 달리, 이 플랫폼은 새로운 정보가 제공됨에 따라 에이전트가 전략을 조정해야 하는 진화하는 환경을 도입하여 실제 환경의 도전 과제를 반영합니다.
★ 551+3최근 7일 스타 변화 - #43
다목적 강화 학습 알고리즘 구현체
★ 533+1최근 7일 스타 변화 - #44
DeepThinkVLA: 비전-언어-행동 모델의 추론 능력 향상
★ 529+0최근 7일 스타 변화 - #45★ 506+1최근 7일 스타 변화
- #46
Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
★ 501—최근 7일 스타 변화