reinforcement-learning
reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #241
강화 학습을 위한 다목적 Gymnasium 환경
★ 760-1최근 7일 스타 변화 - #242★ 749—최근 7일 스타 변화
- #243★ 737+2최근 7일 스타 변화
- #244
Stable-Baselines3용 기여 패키지 - 실험적 강화 학습(RL) 코드
★ 736+5최근 7일 스타 변화 - #245★ 730+1최근 7일 스타 변화
- #246
UAV를 위한 심층 강화 학습 기반 자율 장애물 회피 알고리즘 프로젝트
★ 730+0최근 7일 스타 변화 - #247
Nature에 출판된 "Discovering State-of-the-art Reinforcement Algorithms" 논문 동반 코드
★ 728+2최근 7일 스타 변화 - #248★ 726-1최근 7일 스타 변화
- #249
탐색적 강화학습(Exploration RL) 리소스 큐레이션 목록 (지속 업데이트)
★ 723+0최근 7일 스타 변화 - #250
keras-rl 기반의 강화 학습을 사용하는 텍사스 홀덤 OpenAI gym 포커 환경. 가상 렌더링 및 에퀴티 계산을 위한 몬테카를로 시뮬레이션을 포함합니다.
★ 722+1최근 7일 스타 변화 - #251
Python으로 포커 AI 개발을 위한 포커 엔진
★ 722+1최근 7일 스타 변화 - #252★ 722+1최근 7일 스타 변화
- #253
[COLM’25] DeepRetrieval — 🔥 검색 결과 기반 RLVR을 통한 검색 에이전트 학습
★ 719+2최근 7일 스타 변화 - #254
구현 코드가 포함된 몬테카를로 트리 탐색(MCTS) 논문 모음
★ 715+1최근 7일 스타 변화 - #255
실제 파노라마 이미지를 활용한 강화학습 AI 연구 플랫폼
★ 713+1최근 7일 스타 변화 - #256
모델 예측 제어(MPC)를 활용한 강화 학습
★ 710+1최근 7일 스타 변화 - #257★ 708-1최근 7일 스타 변화
- #258
비전-언어 모델 논문 및 모델을 모아놓은 프론트엔드 컬렉션 및 조사 저장소. 지속적으로 업데이트됨
★ 706+3최근 7일 스타 변화 - #259★ 693+2최근 7일 스타 변화
- #260
Flow-Matching 모델에서 손쉬운 강화학습을 위한 통합 프레임워크
★ 692+7최근 7일 스타 변화 - #261
Python 및 Tensorflow를 이용한 역강화학습(IRL) 알고리즘 구현. Deep MaxEnt, MaxEnt, LPIRL 포함
★ 681+2최근 7일 스타 변화 - #262
강화 학습을 적용한 C++ 기반 하스스톤 시뮬레이터
★ 680+1최근 7일 스타 변화 - #263
Python 바인딩을 지원하는 MDP 및 POMDP용 C++ 프레임워크
★ 671+1최근 7일 스타 변화 - #264
심층 강화 학습 에이전트 구축을 위한 PyTorch 라이브러리입니다.
★ 657+0최근 7일 스타 변화 - #265
BenchMARL은 다중 에이전트 강화학습(MARL) 벤치마킹 라이브러리입니다. 재현성과 표준화라는 두 가지 핵심 원칙을 바탕으로 다양한 MARL 알고리즘, 태스크, 모델을 신속하게 비교할 수 있습니다.
★ 656+2최근 7일 스타 변화 - #266
데이터 과학 프로젝트의 전체 수명 주기 관리입니다.
★ 653+0최근 7일 스타 변화 - #267
Julia용 강화 학습 패키지
★ 652-1최근 7일 스타 변화 - #268
Long Chain-of-Thought 추론의 최신 연구 동향
★ 647-1최근 7일 스타 변화 - #269★ 644+3최근 7일 스타 변화
- #270★ 639+0최근 7일 스타 변화