본문으로 건너뛰기
buildradar
Sign in
토픽 · reinforcement-learning

reinforcement-learning

reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 305개
  • MO-Gymnasium@Farama-Foundation

    강화 학습을 위한 다목적 Gymnasium 환경

    760-1최근 7일 스타 변화
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    749최근 7일 스타 변화
  • tmrl@trackmania-rl

    실시간 애플리케이션을 위한 강화 학습

    737+2최근 7일 스타 변화
  • stable-baselines3-contrib@Stable-Baselines-Team

    Stable-Baselines3용 기여 패키지 - 실험적 강화 학습(RL) 코드

    736+5최근 7일 스타 변화
  • Long-RL@NVlabs

    Long-RL: 긴 시퀀스로 RL 확장 (NeurIPS 2025)

    730+1최근 7일 스타 변화
  • UAV를 위한 심층 강화 학습 기반 자율 장애물 회피 알고리즘 프로젝트

    730+0최근 7일 스타 변화
  • disco_rl@google-deepmind

    Nature에 출판된 "Discovering State-of-the-art Reinforcement Algorithms" 논문 동반 코드

    728+2최근 7일 스타 변화
  • rl-agents@eleurent

    강화 학습 및 계획 알고리즘 구현

    726-1최근 7일 스타 변화
  • 탐색적 강화학습(Exploration RL) 리소스 큐레이션 목록 (지속 업데이트)

    723+0최근 7일 스타 변화
  • neuron_poker@dickreuter

    keras-rl 기반의 강화 학습을 사용하는 텍사스 홀덤 OpenAI gym 포커 환경. 가상 렌더링 및 에퀴티 계산을 위한 몬테카를로 시뮬레이션을 포함합니다.

    722+1최근 7일 스타 변화
  • PyPokerEngine@ishikota

    Python으로 포커 AI 개발을 위한 포커 엔진

    722+1최근 7일 스타 변화
  • UAV-DDPG@fangvv

    UAV 보조 모바일 엣지 컴퓨팅을 위한 연산 오프로딩 최적화: 심층 결정론적 정책 경사 접근법 논문 코드

    722+1최근 7일 스타 변화
  • DeepRetrieval@pat-jj

    [COLM’25] DeepRetrieval — 🔥 검색 결과 기반 RLVR을 통한 검색 에이전트 학습

    719+2최근 7일 스타 변화
  • 구현 코드가 포함된 몬테카를로 트리 탐색(MCTS) 논문 모음

    715+1최근 7일 스타 변화
  • Matterport3DSimulator@peteanderson80

    실제 파노라마 이미지를 활용한 강화학습 AI 연구 플랫폼

    713+1최근 7일 스타 변화
  • mpc-reinforcement-learning@FilippoAiraldi

    모델 예측 제어(MPC)를 활용한 강화 학습

    710+1최근 7일 스타 변화
  • pymarl2@hijkzzz

    SMAC에서 미세 조정된 MARL 알고리즘 (대부분의 시나리오에서 100% 승률)

    708-1최근 7일 스타 변화
  • 비전-언어 모델 논문 및 모델을 모아놓은 프론트엔드 컬렉션 및 조사 저장소. 지속적으로 업데이트됨

    706+3최근 7일 스타 변화
  • ns3-gym@tkn-tub

    ns3-gym - 네트워크 연구를 위한 강화학습 플레이그라운드입니다.

    693+2최근 7일 스타 변화
  • Flow-Factory@X-GenGroup

    Flow-Matching 모델에서 손쉬운 강화학습을 위한 통합 프레임워크

    692+7최근 7일 스타 변화
  • irl-imitation@yrlu

    Python 및 Tensorflow를 이용한 역강화학습(IRL) 알고리즘 구현. Deep MaxEnt, MaxEnt, LPIRL 포함

    681+2최근 7일 스타 변화
  • RosettaStone@utilForever

    강화 학습을 적용한 C++ 기반 하스스톤 시뮬레이터

    680+1최근 7일 스타 변화
  • AI-Toolbox@Svalorzen

    Python 바인딩을 지원하는 MDP 및 POMDP용 C++ 프레임워크

    671+1최근 7일 스타 변화
  • 심층 강화 학습 에이전트 구축을 위한 PyTorch 라이브러리입니다.

    657+0최근 7일 스타 변화
  • BenchMARL@facebookresearch

    BenchMARL은 다중 에이전트 강화학습(MARL) 벤치마킹 라이브러리입니다. 재현성과 표준화라는 두 가지 핵심 원칙을 바탕으로 다양한 MARL 알고리즘, 태스크, 모델을 신속하게 비교할 수 있습니다.

    656+2최근 7일 스타 변화
  • 데이터 과학 프로젝트의 전체 수명 주기 관리입니다.

    653+0최근 7일 스타 변화
  • ReinforcementLearning.jl@JuliaReinforcementLearning

    Julia용 강화 학습 패키지

    652-1최근 7일 스타 변화
  • Long Chain-of-Thought 추론의 최신 연구 동향

    647-1최근 7일 스타 변화
  • pgx@sotetsuk

    JAX 기반의 벡터화된 강화학습 게임 환경

    644+3최근 7일 스타 변화
  • Seg-Zero@JIA-Lab-research

    Seg-Zero: 추론 체인 기반 인지 강화 세분화 프로젝트 페이지

    639+0최근 7일 스타 변화
← 토픽 목록으로