본문으로 건너뛰기
buildradar
Sign in
토픽 · rl

rl

rl 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 46개
  • mobilegym@Purewhiter

    MobileGym: 모바일 GUI 에이전트 연구를 위한 검증 가능하고 고도로 병렬화된 시뮬레이션 플랫폼 · 브라우저에서 실행되는 안드로이드 시뮬레이터 · Browser-hosted Android Simulator · 검증 가능한 평가 · 확장 가능한 온라인 RL 학습

    786+10최근 7일 스타 변화
  • stable-baselines3-contrib@Stable-Baselines-Team

    Stable-Baselines3용 기여 패키지 - 실험적 강화 학습(RL) 코드

    736+5최근 7일 스타 변화
  • 구현 코드가 포함된 몬테카를로 트리 탐색(MCTS) 논문 모음

    715+1최근 7일 스타 변화
  • Matterport3DSimulator@peteanderson80

    실제 파노라마 이미지를 활용한 강화학습 AI 연구 플랫폼

    713+1최근 7일 스타 변화
  • dr-tulu@rlresearch

    심층 연구를 위한 진화하는 루브릭 기반 강화 학습(DR Tulu) 공식 저장소

    704+4최근 7일 스타 변화
  • irl-imitation@yrlu

    Python 및 Tensorflow를 이용한 역강화학습(IRL) 알고리즘 구현. Deep MaxEnt, MaxEnt, LPIRL 포함

    681+2최근 7일 스타 변화
  • RosettaStone@utilForever

    강화 학습을 적용한 C++ 기반 하스스톤 시뮬레이터

    680+1최근 7일 스타 변화
  • BenchMARL@facebookresearch

    BenchMARL은 다중 에이전트 강화학습(MARL) 벤치마킹 라이브러리입니다. 재현성과 표준화라는 두 가지 핵심 원칙을 바탕으로 다양한 MARL 알고리즘, 태스크, 모델을 신속하게 비교할 수 있습니다.

    656+2최근 7일 스타 변화
  • Long Chain-of-Thought 추론의 최신 연구 동향

    647-1최근 7일 스타 변화
  • WebShop@princeton-nlp

    [NeurIPS 2022] 🛒WebShop: Grounded Language Agent를 활용한 확장 가능한 실세계 웹 상호작용 연구

    589+3최근 7일 스타 변화
  • sim2real을 포함한 4족 보행 로봇용 ROS2-Control 구현

    567+3최근 7일 스타 변화
  • Meta Agents Research Environments는 동적이고 현실적인 시나리오에서 AI 에이전트를 평가하기 위한 포괄적인 플랫폼입니다. 정적 벤치마크와 달리, 이 플랫폼은 새로운 정보가 제공됨에 따라 에이전트가 전략을 조정해야 하는 진화하는 환경을 도입하여 실제 환경의 도전 과제를 반영합니다.

    551+3최근 7일 스타 변화
  • morl-baselines@LucasAlegre

    다목적 강화 학습 알고리즘 구현체

    533+1최근 7일 스타 변화
  • DeepThinkVLA@OpenBMB

    DeepThinkVLA: 비전-언어-행동 모델의 추론 능력 향상

    529+0최근 7일 스타 변화
  • gem@axon-rl

    에이전트형 LLM을 위한 학습 환경(Gym)

    506+1최근 7일 스타 변화
  • GDPO@NVlabs

    Official implementation of GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization

    501최근 7일 스타 변화
← 토픽 목록으로