본문으로 건너뛰기
buildradar
Sign in
토픽 · reinforcement-learning

reinforcement-learning

reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 305개
  • 슈퍼 마리오 브라더스를 위한 비동기 어드밴티지 액터-크리틱(A3C) 알고리즘

    1,111-1최근 7일 스타 변화
  • purejaxrl@luchris429

    매우 빠른 엔드투엔드 Jax 강화학습 구현체

    1,102+2최근 7일 스타 변화
  • skrl@Toni-SM

    Gymnasium/Gym, NVIDIA Isaac Lab, MuJoCo Playground 및 기타 환경을 지원하는 모듈형 강화학습(RL) 라이브러리(PyTorch, JAX, NVIDIA Warp로 구현)

    1,095+2최근 7일 스타 변화
  • DexterousHands@PKU-MARL

    Isaac Gym을 통해 양손 조작 작업을 제공하는 라이브러리

    1,094+7최근 7일 스타 변화
  • xuance@agi-brain

    XuanCe: 포괄적이고 통합된 심층 강화 학습 라이브러리

    1,085+4최근 7일 스타 변화
  • Stable-Retro@Farama-Foundation

    추가 게임, 에뮬레이터 및 지원 플랫폼을 포함한 gym-retro 포크

    1,079+396최근 7일 스타 변화
  • 오프라인 강화학습(offline-rl) 알고리즘 색인입니다.

    1,078+3최근 7일 스타 변화
  • sumo-rl@LucasAlegre

    SUMO를 이용한 교통 신호 제어용 강화 학습 환경. Gymnasium, PettingZoo 및 주요 RL 라이브러리와 호환됩니다.

    1,074+3최근 7일 스타 변화
  • Books@Rishabh-creator601

    다양한 프로그래밍 분야의 도서 / PDF / EPUB 모음. 읽고, 성장하고, 즐기세요 😊😊😊😊

    1,065+5최근 7일 스타 변화
  • AI/ML/DL/CV 트렌드를 따라잡기 위한 필수 가이드

    1,063+0최근 7일 스타 변화
  • judgeval@JudgmentLabs

    에이전트를 위한 지속적 개선 스택. 환경 데이터와 평가(eval)를 통해 에이전트의 성능 향상과 모니터링을 지원합니다.

    1,060+2최근 7일 스타 변화
  • Online-3D-BPP-PCT@alexfrom0815

    "Learning Efficient Online 3D Bin Packing on Packing Configuration Trees"의 코드 구현. 계층적 패킹 구성 트리를 통한 학습을 통해 온라인 3D 적재 문제(BPP)의 실용적용성을 향상시키며, 이를 통해 심층 강화학습(DRL) 모델이 실제 제약 조건을 쉽게 처리하고 연속적인 솔루션 공간에서도 우수한 성능을 발휘하도록 합니다.

    1,047+1최근 7일 스타 변화
  • Agent 엔지니어를 위한 완벽 학습 로드맵 · AI 엔지니어링 마스터를 위한 20단계 503개 강의 · 중국어 번역 및 전용 사이트, 애니메이션 강의 영상 제공 · AI Agent 엔지니어가 되기 위한 가이드

    1,043+40최근 7일 스타 변화
  • GPTSwarm@metauto-ai

    🐝 RL 및 프롬프트 최적화를 적용한 최초의 자기 개선 에이전트

    1,041+1최근 7일 스타 변화
  • rl-tools@rl-tools

    가장 빠른 심층 강화 학습 라이브러리

    1,033+3최근 7일 스타 변화
  • rl-book@ZhiqingXiao

    도서 "강화학습: 이론 및 Python 구현" 소스 코드

    1,033+3최근 7일 스타 변화
  • rl-mpc-locomotion@silvery107

    사족보행 로봇 이동 제어를 위한 MPC용 Deep RL

    1,024+3최근 7일 스타 변화
  • sample-factory@alex-petrenko

    고처리량 동기 및 비동기 강화 학습

    1,021+0최근 7일 스타 변화
  • DeepRec@imsheridan

    추천 및 광고 분야의 산업계 고전 및 최신 논문·자료 모음

    1,016+0최근 7일 스타 변화
  • overcooked_ai@HumanCompatibleAI

    완전 협력적 인간-AI 성능을 위한 벤치마크 환경.

    1,003+5최근 7일 스타 변화
  • 다중 에이전트 강화학습(Multi-Agent Reinforcement Learning) 관련 유용한 게임 AI 자료 모음

    979+2최근 7일 스타 변화
  • Step-Audio-EditX@stepfun-ai

    감정, 화법, 준언어 편집에 탁월하며 강력한 제로샷 음성 합성(TTS) 기능을 갖춘 강력한 3B 파라미터 LLM 기반 강화 학습 오디오 편집 모델

    972+1최근 7일 스타 변화
  • verl-omni@verl-project

    디퓨전 및 옴니 모델을 위한 멀티모달 RL 학습 프레임워크

    968+64최근 7일 스타 변화
  • Gymnasium-Robotics@Farama-Foundation

    강화 학습을 위한 로봇 시뮬레이션 환경 모음입니다.

    963+1최근 7일 스타 변화
  • 머신러닝 오픈소스 대학교

    955+0최근 7일 스타 변화
  • 생성형 AI 및 딥러닝을 이용한 분자 및 소재 설계 목록

    952+1최근 7일 스타 변화
  • AgileRL@AgileRL

    RLOps를 통한 강화학습 간소화. 진화형 하이퍼파라미터 최적화를 통해 10배 더 빠른 학습을 제공하는 최첨단 RL 알고리즘 및 툴.

    951+5최근 7일 스타 변화
  • Shimmy@Farama-Foundation

    PettingZoo and Gymnasium bindings for popular reinforcement learning environments outside of Farama

    947최근 7일 스타 변화
  • GibsonEnv@StanfordVL

    Gibson 환경: 체화된 에이전트를 위한 현실 세계 인지

    947+1최근 7일 스타 변화
  • mushroom-rl@MushroomRL

    강화학습을 위한 Python 라이브러리

    944+0최근 7일 스타 변화
← 토픽 목록으로