본문으로 건너뛰기
buildradar
Sign in
토픽 · reinforcement-learning

reinforcement-learning

reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 305개
  • mushroom-rl@MushroomRL

    강화학습을 위한 Python 라이브러리

    944+0최근 7일 스타 변화
  • UniRL@Tencent-Hunyuan

    통합 멀티모달 모델 강화 학습을 위한 프레임워크 UniRL

    936+17최근 7일 스타 변화
  • Mava@instadeepai

    🦁 JAX에서 다중 에이전트 강화 학습의 빠른 실험을 위한 연구 친화적인 코드베이스

    934+2최근 7일 스타 변화
  • maro@microsoft

    Multi-Agent Resource Optimization (MARO) 플랫폼은 실제 리소스 최적화 문제를 해결하기 위한 Reinforcement Learning as a Service (RaaS) 구현체입니다.

    923+2최근 7일 스타 변화
  • UniLab@Motphys

    UniLab: GPU 중심 패러다임을 넘어선 로봇 RL을 위한 이기종 아키텍처

    920+23최근 7일 스타 변화
  • 확산 모델(Diffusion model) 주제 학습을 위한 핵심 논문 및 블로그 요약. 발표된 모든 확산 로보틱스 논문의 상세 목록.

    920+1최근 7일 스타 변화
  • safe-control-gym@learnsyslab

    학습 기반 제어 및 RL을 위한 PyBullet CartPole 및 Quadrotor 환경 (CasADi 심볼릭 사전 동역학 포함)

    917+4최근 7일 스타 변화
  • Decision Transformer 리소스 모음 (지속적으로 업데이트됨)

    916+0최근 7일 스타 변화
  • 👉 자습서, 블로그, 코드 등 CARLA 리소스 https://github.com/carla-simulator/carla

    915-1최근 7일 스타 변화
  • hok_env@tencent-ailab

    텐센트의 왕자영요 AI 오픈 환경

    905+1최근 7일 스타 변화
  • rl4co@ai4co

    조합 최적화(CO)를 위한 강화학습(RL) 관련 모든 기능을 제공하는 PyTorch 라이브러리

    900+1최근 7일 스타 변화
  • Deep Reinforcement Learning 관련 유용한 리소스 모음

    900+1최근 7일 스타 변화
  • iris@eloialonso

    Transformers는 샘플 효율적인 월드 모델임. ICLR 2023 상위 5% 선정

    900+0최근 7일 스타 변화
  • TienKung-Lab@Open-X-Humanoid

    Tien Kung-Lab: 보행 로봇을 위한 Direct IsaacLab 워크플로

    883+11최근 7일 스타 변화
  • jumanji@instadeepai

    🕹️ JAX 기반의 확장 가능한 다양한 강화 학습 환경 모음

    861+2최근 7일 스타 변화
  • REINVENT4@MolecularAI

    드 노보(de novo) 설계, 스캐폴드 호핑, R-그룹 교체, 링커 설계 및 분자 최적화를 위한 AI 분자 설계 도구

    853+3최근 7일 스타 변화
  • humanplus@MarkFzp

    [CoRL 2024] HumanPlus: 휴머노이드 섀도잉 및 인간 모방 학습

    850+0최근 7일 스타 변화
  • JaxMARL@bold-lab-ai

    JAX를 활용한 멀티 에이전트 강화학습

    848+3최근 7일 스타 변화
  • openrl@OpenRL-Lab

    통합 강화 학습 프레임워크

    841+0최근 7일 스타 변화
  • 머신러닝, 딥러닝, 생성형 AI, NLP 및 데이터 과학을 아우르는 고품질 AI 도구, API, 데이터셋 및 학습 리소스 모음입니다. 개발자, 연구자 및 크리에이터가 AI를 활용해 더 빠르게 개발할 수 있도록 돕습니다.

    841+27최근 7일 스타 변화
  • contextualbandits@david-cortes

    Contextual Bandits 알고리즘의 Python 구현체

    839+0최근 7일 스타 변화
  • LLM, VLM, VLA, AIGC 관련 데이터셋 및 애플리케이션을 다루는 우수한 공개 프로젝트 모음

    815+1최근 7일 스타 변화
  • 안전한 강화 학습 베이스라인을 위한 저장소

    813+0최근 7일 스타 변화
  • awesome-isaac-gym@robotlearning123

    멋진 NVIDIA Isaac Gym 프레임워크, 논문, 소프트웨어 및 리소스 모음

    797+2최근 7일 스타 변화
  • 대형 언어 모델의 온폴리시 증류(OPD)를 위한 논문, 기술 보고서, 프레임워크 및 도구 모음

    794+31최근 7일 스타 변화
  • mobilegym@Purewhiter

    MobileGym: 모바일 GUI 에이전트 연구를 위한 검증 가능하고 고도로 병렬화된 시뮬레이션 플랫폼 · 브라우저에서 실행되는 안드로이드 시뮬레이터 · Browser-hosted Android Simulator · 검증 가능한 평가 · 확장 가능한 온라인 RL 학습

    786+10최근 7일 스타 변화
  • BFM-Zero@LeCAR-Lab

    BFM_Zero: 비지도 강화 학습을 활용한 휴머노이드 제어용 프롬프트 기반 행동 파운데이션 모델

    778+15최근 7일 스타 변화
  • POMDPs.jl@JuliaPOMDP

    Julia의 MDP 및 POMDP - 이산 및 연속 공간에서 완전 및 부분 관측 가능한 마르코프 결정 과정을 정의, 해결 및 시뮬레이션하기 위한 인터페이스입니다.

    766+1최근 7일 스타 변화
  • panda-gym@qgallouedec

    PyBullet 물리 엔진과 gymnasium을 기반으로 하는 로보틱스 환경 세트.

    765+1최근 7일 스타 변화
  • 자율 에이전트 구축에 관한 최신 논문 모음. RL 기반 및 LLM 기반 에이전트 주제 포함.

    760+3최근 7일 스타 변화
← 토픽 목록으로