reinforcement-learning
reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #211
강화학습을 위한 Python 라이브러리
★ 944+0최근 7일 스타 변화 - #212★ 936+17최근 7일 스타 변화
- #213★ 934+2최근 7일 스타 변화
- #214
Multi-Agent Resource Optimization (MARO) 플랫폼은 실제 리소스 최적화 문제를 해결하기 위한 Reinforcement Learning as a Service (RaaS) 구현체입니다.
★ 923+2최근 7일 스타 변화 - #215★ 920+23최근 7일 스타 변화
- #216
확산 모델(Diffusion model) 주제 학습을 위한 핵심 논문 및 블로그 요약. 발표된 모든 확산 로보틱스 논문의 상세 목록.
★ 920+1최근 7일 스타 변화 - #217
학습 기반 제어 및 RL을 위한 PyBullet CartPole 및 Quadrotor 환경 (CasADi 심볼릭 사전 동역학 포함)
★ 917+4최근 7일 스타 변화 - #218
Decision Transformer 리소스 모음 (지속적으로 업데이트됨)
★ 916+0최근 7일 스타 변화 - #219
👉 자습서, 블로그, 코드 등 CARLA 리소스 https://github.com/carla-simulator/carla
★ 915-1최근 7일 스타 변화 - #220★ 905+1최근 7일 스타 변화
- #221★ 900+1최근 7일 스타 변화
- #222
Deep Reinforcement Learning 관련 유용한 리소스 모음
★ 900+1최근 7일 스타 변화 - #223★ 900+0최근 7일 스타 변화
- #224
Tien Kung-Lab: 보행 로봇을 위한 Direct IsaacLab 워크플로
★ 883+11최근 7일 스타 변화 - #225★ 861+2최근 7일 스타 변화
- #226★ 853+3최근 7일 스타 변화
- #227★ 850+0최근 7일 스타 변화
- #228★ 848+3최근 7일 스타 변화
- #229★ 841+0최근 7일 스타 변화
- #230
머신러닝, 딥러닝, 생성형 AI, NLP 및 데이터 과학을 아우르는 고품질 AI 도구, API, 데이터셋 및 학습 리소스 모음입니다. 개발자, 연구자 및 크리에이터가 AI를 활용해 더 빠르게 개발할 수 있도록 돕습니다.
★ 841+27최근 7일 스타 변화 - #231
Contextual Bandits 알고리즘의 Python 구현체
★ 839+0최근 7일 스타 변화 - #232
LLM, VLM, VLA, AIGC 관련 데이터셋 및 애플리케이션을 다루는 우수한 공개 프로젝트 모음
★ 815+1최근 7일 스타 변화 - #233
안전한 강화 학습 베이스라인을 위한 저장소
★ 813+0최근 7일 스타 변화 - #234
멋진 NVIDIA Isaac Gym 프레임워크, 논문, 소프트웨어 및 리소스 모음
★ 797+2최근 7일 스타 변화 - #235
대형 언어 모델의 온폴리시 증류(OPD)를 위한 논문, 기술 보고서, 프레임워크 및 도구 모음
★ 794+31최근 7일 스타 변화 - #236
MobileGym: 모바일 GUI 에이전트 연구를 위한 검증 가능하고 고도로 병렬화된 시뮬레이션 플랫폼 · 브라우저에서 실행되는 안드로이드 시뮬레이터 · Browser-hosted Android Simulator · 검증 가능한 평가 · 확장 가능한 온라인 RL 학습
★ 786+10최근 7일 스타 변화 - #237★ 778+15최근 7일 스타 변화
- #238
Julia의 MDP 및 POMDP - 이산 및 연속 공간에서 완전 및 부분 관측 가능한 마르코프 결정 과정을 정의, 해결 및 시뮬레이션하기 위한 인터페이스입니다.
★ 766+1최근 7일 스타 변화 - #239★ 765+1최근 7일 스타 변화
- #240
자율 에이전트 구축에 관한 최신 논문 모음. RL 기반 및 LLM 기반 에이전트 주제 포함.
★ 760+3최근 7일 스타 변화