reinforcement-learning
reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
Vowpal Wabbit은 온라인 학습, 해싱, allreduce, reductions, learning2search, 액티브 및 인터랙티브 학습 등의 기법으로 머신러닝의 한계를 넓히는 머신러닝 시스템입니다.
★ 8,708+2최근 7일 스타 변화 - #32★ 8,309+2최근 7일 스타 변화
- #33
PaLM 아키텍처 기반의 RLHF(인간 피드백 기반 강화학습) 구현. 기본적으로 PaLM을 사용한 ChatGPT와 유사함
★ 7,866-1최근 7일 스타 변화 - #34
직관을 바탕으로 수학, 컴퓨팅, ML을 다루는 파격적인 교과서를 통해 뛰어난 AI/ML 연구원/엔지니어되기
★ 7,400+21최근 7일 스타 변화 - #35
멀티모달 머신러닝 연구 주제를 위한 독서 목록
★ 6,926+1최근 7일 스타 변화 - #36
OpenAI o1 🍓 및 추론 기법에 중점을 둔 LLM 논문, 블로그, 프로젝트 모음
★ 6,902+3최근 7일 스타 변화 - #37
실전 강화 학습 강좌
★ 6,566+0최근 7일 스타 변화 - #38
🔬 금융 시장의 유용한 LLM 및 딥러닝 전략과 도구 모음
★ 6,475+23최근 7일 스타 변화 - #39★ 6,470+40최근 7일 스타 변화
- #40
유용한 자기지도 학습 방법 모음
★ 6,414+1최근 7일 스타 변화 - #41★ 6,321+8최근 7일 스타 변화
- #42★ 6,018+4최근 7일 스타 변화
- #43★ 5,813+5최근 7일 스타 변화
- #44★ 5,712+9최근 7일 스타 변화
- #45
OpenSpiel은 일반 강화학습 및 게임 내 탐색/계획 연구를 위한 환경 및 알고리즘 모음입니다.
★ 5,452+8최근 7일 스타 변화 - #46
STEM, 코딩 및 로봇 공학 교육, IoT 로봇 애플리케이션, AI 강화 로봇 애플리케이션 서비스, 연구, DIY 로봇 키트 개발에 적합한 Boston Dynamics 스타일의 4족 보행 로봇을 개발하기 위한 오픈 소스 4족 보행 로봇 펫 프레임워크입니다.
★ 5,246+15최근 7일 스타 변화 - #47★ 5,188+3최근 7일 스타 변화
- #48
심층 강화 학습(Deep Reinforcement Learning) 나노degree 프로그램 저장소
★ 5,176+0최근 7일 스타 변화 - #49★ 5,141+5최근 7일 스타 변화
- #50
PyTorch로 처음부터 단계별로 추론 LLM 구현하기
★ 5,138+49최근 7일 스타 변화 - #51
이 저장소는 Hugging Face Deep Reinforcement Learning Course를 포함합니다.
★ 5,006+10최근 7일 스타 변화 - #52
🌟100개 이상의 오리지널 LLM / RL 원리 다이어그램📚, '대형 모델 알고리즘' 저자의 역작!💥 (100개 이상의 LLM/RL 알고리즘 맵)
★ 4,838+12최근 7일 스타 변화 - #53★ 4,754-1최근 7일 스타 변화
- #54★ 4,705+31최근 7일 스타 변화
- #55
MuJoCo를 사용하는 물리 기반 시뮬레이션 및 강화학습 환경을 위한 Google DeepMind의 소프트웨어 스택
★ 4,681+6최근 7일 스타 변화 - #56★ 4,659+5최근 7일 스타 변화
- #57
모든 프레임워크와 게임에 적용 가능한 AlphaZero 기반의 깔끔한 구현체 + 튜토리얼 + 오델로/오목/틱택토/네트워크4 등 포함
★ 4,512+5최근 7일 스타 변화 - #58
인간 피드백 기반 강화 학습(RLHF) 리소스 모음 (지속 업데이트)
★ 4,424+2최근 7일 스타 변화 - #59★ 4,359+2최근 7일 스타 변화
- #60
🚀 기초 RL 개념부터 LLM 정렬, RLVR, 고급 Agentic 시스템까지의 간극을 메우는 오픈소스 실습 커리큘럼
★ 4,199+54최근 7일 스타 변화