본문으로 건너뛰기
buildradar
Sign in
토픽 · reinforcement-learning

reinforcement-learning

reinforcement-learning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 305개
  • vowpal_wabbit@VowpalWabbit

    Vowpal Wabbit은 온라인 학습, 해싱, allreduce, reductions, learning2search, 액티브 및 인터랙티브 학습 등의 기법으로 머신러닝의 한계를 넓히는 머신러닝 시스템입니다.

    8,708+2최근 7일 스타 변화
  • pysc2@google-deepmind

    스타크래프트 II 학습 환경

    8,309+2최근 7일 스타 변화
  • PaLM-rlhf-pytorch@lucidrains

    PaLM 아키텍처 기반의 RLHF(인간 피드백 기반 강화학습) 구현. 기본적으로 PaLM을 사용한 ChatGPT와 유사함

    7,866-1최근 7일 스타 변화
  • maths-cs-ai-compendium@HenryNdubuaku

    직관을 바탕으로 수학, 컴퓨팅, ML을 다루는 파격적인 교과서를 통해 뛰어난 AI/ML 연구원/엔지니어되기

    7,400+21최근 7일 스타 변화
  • 멀티모달 머신러닝 연구 주제를 위한 독서 목록

    6,926+1최근 7일 스타 변화
  • OpenAI o1 🍓 및 추론 기법에 중점을 둔 LLM 논문, 블로그, 프로젝트 모음

    6,902+3최근 7일 스타 변화
  • Practical_RL@yandexdataschool

    실전 강화 학습 강좌

    6,566+0최근 7일 스타 변화
  • 🔬 금융 시장의 유용한 LLM 및 딥러닝 전략과 도구 모음

    6,475+23최근 7일 스타 변화
  • Mooncake@kvcache-ai

    Mooncake은 Moonshot AI가 제공하는 선도적인 LLM 서비스 Kimi의 서빙 플랫폼입니다.

    6,470+40최근 7일 스타 변화
  • 유용한 자기지도 학습 방법 모음

    6,414+1최근 7일 스타 변화
  • PufferLib@PufferAI

    강화학습 성능 향상

    6,321+8최근 7일 스타 변화
  • VLM-R1@om-ai-lab

    강화된 VLM을 통한 시각적 이해 해결

    6,018+4최근 7일 스타 변화
  • rllm@rllm-org

    LLM을 위한 강화 학습의 대중화

    5,813+5최근 7일 스타 변화
  • AReaL@areal-project

    LLM 기반 Agent 애플리케이션을 위한 RL 브리지. 간단하고 유연하게 구현되었습니다.

    5,712+9최근 7일 스타 변화
  • open_spiel@google-deepmind

    OpenSpiel은 일반 강화학습 및 게임 내 탐색/계획 연구를 위한 환경 및 알고리즘 모음입니다.

    5,452+8최근 7일 스타 변화
  • STEM, 코딩 및 로봇 공학 교육, IoT 로봇 애플리케이션, AI 강화 로봇 애플리케이션 서비스, 연구, DIY 로봇 키트 개발에 적합한 Boston Dynamics 스타일의 4족 보행 로봇을 개발하기 위한 오픈 소스 4족 보행 로봇 펫 프레임워크입니다.

    5,246+15최근 7일 스타 변화
  • xtuner@InternLM

    초대형 MoE 모델을 위해 구축된 차세대 학습 엔진

    5,188+3최근 7일 스타 변화
  • deep-reinforcement-learning@udacity

    심층 강화 학습(Deep Reinforcement Learning) 나노degree 프로그램 저장소

    5,176+0최근 7일 스타 변화
  • EasyR1@hiyouga

    EasyR1: veRL 기반의 효율적이고 확장 가능한 멀티모달 RL 학습 프레임워크

    5,141+5최근 7일 스타 변화
  • reasoning-from-scratch@rasbt

    PyTorch로 처음부터 단계별로 추론 LLM 구현하기

    5,138+49최근 7일 스타 변화
  • deep-rl-class@huggingface

    이 저장소는 Hugging Face Deep Reinforcement Learning Course를 포함합니다.

    5,006+10최근 7일 스타 변화
  • LLM-RL-Visualized@changyeyu

    🌟100개 이상의 오리지널 LLM / RL 원리 다이어그램📚, '대형 모델 알고리즘' 저자의 역작!💥 (100개 이상의 LLM/RL 알고리즘 맵)

    4,838+12최근 7일 스타 변화
  • trlx@CarperAI

    인간 피드백 기반 강화학습(RLHF)을 통한 언어 모델 분산 학습 리포지토리

    4,754-1최근 7일 스타 변화
  • RLinf@RLinf

    RLinf: 체화 및 에이전트 AI를 위한 강화학습 인프라

    4,705+31최근 7일 스타 변화
  • dm_control@google-deepmind

    MuJoCo를 사용하는 물리 기반 시뮬레이션 및 강화학습 환경을 위한 Google DeepMind의 소프트웨어 스택

    4,681+6최근 7일 스타 변화
  • DouZero@kwai

    [ICML 2021] DouZero: 셀프 플레이 심층 강화학습을 통한 斗地主(두지주) 마스터하기 | 두지주 AI

    4,659+5최근 7일 스타 변화
  • alpha-zero-general@suragnair

    모든 프레임워크와 게임에 적용 가능한 AlphaZero 기반의 깔끔한 구현체 + 튜토리얼 + 오델로/오목/틱택토/네트워크4 등 포함

    4,512+5최근 7일 스타 변화
  • awesome-RLHF@opendilab

    인간 피드백 기반 강화 학습(RLHF) 리소스 모음 (지속 업데이트)

    4,424+2최근 7일 스타 변화
  • ElegantRL@AI4Finance-Foundation

    대규모 병렬 심층 강화학습. 🔥

    4,359+2최근 7일 스타 변화
  • hands-on-modern-rl@walkinglabs

    🚀 기초 RL 개념부터 LLM 정렬, RLVR, 고급 Agentic 시스템까지의 간극을 메우는 오픈소스 실습 커리큘럼

    4,199+54최근 7일 스타 변화
← 토픽 목록으로