본문으로 건너뛰기
buildradar
Sign in
토픽 · reinforcement-learning-algorithms

reinforcement-learning-algorithms

reinforcement-learning-algorithms 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
21
총 스타
39,604
평균 스타
1,886
비중
0.00%

같은 리포지토리에 reinforcement-learning-algorithms 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 reinforcement-learning-algorithms 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • 강화학습 알고리즘의 신뢰할 수 있는 구현체인 Stable Baselines의 PyTorch 버전

    13,758+21최근 7일 스타 변화
  • deep-reinforcement-learning@udacity

    심층 강화 학습(Deep Reinforcement Learning) 나노degree 프로그램 저장소

    5,176+0최근 7일 스타 변화
  • DI-engine@opendilab

    OpenDILab 결정 AI 엔진. 가장 포괄적인 강화학습 프레임워크 B.P.

    3,642+1최근 7일 스타 변화
  • PPO-PyTorch@nikhilbarhate99

    PyTorch를 이용한 클리핑된 목적 함수 기반 PPO(Proximal Policy Optimization) 최소 구현

    2,381+6최근 7일 스타 변화
  • 엄선된 멋진 모델 기반 RL 리소스 목록(지속 업데이트)

    1,393+0최근 7일 스타 변화
  • PPO-for-Beginners@ericyangyu

    간단하고 스타일이 잘 적용된 PPO 구현. 내 Medium 시리즈 기반: https://medium.com/@eyyu/coding-ppo-from-scratch-with-pytorch-part-1-4-613dfc1b14c8.

    1,269+1최근 7일 스타 변화
  • ARPO@RUC-NLPIR

    [ICLR 2026] Agentic Reinforced Policy Optimization (ARPO)

    1,116+5최근 7일 스타 변화
  • purejaxrl@luchris429

    매우 빠른 엔드투엔드 Jax 강화학습 구현체

    1,103+2최근 7일 스타 변화
  • UI-Venus@inclusionAI

    UI-Venus는 스크린샷만을 입력으로 사용하여 정확한 GUI 요소 그라운딩과 효과적인 내비게이션을 수행하도록 설계된 네이티브 UI 에이전트입니다.

    1,037+23최근 7일 스타 변화
  • Decision Transformer 리소스 모음 (지속적으로 업데이트됨)

    916+0최근 7일 스타 변화
  • course-content-dl@NeuromatchAcademy

    NMA 딥러닝 코스

    812+1최근 7일 스타 변화
  • POMDPs.jl@JuliaPOMDP

    Julia의 MDP 및 POMDP - 이산 및 연속 공간에서 완전 및 부분 관측 가능한 마르코프 결정 과정을 정의, 해결 및 시뮬레이션하기 위한 인터페이스입니다.

    766+1최근 7일 스타 변화
  • stable-baselines3-contrib@Stable-Baselines-Team

    Stable-Baselines3용 기여 패키지 - 실험적 강화 학습(RL) 코드

    736+5최근 7일 스타 변화
  • UAV를 위한 심층 강화 학습 기반 자율 장애물 회피 알고리즘 프로젝트

    730+0최근 7일 스타 변화
  • disco_rl@google-deepmind

    Nature에 출판된 "Discovering State-of-the-art Reinforcement Algorithms" 논문 동반 코드

    728+2최근 7일 스타 변화
  • 탐색적 강화학습(Exploration RL) 리소스 큐레이션 목록 (지속 업데이트)

    723+0최근 7일 스타 변화
  • UAV-DDPG@fangvv

    UAV 보조 모바일 엣지 컴퓨팅을 위한 연산 오프로딩 최적화: 심층 결정론적 정책 경사 접근법 논문 코드

    722+1최근 7일 스타 변화
  • Rofunc@Skylark0924

    🤖 로봇 학습 및 로봇 조작을 위한 전체 프로세스 Python 패키지

    720+1최근 7일 스타 변화
  • 구현 코드가 포함된 몬테카를로 트리 탐색(MCTS) 논문 모음

    715+1최근 7일 스타 변화
  • 심층 강화 학습 에이전트 구축을 위한 PyTorch 라이브러리입니다.

    657+0최근 7일 스타 변화
  • dLLM-RL@Gen-Verse

    [ICLR 2026] TraceRL 공식 코드: Diffusion LLM의 사후 학습을 혁신하고 SOTA TraDo 시리즈를 구동함.

    520+1최근 7일 스타 변화
← 토픽 목록으로