メインコンテンツへスキップ
buildradar
Sign in
トピック · reinforcement-learning

reinforcement-learning

reinforcement-learning がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

304 件のリポジトリ
  • vowpal_wabbit@VowpalWabbit

    Vowpal Wabbitは、オンライン、ハッシュ化、allreduce、削減、learning2search、アクティブ、インタラクティブ学習などの技術により、機械学習の最前線を押し進める機械学習システム。

    8,708+2直近 7 日のスター増減
  • pysc2@google-deepmind

    StarCraft II 学習環境

    8,309+2直近 7 日のスター増減
  • PaLM-rlhf-pytorch@lucidrains

    PaLMアーキテクチャ上に実装されたRLHF (Reinforcement Learning with Human Feedback)。基本的にChatGPTだがPaLMを使用している。

    7,866-1直近 7 日のスター増減
  • maths-cs-ai-compendium@HenryNdubuaku

    この型破りな教科書で、直感的な数学、コンピューティング、MLを網羅し、AI/MLの研究者/エンジニアになる。

    7,400+21直近 7 日のスター増減
  • マルチモーダル機械学習の研究トピックに関する読書リスト

    6,926+1直近 7 日のスター増減
  • OpenAI o1 🍓および推論技術に焦点を当てた、LLMの論文、ブログ、プロジェクトのコレクション

    6,902+3直近 7 日のスター増減
  • Practical_RL@yandexdataschool

    実環境における強化学習のコース

    6,566+0直近 7 日のスター増減
  • 🔬 金融市場における素晴らしいLLM、深層学習戦略、ツールの厳選リスト。

    6,475+23直近 7 日のスター増減
  • Mooncake@kvcache-ai

    Mooncakeは、Moonshot AIが提供する主要なLLMサービスKimiの提供プラットフォームです。

    6,470+40直近 7 日のスター増減
  • 素晴らしい自己教師あり学習手法の厳選リスト。

    6,414+1直近 7 日のスター増減
  • PufferLib@PufferAI

    強化学習の強化(膨らませる)

    6,321+8直近 7 日のスター増減
  • VLM-R1@om-ai-lab

    強化学習されたVLMによる視覚理解を解決する

    6,018+4直近 7 日のスター増減
  • rllm@rllm-org

    LLMのための強化学習の民主化

    5,813+5直近 7 日のスター増減
  • AReaL@areal-project

    LLMベースのエージェントアプリケーションのためのRL Bridge。シンプルかつ柔軟に設計されています。

    5,712+9直近 7 日のスター増減
  • open_spiel@google-deepmind

    OpenSpielは、一般的な強化学習およびゲームにおける探索/計画の研究のための環境とアルゴリズムのコレクションです。

    5,452+8直近 7 日のスター増減
  • Boston Dynamicsスタイルの四足ロボットを開発するためのオープンソースの四足ロボットペットフレームワーク。STEM、コーディング&ロボティクス教育、IoTロボティクスアプリケーション、AI強化型ロボティクスアプリケーションサービス、研究、DIYロボティクスキット開発に最適です。

    5,246+15直近 7 日のスター増減
  • xtuner@InternLM

    超大規模MoEモデル向けに構築された次世代トレーニングエンジン

    5,188+3直近 7 日のスター増減
  • deep-reinforcement-learning@udacity

    Deep Reinforcement Learning NanoDegreeプログラムのリポジトリ

    5,176+0直近 7 日のスター増減
  • EasyR1@hiyouga

    EasyR1: veRLに基づいた、効率的でスケーラブルなマルチモーダルRLトレーニングフレームワーク

    5,141+5直近 7 日のスター増減
  • reasoning-from-scratch@rasbt

    PyTorchで推論LLMをゼロから、ステップバイステップで実装。

    5,138+49直近 7 日のスター増減
  • deep-rl-class@huggingface

    このリポジトリには、Hugging Faceの深層強化学習コースが含まれています。

    5,006+10直近 7 日のスター増減
  • LLM-RL-Visualized@changyeyu

    🌟100以上のオリジナルLLM/RL原理図📚、『大模型算法』著者による豪華提供!💥(100+ LLM/RL Algorithm Maps)

    4,838+12直近 7 日のスター増減
  • trlx@CarperAI

    人間からのフィードバックによる強化学習 (RLHF) を用いた言語モデルの分散学習のためのリポジトリ

    4,754-1直近 7 日のスター増減
  • RLinf@RLinf

    RLinf: 具現化されたエージェンシーAIのための強化学習インフラストラクチャ

    4,705+31直近 7 日のスター増減
  • dm_control@google-deepmind

    Google DeepMindによる、MuJoCoを使用した物理ベースシミュレーションおよび強化学習環境のためのソフトウェアスタック。

    4,681+6直近 7 日のスター増減
  • DouZero@kwai

    [ICML 2021] DouZero: 自己対戦型深層強化学習によるDouDizhuの習得 | 斗地主AI

    4,659+5直近 7 日のスター増減
  • alpha-zero-general@suragnair

    AlphaZeroに基づいた、あらゆるフレームワークのあらゆるゲームに対応したクリーンな実装 + チュートリアル + Othello/Gobang/TicTacToe/Connect4など

    4,512+5直近 7 日のスター増減
  • awesome-RLHF@opendilab

    人間フィードバックによる強化学習(Reinforcement Learning with Human Feedback)のリソースを厳選したリスト(継続的に更新中)。

    4,424+2直近 7 日のスター増減
  • ElegantRL@AI4Finance-Foundation

    大規模並列深層強化学習 🔥

    4,359+2直近 7 日のスター増減
  • hands-on-modern-rl@walkinglabs

    🚀 基本的なRLの概念からLLMアライメント、RLVR、高度なエージェンティックシステムへのギャップを埋めるオープンソースの実践的カリキュラム

    4,199+54直近 7 日のスター増減
← トピック一覧に戻る