メインコンテンツへスキップ
buildradar
Sign in
トピック · pretraining

pretraining

pretraining がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

リポジトリ
19
総スター数
142,049
平均スター数
7,476
シェア
0.01%

pretraining と同じリポジトリに頻繁に登場するトピック。

最近の急上昇

直近 90 日以内に作成され、pretraining がタグ付けされたリポジトリ。

直近 90 日以内に、このトピックがタグ付けされた新しいリポジトリはありません。

  • LLMs-from-scratch@rasbt

    PyTorchでChatGPTライクなLLMをゼロから段階的に実装。

    104,010+820直近 7 日のスター増減
  • Llama-Chinese@LlamaChinese

    Llama中国コミュニティ。最新のLlama学習資料をリアルタイムで集約し、完全オープンソースで商用利用可能な最高の中国語Llama大規模モデルエコシステムを構築。

    14,740+1直近 7 日のスター増減
  • LMOps@microsoft

    LLMおよびMLLMによるAI機能を有効にするための一般技術

    4,466+1直近 7 日のスター増減
  • OFA@OFA-Sys

    OFA (ICML 2022) の公式リポジトリ。論文: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2,557+0直近 7 日のスター増減
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl:強力なマルチモーダル大規模言語モデルファミリ

    2,539+0直近 7 日のスター増減
  • HRM-Text@sapientinc

    HRM-Textは、HRMアーキテクチャに基づく1Bのテキスト生成モデルであり、タスク完了能力と潜在空間推論によって強化されています。

    1,919+43直近 7 日のスター増減
  • グラフニューラルネットワーク(GNN)の事前学習および自己教師あり学習に関する論文集

    1,728+0直近 7 日のスター増減
  • SparK@keyu-tian

    [ICLR'23 Spotlight🔥] 任意の畳み込みネットワークにおける初のBERT/MAEスタイル事前学習の成功例。「Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling」のPyTorch実装

    1,376-1直近 7 日のスター増減
  • GraphGen@InternScience

    GraphGen: 知識駆動型の合成データ生成による LLM の教師ありファインチューニングの強化

    1,214+5直近 7 日のスター増減
  • Uni-Mol@deepmodeling

    Uni-Mol シリーズ手法の公式リポジトリ

    1,157+5直近 7 日のスター増減
  • 大規模な深度リカレント言語モデルのための事前学習および推論コード

    911+0直近 7 日のスター増減
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】言語ベースのセマンティックアライメントによる、ビデオ言語事前学習のNモダリティへの拡張

    885+0直近 7 日のスター増減
  • 大規模モデル(LLM/VLM)時代におけるロボット工学分野に関連する3Dビジョン論文の厳選リスト。awesome-computer-visionにインスパイアされ、論文、コード、関連ウェブサイトを含む。

    820+0直近 7 日のスター増減
  • MARS@AGI-Arena

    MARS: 大規模モデルのトレーニングにおける分散削減の威力を最大限に引き出す公式実装

    722+0直近 7 日のスター増減
  • MPP-LLaVA@Coobiw

    個人プロジェクト: MPP-Qwen14B & MPP-Qwen-Next(Qwen-LMに基づくマルチモーダルパイプライン並列化)。[動画/画像/複数画像]の{sft/会話}をサポート。貧困に想像力を制限されないようにしよう!RTX3090/4090 24GBで独自の8B/14B LLaVA形式のMLLMをトレーニング。

    686+2直近 7 日のスター増減
  • Craw4LLM@cxcscmu

    「Craw4LLM: Efficient Web Crawling for LLM Pretraining」の公式リポジトリ

    664+1直近 7 日のスター増減
  • SaProt@westlake-repl

    Saprot: 構造アルファベットを持つタンパク質言語モデル (AA+3Di)

    626+4直近 7 日のスター増減
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    538直近 7 日のスター増減
  • PITI@PITI-Synthesis

    PITI: 画像間変換には事前学習のすべてが必要である

    502+0直近 7 日のスター増減
← トピック一覧に戻る