跳到主要內容
buildradar
Sign in
主題 · pretraining

pretraining

標記 pretraining 主題、收錄中的開源專案,依星數排序。

專案數
19
總星數
142,318
平均星數
7,490
佔比
0.01%

常跟 pretraining 一起出現在同一個專案上的主題。

近期新秀

近 90 天內建立、標記 pretraining 主題的專案。

  • OpenWAM@OpenWAM-Official

    Official repository for "OpenWAM: An Open, Modular Exploration Towards Systematic World–Action Model Pretraining".

    151
  • LLMs-from-scratch@rasbt

    從頭開始、一步步在 PyTorch 中實作類似 ChatGPT 的大型語言模型

    104,229+219近 7 天星數變化
  • Llama-Chinese@LlamaChinese

    Llama中文社区,实时汇总最新Llama学习资料,构建最好的中文Llama大模型开源生态,完全开源可商用

    14,743+3近 7 天星數變化
  • LMOps@microsoft

    通用技術,為 AI 能力提供 LLM 與 MLLM 支援

    4,465-1近 7 天星數變化
  • OFA@OFA-Sys

    OFA (ICML 2022) 官方儲存庫。論文:OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2,557+0近 7 天星數變化
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl:強大的多模態大型語言模型系列

    2,539+0近 7 天星數變化
  • HRM-Text@sapientinc

    HRM-Text 是一個基於 HRM 架構的 1B 文字生成模型,透過任務完成與潛在空間推理能力進行強化。

    1,938+24近 7 天星數變化
  • 關於圖神經網路 (GNN) 預訓練與自監督學習的論文。

    1,728+0近 7 天星數變化
  • SparK@keyu-tian

    [ICLR'23 Spotlight🔥] 首次在卷積網路中成功進行 BERT/MAE 風格的預訓練;「Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling」的 PyTorch 實作。

    1,376+0近 7 天星數變化
  • GraphGen@InternScience

    GraphGen:透過知識驅動的合成資料生成增強大型語言模型的監督微調

    1,216+2近 7 天星數變化
  • Uni-Mol@deepmodeling

    Uni-Mol 系列方法的官方儲存庫

    1,159+3近 7 天星數變化
  • 大規模深度遞歸語言模型的預訓練與推論程式碼

    942+31近 7 天星數變化
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】透過基於語言的語意對齊將視訊語言預訓練擴展至 N 模態

    885+0近 7 天星數變化
  • 受 awesome-computer-vision 啟發,精選大模型(即 LLM/VLM)時代下與機器人領域相關的 3D 視覺論文清單,包含論文、程式碼及相關網站

    822+2近 7 天星數變化
  • MARS@AGI-Arena

    MARS 官方實作:釋放變異數縮減的力量以訓練大型模型

    722+0近 7 天星數變化
  • MPP-LLaVA@Coobiw

    個人專案:MPP-Qwen14B & MPP-Qwen-Next(基於 Qwen-LM 的多模態管線並行)。支援 [影片/圖片/多圖] {微調/對話}。別讓貧窮限制您的想像力!在 RTX3090/4090 24GB 上訓練您自己的 8B/14B LLaVA 風格 MLLM。

    687+0近 7 天星數變化
  • Craw4LLM@cxcscmu

    「Craw4LLM: Efficient Web Crawling for LLM Pretraining」官方儲存庫

    664+1近 7 天星數變化
  • SaProt@westlake-repl

    Saprot:帶有結構字母表的蛋白質語言模型(AA+3Di)

    629+2近 7 天星數變化
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15近 7 天星數變化
  • PITI@PITI-Synthesis

    PITI:影像對影像轉換所需的預訓練模型

    502+0近 7 天星數變化
← 返回主題列表