跳到主要内容
buildradar
Sign in
主题 · pretraining

pretraining

标记 pretraining 主题、收录中的开源项目,按星标数排序。

项目数
19
总星标数
142,318
平均星标数
7,490
占比
0.01%

常跟 pretraining 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 pretraining 主题的项目。

  • OpenWAM@OpenWAM-Official

    Official repository for "OpenWAM: An Open, Modular Exploration Towards Systematic World–Action Model Pretraining".

    189
  • LLMs-from-scratch@rasbt

    从头开始、一步步在 PyTorch 中实现类似 ChatGPT 的大型语言模型

    104,229+219近 7 天星标变化
  • Llama-Chinese@LlamaChinese

    Llama中文社区,实时汇总最新Llama学习资料,构建最好的中文Llama大模型开源生态,完全开源可商用

    14,743+3近 7 天星标变化
  • LMOps@microsoft

    通用技术,为 AI 能力提供 LLM 与 MLLM 支援

    4,465-1近 7 天星标变化
  • OFA@OFA-Sys

    OFA (ICML 2022) 官方仓库。论文:OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2,557+0近 7 天星标变化
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl:强大的多模态大语言模型系列

    2,539+0近 7 天星标变化
  • HRM-Text@sapientinc

    HRM-Text 是一个基于 HRM 架构的 1B 文本生成模型,通过任务完成与潜在空间推理能力进行强化。

    1,938+24近 7 天星标变化
  • 关于图神经网络 (GNN) 预训练与自监督学习的论文。

    1,728+0近 7 天星标变化
  • SparK@keyu-tian

    [ICLR'23 Spotlight🔥] 首次在卷积网络中成功进行 BERT/MAE 风格的预训练;「Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling」的 PyTorch 实现。

    1,376+0近 7 天星标变化
  • GraphGen@InternScience

    GraphGen:通过知识驱动的合成数据生成增强大语言模型的监督微调

    1,216+2近 7 天星标变化
  • Uni-Mol@deepmodeling

    Uni-Mol 系列方法的官方仓库

    1,159+3近 7 天星标变化
  • 大规模深度递归语言模型的预训练与推理代码

    945+34近 7 天星标变化
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】通过基于语言的语义对齐将视频语言预训练扩展至 N 模态

    885+0近 7 天星标变化
  • 受 awesome-computer-vision 启发,精选大模型(即 LLM/VLM)时代下与机器人领域相关的 3D 视觉论文清单,包含论文、代码及相关网站

    822+3近 7 天星标变化
  • MARS@AGI-Arena

    MARS 官方实现:释放方差缩减的力量以训练大型模型

    722+0近 7 天星标变化
  • MPP-LLaVA@Coobiw

    个人项目:MPP-Qwen14B & MPP-Qwen-Next(基于 Qwen-LM 的多模态流水线并行)。支持 [视频/图像/多图] {SFT/对话}。不要让贫穷限制您的想象力!在 RTX3090/4090 24GB 上训练您自己的 8B/14B LLaVA 风格 MLLM。

    687+1近 7 天星标变化
  • Craw4LLM@cxcscmu

    “Craw4LLM: Efficient Web Crawling for LLM Pretraining”官方仓库

    664+1近 7 天星标变化
  • SaProt@westlake-repl

    Saprot:带有结构字母表的蛋白质语言模型(AA+3Di)

    629+2近 7 天星标变化
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    551+15近 7 天星标变化
  • PITI@PITI-Synthesis

    PITI:图像对图像转换所需的预训练模型

    502+0近 7 天星标变化
← 返回主题列表