Pular para o conteúdo principal
buildradar
Sign in
Tópico · pretraining

pretraining

Repositórios de código aberto acompanhados marcados com pretraining, ordenados por estrelas.

Repositórios
19
Total de estrelas
142.049
Média de estrelas
7.476
Participação
0,01%

Tópicos que aparecem com frequência ao lado de pretraining no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com pretraining.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • LLMs-from-scratch@rasbt

    Implemente um LLM semelhante ao ChatGPT em PyTorch do zero, passo a passo

    104.010+820Variação de estrelas nos últimos 7 dias
  • Llama-Chinese@LlamaChinese

    Comunidade chinesa Llama, reunindo em tempo real os materiais de estudo mais recentes sobre Llama, construindo o melhor ecossistema open source de grandes modelos Llama em chinês, totalmente aberto e comercializável.

    14.740+1Variação de estrelas nos últimos 7 dias
  • LMOps@microsoft

    Tecnologia geral para habilitar capacidades de IA com LLMs e MLLMs.

    4.466+1Variação de estrelas nos últimos 7 dias
  • OFA@OFA-Sys

    Repositório oficial do OFA (ICML 2022). Artigo: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2.557+0Variação de estrelas nos últimos 7 dias
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl: A poderosa família de modelos de linguagem multimodal de grande escala.

    2.539+0Variação de estrelas nos últimos 7 dias
  • HRM-Text@sapientinc

    HRM-Text é um modelo de geração de texto de 1B baseado na arquitetura HRM, fortalecido por conclusão de tarefas e raciocínio em espaço latente.

    1.919+43Variação de estrelas nos últimos 7 dias
  • Artigos sobre pré-treinamento e aprendizado autossupervisionado em Graph Neural Networks (GNN).

    1.728+0Variação de estrelas nos últimos 7 dias
  • SparK@keyu-tian

    [ICLR'23 Spotlight] O primeiro pré-treinamento bem-sucedido estilo BERT/MAE em qualquer rede convolucional; implementação em PyTorch de "Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling".

    1.376-1Variação de estrelas nos últimos 7 dias
  • GraphGen@InternScience

    GraphGen: Aprimorando o ajuste fino supervisionado para LLMs com geração de dados sintéticos orientada por conhecimento

    1.214+5Variação de estrelas nos últimos 7 dias
  • Uni-Mol@deepmodeling

    Repositório oficial para a série de métodos Uni-Mol

    1.157+5Variação de estrelas nos últimos 7 dias
  • Código de pré-treinamento e inferência para um modelo de linguagem recorrente de profundidade em larga escala

    911+0Variação de estrelas nos últimos 7 dias
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】 Estendendo o pré-treinamento de vídeo-linguagem para N-modalidades por alinhamento semântico baseado em linguagem

    885+0Variação de estrelas nos últimos 7 dias
  • Uma lista com curadoria de artigos de visão 3D relacionados ao domínio de robótica na era de grandes modelos, como LLMs/VLMs, inspirada no awesome-computer-vision, incluindo artigos, códigos e sites relacionados

    820+0Variação de estrelas nos últimos 7 dias
  • MARS@AGI-Arena

    A implementação oficial do MARS: Liberando o poder da redução de variância para o treinamento de grandes modelos

    722+0Variação de estrelas nos últimos 7 dias
  • MPP-LLaVA@Coobiw

    Projeto Pessoal: MPP-Qwen14B & MPP-Qwen-Next (Pipeline Paralelo Multimodal baseado em Qwen-LM). Suporta [vídeo/imagem/várias imagens] {sft/conversas}. Não deixe a pobreza limitar sua imaginação! Treine seu próprio MLLM semelhante ao LLaVA de 8B/14B em RTX3090/4090 24GB.

    686+2Variação de estrelas nos últimos 7 dias
  • Craw4LLM@cxcscmu

    Repositório oficial para "Craw4LLM: Efficient Web Crawling for LLM Pretraining"

    664+1Variação de estrelas nos últimos 7 dias
  • SaProt@westlake-repl

    Saprot: Modelo de Linguagem de Proteínas com Alfabeto Estrutural (AA+3Di)

    626+4Variação de estrelas nos últimos 7 dias
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    538Variação de estrelas nos últimos 7 dias
  • PITI@PITI-Synthesis

    PITI: Pré-treinamento é tudo o que você precisa para tradução de imagem para imagem

    502+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos