pretraining
Repositórios de código aberto acompanhados marcados com pretraining, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de pretraining no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com pretraining.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Implemente um LLM semelhante ao ChatGPT em PyTorch do zero, passo a passo
★ 104.010+820Variação de estrelas nos últimos 7 dias - #2
Comunidade chinesa Llama, reunindo em tempo real os materiais de estudo mais recentes sobre Llama, construindo o melhor ecossistema open source de grandes modelos Llama em chinês, totalmente aberto e comercializável.
★ 14.740+1Variação de estrelas nos últimos 7 dias - #3★ 4.466+1Variação de estrelas nos últimos 7 dias
- #4
Repositório oficial do OFA (ICML 2022). Artigo: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
★ 2.557+0Variação de estrelas nos últimos 7 dias - #5★ 2.539+0Variação de estrelas nos últimos 7 dias
- #6
HRM-Text é um modelo de geração de texto de 1B baseado na arquitetura HRM, fortalecido por conclusão de tarefas e raciocínio em espaço latente.
★ 1.919+43Variação de estrelas nos últimos 7 dias - #7
Artigos sobre pré-treinamento e aprendizado autossupervisionado em Graph Neural Networks (GNN).
★ 1.728+0Variação de estrelas nos últimos 7 dias - #8
[ICLR'23 Spotlight] O primeiro pré-treinamento bem-sucedido estilo BERT/MAE em qualquer rede convolucional; implementação em PyTorch de "Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling".
★ 1.376-1Variação de estrelas nos últimos 7 dias - #9
GraphGen: Aprimorando o ajuste fino supervisionado para LLMs com geração de dados sintéticos orientada por conhecimento
★ 1.214+5Variação de estrelas nos últimos 7 dias - #10★ 1.157+5Variação de estrelas nos últimos 7 dias
- #11
Código de pré-treinamento e inferência para um modelo de linguagem recorrente de profundidade em larga escala
★ 911+0Variação de estrelas nos últimos 7 dias - #12
【ICLR 2024🔥】 Estendendo o pré-treinamento de vídeo-linguagem para N-modalidades por alinhamento semântico baseado em linguagem
★ 885+0Variação de estrelas nos últimos 7 dias - #13
Uma lista com curadoria de artigos de visão 3D relacionados ao domínio de robótica na era de grandes modelos, como LLMs/VLMs, inspirada no awesome-computer-vision, incluindo artigos, códigos e sites relacionados
★ 820+0Variação de estrelas nos últimos 7 dias - #14
A implementação oficial do MARS: Liberando o poder da redução de variância para o treinamento de grandes modelos
★ 722+0Variação de estrelas nos últimos 7 dias - #15
Projeto Pessoal: MPP-Qwen14B & MPP-Qwen-Next (Pipeline Paralelo Multimodal baseado em Qwen-LM). Suporta [vídeo/imagem/várias imagens] {sft/conversas}. Não deixe a pobreza limitar sua imaginação! Treine seu próprio MLLM semelhante ao LLaVA de 8B/14B em RTX3090/4090 24GB.
★ 686+2Variação de estrelas nos últimos 7 dias - #16★ 664+1Variação de estrelas nos últimos 7 dias
- #17★ 626+4Variação de estrelas nos últimos 7 dias
- #18
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 538—Variação de estrelas nos últimos 7 dias - #19
PITI: Pré-treinamento é tudo o que você precisa para tradução de imagem para imagem
★ 502+0Variação de estrelas nos últimos 7 dias