Pular para o conteúdo principal
buildradar
Sign in
Tópico · attention-mechanism

attention-mechanism

Repositórios de código aberto acompanhados marcados com attention-mechanism, ordenados por estrelas.

Repositórios
34
Total de estrelas
212.413
Média de estrelas
6.247
Participação
0,01%

Tópicos que aparecem com frequência ao lado de attention-mechanism no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com attention-mechanism.

  • ComfyUI-VDN-H3@Saganaki22

    Video Delta Net hybrid attention for MiniMax-H3 as a native ComfyUI node.

    202
  • LLMs-from-scratch@rasbt

    Implemente um LLM semelhante ao ChatGPT em PyTorch do zero, passo a passo

    104.229+0Variação de estrelas nos últimos 7 dias
  • vit-pytorch@lucidrains

    Implementação do Vision Transformer em PyTorch, uma maneira simples de alcançar SoTA em classificação de visão usando apenas um único codificador transformer

    25.498+0Variação de estrelas nos últimos 7 dias
  • nndl@nndl

    Livro teórico de Qiu Xipeng 'Redes Neurais e Aprendizado Profundo' (Livro Dente-de-leão), v2 e versão geral.

    19.149+0Variação de estrelas nos últimos 7 dias
  • RWKV-LM@BlinkDL

    RWKV (pronuncia-se RwaKuv) é uma RNN com excelente desempenho em LLM, que também pode ser treinada diretamente como um transformer GPT (paralelizável). Estamos na versão RWKV-7 "Goose". Ele combina o melhor de RNN e transformer: ótimo desempenho, tempo linear, espaço constante (sem kv-cache), treinamento rápido, comprimento de contexto infinito e sentence embedding gratuito.

    14.695+0Variação de estrelas nos últimos 7 dias
  • x-transformers@lucidrains

    Um transformer full-attention conciso, porém completo, com um conjunto de recursos experimentais promissores de vários artigos.

    5.943+0Variação de estrelas nos últimos 7 dias
  • DALLE-pytorch@lucidrains

    Implementação/replicação do DALL-E, o Transformer de texto para imagem da OpenAI, em PyTorch

    5.626+0Variação de estrelas nos últimos 7 dias
  • Uma lista de artigos extremamente abrangente sobre Vision Transformer/Attention, incluindo artigos, códigos e sites relacionados

    5.046+0Variação de estrelas nos últimos 7 dias
  • RuVector@ruvnet

    RuVector é um banco de dados de memória vetorial GNN, de alto desempenho, tempo real e autoaprendizado, construído em Rust.

    4.473+0Variação de estrelas nos últimos 7 dias
  • how-to-train-your-gpt@raiyanyahya

    Construa um LLM moderno do zero. Cada linha comentada. Explicado de forma simples.

    3.271+0Variação de estrelas nos últimos 7 dias
  • whisper-timestamped@linto-ai

    Reconhecimento automático de fala multilíngue com carimbos de data/hora em nível de palavra e confiança

    2.842+0Variação de estrelas nos últimos 7 dias
  • keras-attention@philipperemy

    Camada de atenção Keras (pontuações de Luong e Bahdanau).

    2.809+0Variação de estrelas nos últimos 7 dias
  • soundstorm-pytorch@lucidrains

    Implementação do SoundStorm, geração de áudio paralela eficiente do Google Deepmind, em Pytorch

    1.547+0Variação de estrelas nos últimos 7 dias
  • llm-internals@amitshekhariitbhu

    Aprenda os fundamentos de LLM passo a passo - desde tokenização e atenção até otimização de inferência.

    1.540+0Variação de estrelas nos últimos 7 dias
  • perceiver-pytorch@lucidrains

    Implementação do Perceiver, General Perception with Iterative Attention, em Pytorch

    1.218+0Variação de estrelas nos últimos 7 dias
  • sockeye@awslabs

    Framework sequence-to-sequence baseado em PyTorch com foco em Tradução Automática Neural

    1.216+0Variação de estrelas nos últimos 7 dias
  • EEG-DL@SuperBruceJia

    Uma biblioteca de Deep Learning para classificação de tarefas (sinais) de EEG, baseada em TensorFlow.

    1.168+0Variação de estrelas nos últimos 7 dias
  • Uma lista com curadoria de recursos de PNL focados em redes Transformer, mecanismo de atenção, GPT, BERT, ChatGPT, LLMs e aprendizado por transferência.

    1.152+0Variação de estrelas nos últimos 7 dias
  • OpenSTL@chengtan9907

    OpenSTL: Um benchmark abrangente de aprendizado preditivo espaço-temporal

    1.143+0Variação de estrelas nos últimos 7 dias
  • Implementação do TabTransformer, rede de atenção para dados tabulares, em Pytorch

    1.093+2Variação de estrelas nos últimos 7 dias
  • Transformer baseado em uma variante de atenção que possui complexidade linear em relação ao comprimento da sequência

    843+0Variação de estrelas nos últimos 7 dias
  • MIRNet@swz30

    [ECCV 2020] Aprendizado de recursos aprimorados para restauração e aprimoramento de imagens reais. Resultados SOTA para redução de ruído, super-resolução e aprimoramento de imagem.

    725+1Variação de estrelas nos últimos 7 dias
  • yolo_research@positive666

    baseado no projeto yolo-high-level (detect\pose\classify\segment\): inclui núcleo do yolov5\yolov7\yolov8, pesquisa de melhoria, SwintransformV2 e Séries de Atenção. habilidades de treinamento, customização de negócios, implantação de engenharia C

    665+0Variação de estrelas nos últimos 7 dias
  • MORAN_v2@Canjie-Luo

    MORAN: Uma rede de atenção retificada de múltiplos objetos para reconhecimento de texto em cenas.

    649+0Variação de estrelas nos últimos 7 dias
  • Deepdive-llama3-from-scratch@therealoliver

    Implemente a inferência do llama3 passo a passo, compreenda os conceitos centrais, domine a derivação do processo e escreva o código.

    629-1Variação de estrelas nos últimos 7 dias
  • ChangeFormer@wgcban

    [IGARSS'22]: Uma rede siamesa baseada em Transformer para detecção de mudanças

    622+2Variação de estrelas nos últimos 7 dias
  • metal-flash-attention@philipturner

    FlashAttention (Porte para Metal)

    612+0Variação de estrelas nos últimos 7 dias
  • OverlapPredator@prs-eth

    [CVPR 2021, Oral] PREDATOR: Registro de nuvens de pontos 3D com baixa sobreposição.

    603+0Variação de estrelas nos últimos 7 dias
  • zeta@kyegomez

    Construa modelos de IA de alto desempenho com blocos de construção modulares

    601+1Variação de estrelas nos últimos 7 dias
  • TokenFormer@Haiyang-W

    [ICLR2025 Spotlight🔥] Implementação oficial do TokenFormer: Repensando o dimensionamento do Transformer com parâmetros de modelo tokenizados

    594-1Variação de estrelas nos últimos 7 dias
  • RT-2@kyegomez

    Democratização do RT-2 "RT-2: Novo modelo traduz visão e linguagem em ação"

    583-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos