Zum Hauptinhalt springen
buildradar
Sign in
Thema · attention-mechanism

attention-mechanism

Erfasste Open-Source-Repos mit dem Tag attention-mechanism, sortiert nach Sternen.

Repos
34
Sterne gesamt
212.413
Sterne im Schnitt
6.247
Anteil
0,01%

Themen, die häufig gemeinsam mit attention-mechanism am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit attention-mechanism getaggt wurden.

  • ComfyUI-VDN-H3@Saganaki22

    Video Delta Net hybrid attention for MiniMax-H3 as a native ComfyUI node.

    153
  • LLMs-from-scratch@rasbt

    Implementiere ein ChatGPT-ähnliches LLM in PyTorch von Grund auf, Schritt für Schritt.

    104.229+360Sterne-Änderung der letzten 7 Tage
  • vit-pytorch@lucidrains

    Implementierung des Vision Transformer, ein einfacher Weg, um in der Vision-Klassifikation SOTA zu erreichen, mit nur einem Transformer-Encoder in PyTorch

    25.498+10Sterne-Änderung der letzten 7 Tage
  • nndl@nndl

    Qiu Xipengs „Neural Networks and Deep Learning“ (Pusteblumen-Buch) Theoriebuch v2 und Allgemeinwissensversion

    19.149+25Sterne-Änderung der letzten 7 Tage
  • RWKV-LM@BlinkDL

    RWKV (ausgesprochen RwaKuv) ist ein RNN mit hervorragender LLM-Leistung, das auch wie ein GPT-Transformer direkt trainiert werden kann (parallelisierbar). Wir sind bei RWKV-7 „Goose“. Es kombiniert also das Beste aus RNN und Transformer – hohe Leistung, lineare Zeit, konstanter Speicherplatz (kein KV-Cache), schnelles Training, unendliche ctx_len und kostenloses Sentence Embedding.

    14.695+12Sterne-Änderung der letzten 7 Tage
  • x-transformers@lucidrains

    Ein prägnanter, aber vollständiger Full-Attention-Transformer mit einer Reihe vielversprechender experimenteller Funktionen aus verschiedenen Papers

    5.943+1Sterne-Änderung der letzten 7 Tage
  • DALLE-pytorch@lucidrains

    Implementierung / Replikation von DALL-E, OpenAIs Text-to-Image-Transformer, in Pytorch

    5.626-1Sterne-Änderung der letzten 7 Tage
  • Eine äußerst umfassende Liste von Arbeiten zu Vision Transformer/Attention, einschließlich Papern, Codes und zugehörigen Websites

    5.046-3Sterne-Änderung der letzten 7 Tage
  • RuVector@ruvnet

    RuVector ist eine in Rust geschriebene Hochleistungs-, Echtzeit-, selbstlernende KI, ein Vektor-GNN und eine In-Memory-Datenbank.

    4.473+17Sterne-Änderung der letzten 7 Tage
  • how-to-train-your-gpt@raiyanyahya

    Erstellen Sie ein modernes LLM von Grund auf. Jede Zeile kommentiert. Einfach erklärt.

    3.271+117Sterne-Änderung der letzten 7 Tage
  • whisper-timestamped@linto-ai

    Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten

    2.842+1Sterne-Änderung der letzten 7 Tage
  • keras-attention@philipperemy

    Keras Attention Layer (Luong- und Bahdanau-Scores).

    2.809+0Sterne-Änderung der letzten 7 Tage
  • soundstorm-pytorch@lucidrains

    Implementierung von SoundStorm, effiziente parallele Audiogenerierung von Google DeepMind, in PyTorch

    1.547+1Sterne-Änderung der letzten 7 Tage
  • llm-internals@amitshekhariitbhu

    Lerne LLM-Interna Schritt für Schritt – von der Tokenisierung über Attention bis hin zur Inferenzoptimierung.

    1.540+6Sterne-Änderung der letzten 7 Tage
  • perceiver-pytorch@lucidrains

    Implementierung von Perceiver, General Perception with Iterative Attention, in PyTorch

    1.218+1Sterne-Änderung der letzten 7 Tage
  • sockeye@awslabs

    Sequence-to-Sequence-Framework mit Fokus auf neuronale maschinelle Übersetzung basierend auf PyTorch

    1.216+1Sterne-Änderung der letzten 7 Tage
  • EEG-DL@SuperBruceJia

    Eine Deep-Learning-Bibliothek für die Klassifizierung von EEG-Aufgaben (Signalen), basierend auf TensorFlow.

    1.168+1Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von NLP-Ressourcen mit Schwerpunkt auf Transformer-Netzwerken, Attention-Mechanismen, GPT, BERT, ChatGPT, LLMs und Transfer Learning.

    1.152+3Sterne-Änderung der letzten 7 Tage
  • OpenSTL@chengtan9907

    OpenSTL: Ein umfassender Benchmark für räumlich-zeitliches prädiktives Lernen

    1.143+6Sterne-Änderung der letzten 7 Tage
  • Implementierung von TabTransformer, einem Attention-Netzwerk für tabellarische Daten, in PyTorch

    1.092+0Sterne-Änderung der letzten 7 Tage
  • Transformer basierend auf einer Aufmerksamkeitsvariante mit linearer Komplexität in Bezug auf die Sequenzlänge

    844+0Sterne-Änderung der letzten 7 Tage
  • MIRNet@swz30

    [ECCV 2020] Lernen angereicherter Merkmale zur Wiederherstellung und Verbesserung realer Bilder. SOTA-Ergebnisse für Rauschunterdrückung, Super-Resolution und Bildverbesserung.

    724+0Sterne-Änderung der letzten 7 Tage
  • yolo_research@positive666

    Basierend auf dem yolo-high-level-Projekt (detect\pose\classify\segment\): Enthält yolov5\yolov7\yolov8\-Core, Verbesserungsforschung, SwintransformV2 und Attention-Serie, Trainingsfähigkeiten, Geschäftsanpassung, Engineering-Deployment C

    665+0Sterne-Änderung der letzten 7 Tage
  • MORAN_v2@Canjie-Luo

    MORAN: Ein Multi-Object Rectified Attention Network für Texterkennung in Szenen

    649+0Sterne-Änderung der letzten 7 Tage
  • Deepdive-llama3-from-scratch@therealoliver

    Schritt-für-Schritt-Implementierung der llama3-Inferenz, Verständnis der Kernkonzepte, Beherrschung der Prozessableitung und Implementierung des Codes.

    630+0Sterne-Änderung der letzten 7 Tage
  • ChangeFormer@wgcban

    [IGARSS'22]: Ein Transformer-basiertes siamesisches Netzwerk für die Veränderungsdetektion

    620+1Sterne-Änderung der letzten 7 Tage
  • metal-flash-attention@philipturner

    FlashAttention (Metal-Port)

    612-1Sterne-Änderung der letzten 7 Tage
  • OverlapPredator@prs-eth

    [CVPR 2021, Oral] PREDATOR: Registrierung von 3D-Punktwolken mit geringer Überlappung

    603-1Sterne-Änderung der letzten 7 Tage
  • zeta@kyegomez

    Erstellen Sie Hochleistungs-KI-Modelle mit modularen Bausteinen.

    600+1Sterne-Änderung der letzten 7 Tage
  • TokenFormer@Haiyang-W

    [ICLR2025 Spotlight🔥] Offizielle Implementierung von TokenFormer: Überdenken der Transformer-Skalierung mit tokenisierten Modellparametern

    594+1Sterne-Änderung der letzten 7 Tage
  • RT-2@kyegomez

    Demokratisierung von RT-2 "RT-2: Neues Modell übersetzt Vision und Sprache in Aktion".

    583+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen