attention-mechanism
Erfasste Open-Source-Repos mit dem Tag attention-mechanism, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit attention-mechanism am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit attention-mechanism getaggt wurden.
- #1
Video Delta Net hybrid attention for MiniMax-H3 as a native ComfyUI node.
★ 153
- #1
Implementiere ein ChatGPT-ähnliches LLM in PyTorch von Grund auf, Schritt für Schritt.
★ 104.229+360Sterne-Änderung der letzten 7 Tage - #2
Implementierung des Vision Transformer, ein einfacher Weg, um in der Vision-Klassifikation SOTA zu erreichen, mit nur einem Transformer-Encoder in PyTorch
★ 25.498+10Sterne-Änderung der letzten 7 Tage - #3
Qiu Xipengs „Neural Networks and Deep Learning“ (Pusteblumen-Buch) Theoriebuch v2 und Allgemeinwissensversion
★ 19.149+25Sterne-Änderung der letzten 7 Tage - #4
RWKV (ausgesprochen RwaKuv) ist ein RNN mit hervorragender LLM-Leistung, das auch wie ein GPT-Transformer direkt trainiert werden kann (parallelisierbar). Wir sind bei RWKV-7 „Goose“. Es kombiniert also das Beste aus RNN und Transformer – hohe Leistung, lineare Zeit, konstanter Speicherplatz (kein KV-Cache), schnelles Training, unendliche ctx_len und kostenloses Sentence Embedding.
★ 14.695+12Sterne-Änderung der letzten 7 Tage - #5
Ein prägnanter, aber vollständiger Full-Attention-Transformer mit einer Reihe vielversprechender experimenteller Funktionen aus verschiedenen Papers
★ 5.943+1Sterne-Änderung der letzten 7 Tage - #6
Implementierung / Replikation von DALL-E, OpenAIs Text-to-Image-Transformer, in Pytorch
★ 5.626-1Sterne-Änderung der letzten 7 Tage - #7
Eine äußerst umfassende Liste von Arbeiten zu Vision Transformer/Attention, einschließlich Papern, Codes und zugehörigen Websites
★ 5.046-3Sterne-Änderung der letzten 7 Tage - #8
RuVector ist eine in Rust geschriebene Hochleistungs-, Echtzeit-, selbstlernende KI, ein Vektor-GNN und eine In-Memory-Datenbank.
★ 4.473+17Sterne-Änderung der letzten 7 Tage - #9
Erstellen Sie ein modernes LLM von Grund auf. Jede Zeile kommentiert. Einfach erklärt.
★ 3.271+117Sterne-Änderung der letzten 7 Tage - #10
Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten
★ 2.842+1Sterne-Änderung der letzten 7 Tage - #11
Keras Attention Layer (Luong- und Bahdanau-Scores).
★ 2.809+0Sterne-Änderung der letzten 7 Tage - #12
Implementierung von SoundStorm, effiziente parallele Audiogenerierung von Google DeepMind, in PyTorch
★ 1.547+1Sterne-Änderung der letzten 7 Tage - #13
Lerne LLM-Interna Schritt für Schritt – von der Tokenisierung über Attention bis hin zur Inferenzoptimierung.
★ 1.540+6Sterne-Änderung der letzten 7 Tage - #14
Implementierung von Perceiver, General Perception with Iterative Attention, in PyTorch
★ 1.218+1Sterne-Änderung der letzten 7 Tage - #15
Sequence-to-Sequence-Framework mit Fokus auf neuronale maschinelle Übersetzung basierend auf PyTorch
★ 1.216+1Sterne-Änderung der letzten 7 Tage - #16
Eine Deep-Learning-Bibliothek für die Klassifizierung von EEG-Aufgaben (Signalen), basierend auf TensorFlow.
★ 1.168+1Sterne-Änderung der letzten 7 Tage - #17
Eine kuratierte Liste von NLP-Ressourcen mit Schwerpunkt auf Transformer-Netzwerken, Attention-Mechanismen, GPT, BERT, ChatGPT, LLMs und Transfer Learning.
★ 1.152+3Sterne-Änderung der letzten 7 Tage - #18★ 1.143+6Sterne-Änderung der letzten 7 Tage
- #19
Implementierung von TabTransformer, einem Attention-Netzwerk für tabellarische Daten, in PyTorch
★ 1.092+0Sterne-Änderung der letzten 7 Tage - #20
Transformer basierend auf einer Aufmerksamkeitsvariante mit linearer Komplexität in Bezug auf die Sequenzlänge
★ 844+0Sterne-Änderung der letzten 7 Tage - #21
[ECCV 2020] Lernen angereicherter Merkmale zur Wiederherstellung und Verbesserung realer Bilder. SOTA-Ergebnisse für Rauschunterdrückung, Super-Resolution und Bildverbesserung.
★ 724+0Sterne-Änderung der letzten 7 Tage - #22
Basierend auf dem yolo-high-level-Projekt (detect\pose\classify\segment\): Enthält yolov5\yolov7\yolov8\-Core, Verbesserungsforschung, SwintransformV2 und Attention-Serie, Trainingsfähigkeiten, Geschäftsanpassung, Engineering-Deployment C
★ 665+0Sterne-Änderung der letzten 7 Tage - #23★ 649+0Sterne-Änderung der letzten 7 Tage
- #24
Schritt-für-Schritt-Implementierung der llama3-Inferenz, Verständnis der Kernkonzepte, Beherrschung der Prozessableitung und Implementierung des Codes.
★ 630+0Sterne-Änderung der letzten 7 Tage - #25
[IGARSS'22]: Ein Transformer-basiertes siamesisches Netzwerk für die Veränderungsdetektion
★ 620+1Sterne-Änderung der letzten 7 Tage - #26
FlashAttention (Metal-Port)
★ 612-1Sterne-Änderung der letzten 7 Tage - #27
[CVPR 2021, Oral] PREDATOR: Registrierung von 3D-Punktwolken mit geringer Überlappung
★ 603-1Sterne-Änderung der letzten 7 Tage - #28★ 600+1Sterne-Änderung der letzten 7 Tage
- #29
[ICLR2025 Spotlight🔥] Offizielle Implementierung von TokenFormer: Überdenken der Transformer-Skalierung mit tokenisierten Modellparametern
★ 594+1Sterne-Änderung der letzten 7 Tage - #30
Demokratisierung von RT-2 "RT-2: Neues Modell übersetzt Vision und Sprache in Aktion".
★ 583+0Sterne-Änderung der letzten 7 Tage