pretraining
Erfasste Open-Source-Repos mit dem Tag pretraining, sortiert nach Sternen.
Verwandte Themen
Themen, die häufig gemeinsam mit pretraining am selben Repo auftauchen.
Neue Aufsteiger
Repos, die in den letzten 90 Tagen erstellt und mit pretraining getaggt wurden.
In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.
- #1
Implementiere ein ChatGPT-ähnliches LLM in PyTorch von Grund auf, Schritt für Schritt.
★ 104.010+820Sterne-Änderung der letzten 7 Tage - #2
Llama-Community auf Chinesisch, die in Echtzeit die neuesten Llama-Lernmaterialien zusammenfasst und das beste chinesische Llama-Open-Source-Ökosystem aufbaut, vollständig Open Source und kommerziell nutzbar
★ 14.740+1Sterne-Änderung der letzten 7 Tage - #3★ 4.466+1Sterne-Änderung der letzten 7 Tage
- #4
Offizielles Repository von OFA (ICML 2022). Paper: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework
★ 2.557+0Sterne-Änderung der letzten 7 Tage - #5★ 2.539+0Sterne-Änderung der letzten 7 Tage
- #6
HRM-Text ist ein 1B-Textgenerierungsmodell basierend auf der HRM-Architektur, verstärkt durch Aufgabenabschluss und Latent-Space-Reasoning.
★ 1.919+43Sterne-Änderung der letzten 7 Tage - #7
Forschungsarbeiten zum Vortraining und selbstüberwachten Lernen bei Graph Neural Networks (GNNs).
★ 1.728+0Sterne-Änderung der letzten 7 Tage - #8
[ICLR'23 Spotlight🔥] Das erste erfolgreiche BERT/MAE-artige Vortraining für beliebige neuronale Faltungsnetze; PyTorch-Impl. von „Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling“
★ 1.376-1Sterne-Änderung der letzten 7 Tage - #9
GraphGen: Verbesserung des Supervised Fine-Tuning für LLMs durch wissensbasierte synthetische Datengenerierung
★ 1.214+5Sterne-Änderung der letzten 7 Tage - #10★ 1.157+5Sterne-Änderung der letzten 7 Tage
- #11
Pretraining- und Inferenz-Code für ein großflächiges, tiefenrekurrentes Sprachmodell
★ 911+0Sterne-Änderung der letzten 7 Tage - #12
[ICLR 2024🔥] Erweiterung des Video-Language-Pretraining auf N-Modalität durch sprachbasierte semantische Ausrichtung
★ 885+0Sterne-Änderung der letzten 7 Tage - #13
Eine kuratierte Liste von 3D-Vision-Papern mit Bezug zur Robotik im Zeitalter großer Modelle wie LLMs/VLMs, inspiriert von awesome-computer-vision, einschließlich Papers, Codes und zugehörigen Websites
★ 820+0Sterne-Änderung der letzten 7 Tage - #14
Die offizielle Implementierung von MARS: Unleashing the Power of Variance Reduction for Training Large Models
★ 722+0Sterne-Änderung der letzten 7 Tage - #15
Persönliches Projekt: MPP-Qwen14B & MPP-Qwen-Next (Multimodale Pipeline-Parallelisierung basierend auf Qwen-LM). Unterstützt [Video/Bild/Multi-Bild] {SFT/Konversationen}. Lassen Sie sich nicht von Armut in Ihrer Vorstellungskraft einschränken! Trainieren Sie Ihr eigenes LLaVA-ähnliches MLLM (8B/14B) auf einer RTX3090/4090 mit 24 GB.
★ 686+2Sterne-Änderung der letzten 7 Tage - #16★ 664+1Sterne-Änderung der letzten 7 Tage
- #17★ 626+4Sterne-Änderung der letzten 7 Tage
- #18
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 540—Sterne-Änderung der letzten 7 Tage - #19★ 502+0Sterne-Änderung der letzten 7 Tage