Zum Hauptinhalt springen
buildradar
Sign in
Thema · pretraining

pretraining

Erfasste Open-Source-Repos mit dem Tag pretraining, sortiert nach Sternen.

Repos
19
Sterne gesamt
142.049
Sterne im Schnitt
7.476
Anteil
0,01%

Themen, die häufig gemeinsam mit pretraining am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit pretraining getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • LLMs-from-scratch@rasbt

    Implementiere ein ChatGPT-ähnliches LLM in PyTorch von Grund auf, Schritt für Schritt.

    104.010+820Sterne-Änderung der letzten 7 Tage
  • Llama-Chinese@LlamaChinese

    Llama-Community auf Chinesisch, die in Echtzeit die neuesten Llama-Lernmaterialien zusammenfasst und das beste chinesische Llama-Open-Source-Ökosystem aufbaut, vollständig Open Source und kommerziell nutzbar

    14.740+1Sterne-Änderung der letzten 7 Tage
  • LMOps@microsoft

    Allgemeine Technologie zur Ermöglichung von KI-Funktionen mit LLMs und MLLMs

    4.466+1Sterne-Änderung der letzten 7 Tage
  • OFA@OFA-Sys

    Offizielles Repository von OFA (ICML 2022). Paper: OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework

    2.557+0Sterne-Änderung der letzten 7 Tage
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl: Die leistungsstarke Familie multimodaler Large Language Models

    2.539+0Sterne-Änderung der letzten 7 Tage
  • HRM-Text@sapientinc

    HRM-Text ist ein 1B-Textgenerierungsmodell basierend auf der HRM-Architektur, verstärkt durch Aufgabenabschluss und Latent-Space-Reasoning.

    1.919+43Sterne-Änderung der letzten 7 Tage
  • Forschungsarbeiten zum Vortraining und selbstüberwachten Lernen bei Graph Neural Networks (GNNs).

    1.728+0Sterne-Änderung der letzten 7 Tage
  • SparK@keyu-tian

    [ICLR'23 Spotlight🔥] Das erste erfolgreiche BERT/MAE-artige Vortraining für beliebige neuronale Faltungsnetze; PyTorch-Impl. von „Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling“

    1.376-1Sterne-Änderung der letzten 7 Tage
  • GraphGen@InternScience

    GraphGen: Verbesserung des Supervised Fine-Tuning für LLMs durch wissensbasierte synthetische Datengenerierung

    1.214+5Sterne-Änderung der letzten 7 Tage
  • Uni-Mol@deepmodeling

    Offizielles Repository für die Methoden der Uni-Mol-Serie.

    1.157+5Sterne-Änderung der letzten 7 Tage
  • Pretraining- und Inferenz-Code für ein großflächiges, tiefenrekurrentes Sprachmodell

    911+0Sterne-Änderung der letzten 7 Tage
  • LanguageBind@PKU-YuanGroup

    [ICLR 2024🔥] Erweiterung des Video-Language-Pretraining auf N-Modalität durch sprachbasierte semantische Ausrichtung

    885+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von 3D-Vision-Papern mit Bezug zur Robotik im Zeitalter großer Modelle wie LLMs/VLMs, inspiriert von awesome-computer-vision, einschließlich Papers, Codes und zugehörigen Websites

    820+0Sterne-Änderung der letzten 7 Tage
  • MARS@AGI-Arena

    Die offizielle Implementierung von MARS: Unleashing the Power of Variance Reduction for Training Large Models

    722+0Sterne-Änderung der letzten 7 Tage
  • MPP-LLaVA@Coobiw

    Persönliches Projekt: MPP-Qwen14B & MPP-Qwen-Next (Multimodale Pipeline-Parallelisierung basierend auf Qwen-LM). Unterstützt [Video/Bild/Multi-Bild] {SFT/Konversationen}. Lassen Sie sich nicht von Armut in Ihrer Vorstellungskraft einschränken! Trainieren Sie Ihr eigenes LLaVA-ähnliches MLLM (8B/14B) auf einer RTX3090/4090 mit 24 GB.

    686+2Sterne-Änderung der letzten 7 Tage
  • Craw4LLM@cxcscmu

    Offizielles Repository für „Craw4LLM: Efficient Web Crawling for LLM Pretraining“

    664+1Sterne-Änderung der letzten 7 Tage
  • SaProt@westlake-repl

    Saprot: Protein-Sprachmodell mit strukturellem Alphabet (AA+3Di)

    626+4Sterne-Änderung der letzten 7 Tage
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    540Sterne-Änderung der letzten 7 Tage
  • PITI@PITI-Synthesis

    PITI: Pretraining is All You Need für Image-to-Image-Translation.

    502+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen