Lompat ke konten utama
buildradar
Sign in
Topik · pretraining

pretraining

Repositori open source terpantau bertanda pretraining, diurutkan berdasarkan bintang.

Repositori
19
Total bintang
142.318
Rata-rata bintang
7.490
Porsi
0,01%

Topik yang sering muncul berdampingan dengan pretraining di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda pretraining.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • LLMs-from-scratch@rasbt

    Implementasikan LLM mirip ChatGPT dalam PyTorch dari awal, langkah demi langkah

    104.229+219Perubahan bintang dalam 7 hari terakhir
  • Llama-Chinese@LlamaChinese

    Komunitas Llama bahasa Mandarin, mengumpulkan materi pembelajaran Llama terbaru secara real-time, membangun ekosistem open source model besar Llama bahasa Mandarin terbaik, sepenuhnya open source dan dapat digunakan secara komersial.

    14.743+3Perubahan bintang dalam 7 hari terakhir
  • LMOps@microsoft

    Teknologi umum untuk mengaktifkan kemampuan AI dengan LLM dan MLLM

    4.465-1Perubahan bintang dalam 7 hari terakhir
  • OFA@OFA-Sys

    Repositori resmi OFA (ICML 2022). Makalah: OFA: Menyatukan Arsitektur, Tugas, dan Modalitas Melalui Kerangka Kerja Pembelajaran Sequence-to-Sequence yang Sederhana

    2.557+0Perubahan bintang dalam 7 hari terakhir
  • mPLUG-Owl@X-PLUG

    mPLUG-Owl: Keluarga Large Language Model Multi-modal yang Kuat

    2.539+0Perubahan bintang dalam 7 hari terakhir
  • HRM-Text@sapientinc

    HRM-Text adalah model pembuatan teks 1B berbasis arsitektur HRM, yang diperkuat dengan penyelesaian tugas dan penalaran ruang laten.

    1.938+24Perubahan bintang dalam 7 hari terakhir
  • Makalah tentang pretraining dan pembelajaran mandiri (self-supervised learning) pada Graph Neural Networks (GNN).

    1.728+0Perubahan bintang dalam 7 hari terakhir
  • SparK@keyu-tian

    [ICLR'23 Spotlight🔥] Pre-training gaya BERT/MAE pertama yang sukses pada jaringan konvolusional apa pun; Implementasi Pytorch untuk "Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling"

    1.376+0Perubahan bintang dalam 7 hari terakhir
  • GraphGen@InternScience

    GraphGen: Meningkatkan Fine-Tuning Tersupervisi untuk LLM dengan Pembuatan Data Sintetis Berbasis Pengetahuan

    1.216+2Perubahan bintang dalam 7 hari terakhir
  • Uni-Mol@deepmodeling

    Repositori Resmi untuk Metode Seri Uni-Mol

    1.159+3Perubahan bintang dalam 7 hari terakhir
  • Kode pretraining dan inferensi untuk model bahasa depth-recurrent skala besar

    942+22Perubahan bintang dalam 7 hari terakhir
  • LanguageBind@PKU-YuanGroup

    【ICLR 2024🔥】 Memperluas Pra-pelatihan Video-Bahasa ke N-modalitas melalui Penyelarasan Semantik Berbasis Bahasa

    885+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah Visi 3D yang berkaitan dengan domain Robotika di era model besar seperti LLM/VLM, terinspirasi dari awesome-computer-vision, mencakup makalah, kode, dan situs web terkait

    821+1Perubahan bintang dalam 7 hari terakhir
  • MARS@AGI-Arena

    Implementasi resmi MARS: Memanfaatkan Kekuatan Reduksi Varians untuk Melatih Model Besar

    722+0Perubahan bintang dalam 7 hari terakhir
  • MPP-LLaVA@Coobiw

    Proyek Pribadi: MPP-Qwen14B & MPP-Qwen-Next (Multimodal Pipeline Parallel berdasarkan Qwen-LM). Mendukung [video/gambar/multi-gambar] {sft/percakapan}. Jangan biarkan kemiskinan membatasi imajinasi Anda! Latih MLLM mirip pelatihan LLaVA 8B/14B Anda sendiri di RTX3090/4090 24GB.

    686+0Perubahan bintang dalam 7 hari terakhir
  • Craw4LLM@cxcscmu

    Repositori resmi untuk "Craw4LLM: Efficient Web Crawling for LLM Pretraining"

    664+1Perubahan bintang dalam 7 hari terakhir
  • SaProt@westlake-repl

    Saprot: Model Bahasa Protein dengan Alfabet Struktural (AA+3Di)

    629+2Perubahan bintang dalam 7 hari terakhir
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15Perubahan bintang dalam 7 hari terakhir
  • PITI@PITI-Synthesis

    PITI: Pretraining is All You Need for Image-to-Image Translation

    502+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik