pretraining
Repositori open source terpantau bertanda pretraining, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan pretraining di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda pretraining.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Implementasikan LLM mirip ChatGPT dalam PyTorch dari awal, langkah demi langkah
★ 104.229+219Perubahan bintang dalam 7 hari terakhir - #2
Komunitas Llama bahasa Mandarin, mengumpulkan materi pembelajaran Llama terbaru secara real-time, membangun ekosistem open source model besar Llama bahasa Mandarin terbaik, sepenuhnya open source dan dapat digunakan secara komersial.
★ 14.743+3Perubahan bintang dalam 7 hari terakhir - #3★ 4.465-1Perubahan bintang dalam 7 hari terakhir
- #4
Repositori resmi OFA (ICML 2022). Makalah: OFA: Menyatukan Arsitektur, Tugas, dan Modalitas Melalui Kerangka Kerja Pembelajaran Sequence-to-Sequence yang Sederhana
★ 2.557+0Perubahan bintang dalam 7 hari terakhir - #5★ 2.539+0Perubahan bintang dalam 7 hari terakhir
- #6
HRM-Text adalah model pembuatan teks 1B berbasis arsitektur HRM, yang diperkuat dengan penyelesaian tugas dan penalaran ruang laten.
★ 1.938+24Perubahan bintang dalam 7 hari terakhir - #7
Makalah tentang pretraining dan pembelajaran mandiri (self-supervised learning) pada Graph Neural Networks (GNN).
★ 1.728+0Perubahan bintang dalam 7 hari terakhir - #8
[ICLR'23 Spotlight🔥] Pre-training gaya BERT/MAE pertama yang sukses pada jaringan konvolusional apa pun; Implementasi Pytorch untuk "Designing BERT for Convolutional Networks: Sparse and Hierarchical Masked Modeling"
★ 1.376+0Perubahan bintang dalam 7 hari terakhir - #9
GraphGen: Meningkatkan Fine-Tuning Tersupervisi untuk LLM dengan Pembuatan Data Sintetis Berbasis Pengetahuan
★ 1.216+2Perubahan bintang dalam 7 hari terakhir - #10★ 1.159+3Perubahan bintang dalam 7 hari terakhir
- #11
Kode pretraining dan inferensi untuk model bahasa depth-recurrent skala besar
★ 942+22Perubahan bintang dalam 7 hari terakhir - #12
【ICLR 2024🔥】 Memperluas Pra-pelatihan Video-Bahasa ke N-modalitas melalui Penyelarasan Semantik Berbasis Bahasa
★ 885+0Perubahan bintang dalam 7 hari terakhir - #13
Daftar kurasi makalah Visi 3D yang berkaitan dengan domain Robotika di era model besar seperti LLM/VLM, terinspirasi dari awesome-computer-vision, mencakup makalah, kode, dan situs web terkait
★ 821+1Perubahan bintang dalam 7 hari terakhir - #14
Implementasi resmi MARS: Memanfaatkan Kekuatan Reduksi Varians untuk Melatih Model Besar
★ 722+0Perubahan bintang dalam 7 hari terakhir - #15
Proyek Pribadi: MPP-Qwen14B & MPP-Qwen-Next (Multimodal Pipeline Parallel berdasarkan Qwen-LM). Mendukung [video/gambar/multi-gambar] {sft/percakapan}. Jangan biarkan kemiskinan membatasi imajinasi Anda! Latih MLLM mirip pelatihan LLaVA 8B/14B Anda sendiri di RTX3090/4090 24GB.
★ 686+0Perubahan bintang dalam 7 hari terakhir - #16★ 664+1Perubahan bintang dalam 7 hari terakhir
- #17★ 629+2Perubahan bintang dalam 7 hari terakhir
- #18
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Perubahan bintang dalam 7 hari terakhir - #19★ 502+0Perubahan bintang dalam 7 hari terakhir