sft
Repositori open source terpantau bertanda sft, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan sft di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda sft.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1
Gunakan PEFT atau Full-parameter untuk CPT/SFT/DPO/GRPO 600+ LLM (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) dan 300+ MLLM (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).
★ 15.488+88Perubahan bintang dalam 7 hari terakhir - #2
BISHENG adalah platform devops LLM sumber terbuka untuk aplikasi AI perusahaan generasi berikutnya. Fitur yang kuat dan komprehensif mencakup: alur kerja GenAI, RAG, Agen, manajemen model terpadu, evaluasi, SFT, manajemen dataset, manajemen sistem tingkat perusahaan, observabilitas, dan banyak lagi.
★ 11.922+5Perubahan bintang dalam 7 hari terakhir - #3
Lakukan fine-tuning, evaluasi, dan deploy Qwen, Gemma, atau LLM open weight lainnya dengan mudah!
★ 9.383+3Perubahan bintang dalam 7 hari terakhir - #4
https://adongwanai.github.io/AgentGuide | Panduan Pengembangan AI Agent | Praktik LangGraph | RAG Lanjutan | Beralih ke LLM | Wawancara LLM | Insinyur Algoritma | Bank Soal Wawancara | Pembelajaran Penguatan | Sintesis Data
★ 9.116+169Perubahan bintang dalam 7 hari terakhir - #5
Fine-tune LLM dari satu file YAML. Streaming layer melatih model 8B pada GPU laptop 4 GB.
★ 4.929+1.365Perubahan bintang dalam 7 hari terakhir - #6
Kurikulum praktis sumber terbuka yang menjembatani kesenjangan dari konsep dasar RL ke penyelarasan LLM, RLVR, dan sistem agen tingkat lanjut.
★ 4.199+54Perubahan bintang dalam 7 hari terakhir - #7★ 2.410+3Perubahan bintang dalam 7 hari terakhir
- #8
Fine-tuning chatglm 6b dan fine-tuning alpaca
★ 1.526+0Perubahan bintang dalam 7 hari terakhir - #9
🎓 Kursus pembangunan Large Language Model yang sistematis | 🛠️ Mencakup teknik data pre-training, Tokenizer, Transformer, MoE, pemrograman GPU (CUDA/Triton), pelatihan terdistribusi, Scaling Laws, optimasi inferensi, dan alignment (SFT/RLHF/GRPO) | 🚀 6 tugas progresif + berbasis kode, membangun pemahaman tumpukan penuh LLM
★ 1.276+19Perubahan bintang dalam 7 hari terakhir - #10
GraphGen: Meningkatkan Fine-Tuning Tersupervisi untuk LLM dengan Pembuatan Data Sintetis Berbasis Pengetahuan
★ 1.216+2Perubahan bintang dalam 7 hari terakhir - #11★ 813+0Perubahan bintang dalam 7 hari terakhir
- #12
Solusi sumber terbuka untuk penyetelan halus parameter penuh DeepSeek-V3/R1 671B, termasuk kode dan skrip lengkap dari pelatihan hingga inferensi, serta beberapa pengalaman dan kesimpulan praktis.
★ 812+0Perubahan bintang dalam 7 hari terakhir - #13
Kode dan dataset untuk "Character-LLM: A Trainable Agent for Role-Playing"
★ 647+2Perubahan bintang dalam 7 hari terakhir - #14
Repository NLP Deep Learning yang merangkum tugas downstream dari pra-pemrosesan teks hingga model terbaru seperti Topic Models, BERT, GPT, dan LLM menggunakan TensorFlow.
★ 581+0Perubahan bintang dalam 7 hari terakhir - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Perubahan bintang dalam 7 hari terakhir