sft
Dépôts open source suivis étiquetés sft, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de sft sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés sft.
Aucun nouveau dépôt étiqueté avec ce sujet au cours des 90 derniers jours.
- #1
Utilisez PEFT ou le paramétrage complet pour CPT/SFT/DPO/GRPO sur plus de 600 LLM et 300 MLLM (AAAI 2025).
★ 15 488+88Évolution des étoiles sur les 7 derniers jours - #2
BISHENG est une plateforme DevOps LLM open source pour les applications d'IA d'entreprise de nouvelle génération. Ses fonctionnalités puissantes et complètes incluent : flux de travail GenAI, RAG, Agent, gestion unifiée des modèles, évaluation, SFT, gestion des jeux de données, gestion système au niveau entreprise, observabilité, et plus encore.
★ 11 922+5Évolution des étoiles sur les 7 derniers jours - #3★ 9 383+3Évolution des étoiles sur les 7 derniers jours
- #4
https://adongwanai.github.io/AgentGuide | Guide de développement d'agents IA | Pratique LangGraph | RAG avancé | Reconversion vers les grands modèles | Entretiens sur les grands modèles | Ingénieur algorithme | Banque de questions d'entretien | Apprentissage par renforcement | Synthèse de données
★ 9 116+169Évolution des étoiles sur les 7 derniers jours - #5
Fine-tuning de LLM à partir d'un seul fichier YAML. Le streaming de couches permet d'entraîner un modèle 8B sur un GPU d'ordinateur portable de 4 Go.
★ 4 929+1 365Évolution des étoiles sur les 7 derniers jours - #6
Un programme open-source pratique pour faire le pont entre les concepts de base de l'apprentissage par renforcement (RL) et l'alignement des LLM, RLVR et les systèmes d'agents avancés.
★ 4 199+54Évolution des étoiles sur les 7 derniers jours - #7★ 2 410+3Évolution des étoiles sur les 7 derniers jours
- #8
Fine-tuning de chatglm 6b et fine-tuning d'alpaca.
★ 1 526+0Évolution des étoiles sur les 7 derniers jours - #9
Cours systématique sur la construction de grands modèles de langage (LLM) couvrant l'ingénierie des données de pré-entraînement, Tokenizer, Transformer, MoE, programmation GPU (CUDA/Triton), entraînement distribué, lois d'échelle, optimisation de l'inférence et alignement (SFT/RLHF/GRPO), avec 6 exercices progressifs axés sur le code.
★ 1 276+19Évolution des étoiles sur les 7 derniers jours - #10
GraphGen : Amélioration du fine-tuning supervisé pour les LLM grâce à la génération de données synthétiques basées sur les connaissances
★ 1 216+2Évolution des étoiles sur les 7 derniers jours - #11★ 813+0Évolution des étoiles sur les 7 derniers jours
- #12
Une solution open source pour le réglage fin (fine-tuning) complet des paramètres de DeepSeek-V3/R1 671B, incluant le code et les scripts complets de l'entraînement à l'inférence, ainsi que des retours d'expérience et conclusions pratiques.
★ 812+0Évolution des étoiles sur les 7 derniers jours - #13
Code et jeux de données pour « Character-LLM: A Trainable Agent for Role-Playing »
★ 647+1Évolution des étoiles sur les 7 derniers jours - #14
Dépôt NLP de Deep Learning résumant les tâches en aval, du prétraitement du texte aux modèles les plus récents comme Topic Models, BERT, GPT et LLM en utilisant TensorFlow.
★ 581+0Évolution des étoiles sur les 7 derniers jours - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Évolution des étoiles sur les 7 derniers jours