sft
Repositorios de código abierto monitorizados etiquetados con sft, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a sft en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con sft.
No hay repositorios nuevos con este tema en los últimos 90 días.
- #1
Usa PEFT o parámetros completos para CPT/SFT/DPO/GRPO en más de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) y más de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).
★ 15.488+88Variación de estrellas de los últimos 7 días - #2
BISHENG es una plataforma DevOps de LLM abierta para aplicaciones de IA empresarial de próxima generación. Las características potentes e integrales incluyen: flujo de trabajo GenAI, RAG, Agent, gestión unificada de modelos, evaluación, SFT, gestión de conjuntos de datos, gestión de sistemas a nivel empresarial, observabilidad y más.
★ 11.922+5Variación de estrellas de los últimos 7 días - #3★ 9383+3Variación de estrellas de los últimos 7 días
- #4
https://adongwanai.github.io/AgentGuide | Guía de desarrollo de AI Agent | LangGraph en la práctica | RAG avanzado | Transición a LLM | Entrevistas de LLM | Ingeniero de algoritmos | Banco de preguntas de entrevistas | Aprendizaje por refuerzo | Síntesis de datos
★ 9116+169Variación de estrellas de los últimos 7 días - #5
Ajusta LLMs desde un solo YAML. El streaming de capas entrena un modelo de 8B en una GPU de laptop de 4 GB.
★ 4929+1365Variación de estrellas de los últimos 7 días - #6
🚀 Un plan de estudios práctico y de código abierto que puentea la brecha desde los conceptos básicos de RL hasta la alineación de LLM, RLVR y sistemas de agentes avanzados.
★ 4199+54Variación de estrellas de los últimos 7 días - #7★ 2410+3Variación de estrellas de los últimos 7 días
- #8
Ajuste fino (finetuning) de chatglm 6b y alpaca
★ 1526+0Variación de estrellas de los últimos 7 días - #9
🎓 Curso sistemático de construcción de modelos de lenguaje extensos | 🛠️ Cubre ingeniería de datos de preentrenamiento, Tokenizer, Transformer, MoE, programación de GPU (CUDA/Triton), entrenamiento distribuido, leyes de escala, optimización de inferencia y alineación (SFT/RLHF/GRPO) | 🚀 6 tareas progresivas + impulsadas por código para establecer un sistema de conocimiento full-stack de LLM
★ 1276+19Variación de estrellas de los últimos 7 días - #10
GraphGen: mejora del ajuste fino supervisado para LLMs mediante la generación de datos sintéticos basados en conocimiento
★ 1216+2Variación de estrellas de los últimos 7 días - #11★ 813+0Variación de estrellas de los últimos 7 días
- #12
Solución de código abierto para el ajuste fino de parámetros completos de DeepSeek-V3/R1 671B, que incluye código y scripts completos desde el entrenamiento hasta la inferencia, así como experiencias prácticas y conclusiones.
★ 812+0Variación de estrellas de los últimos 7 días - #13
Código y conjuntos de datos para "Character-LLM: A Trainable Agent for Role-Playing".
★ 647+1Variación de estrellas de los últimos 7 días - #14
Repositorio de Deep Learning NLP que utiliza TensorFlow para cubrir desde el preprocesamiento de texto hasta tareas posteriores con modelos modernos como Topic Models, BERT, GPT y LLM.
★ 581+0Variación de estrellas de los últimos 7 días - #15
A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.
★ 549+15Variación de estrellas de los últimos 7 días