Saltar al contenido principal
buildradar
Sign in
Tema · sft

sft

Repositorios de código abierto monitorizados etiquetados con sft, ordenados por estrellas.

Repositorios
15
Estrellas totales
64.861
Estrellas de media
4324
Proporción
0,00%

Temas que aparecen con frecuencia junto a sft en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con sft.

No hay repositorios nuevos con este tema en los últimos 90 días.

  • ms-swift@modelscope

    Usa PEFT o parámetros completos para CPT/SFT/DPO/GRPO en más de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) y más de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).

    15.488+88Variación de estrellas de los últimos 7 días
  • bisheng@dataelement

    BISHENG es una plataforma DevOps de LLM abierta para aplicaciones de IA empresarial de próxima generación. Las características potentes e integrales incluyen: flujo de trabajo GenAI, RAG, Agent, gestión unificada de modelos, evaluación, SFT, gestión de conjuntos de datos, gestión de sistemas a nivel empresarial, observabilidad y más.

    11.922+5Variación de estrellas de los últimos 7 días
  • oumi@oumi-ai

    ¡Ajusta, evalúa y despliega fácilmente Qwen, Gemma o cualquier LLM de pesos abiertos!

    9383+3Variación de estrellas de los últimos 7 días
  • AgentGuide@adongwanai

    https://adongwanai.github.io/AgentGuide | Guía de desarrollo de AI Agent | LangGraph en la práctica | RAG avanzado | Transición a LLM | Entrevistas de LLM | Ingeniero de algoritmos | Banco de preguntas de entrevistas | Aprendizaje por refuerzo | Síntesis de datos

    9116+169Variación de estrellas de los últimos 7 días
  • Soup@MakazhanAlpamys

    Ajusta LLMs desde un solo YAML. El streaming de capas entrena un modelo de 8B en una GPU de laptop de 4 GB.

    4929+1365Variación de estrellas de los últimos 7 días
  • hands-on-modern-rl@walkinglabs

    🚀 Un plan de estudios práctico y de código abierto que puentea la brecha desde los conceptos básicos de RL hasta la alineación de LLM, RLVR y sistemas de agentes avanzados.

    4199+54Variación de estrellas de los últimos 7 días
  • maxtext@AI-Hypercomputer

    ¡Un LLM para Jax simple, eficiente y escalable!

    2410+3Variación de estrellas de los últimos 7 días
  • chatglm_finetuning@ssbuild

    Ajuste fino (finetuning) de chatglm 6b y alpaca

    1526+0Variación de estrellas de los últimos 7 días
  • diy-llm@datawhalechina

    🎓 Curso sistemático de construcción de modelos de lenguaje extensos | 🛠️ Cubre ingeniería de datos de preentrenamiento, Tokenizer, Transformer, MoE, programación de GPU (CUDA/Triton), entrenamiento distribuido, leyes de escala, optimización de inferencia y alineación (SFT/RLHF/GRPO) | 🚀 6 tareas progresivas + impulsadas por código para establecer un sistema de conocimiento full-stack de LLM

    1276+19Variación de estrellas de los últimos 7 días
  • GraphGen@InternScience

    GraphGen: mejora del ajuste fino supervisado para LLMs mediante la generación de datos sintéticos basados en conocimiento

    1216+2Variación de estrellas de los últimos 7 días
  • surogate@invergent-ai

    Entrenamiento y ajuste fino a la velocidad de la luz

    813+0Variación de estrellas de los últimos 7 días
  • DeepSeek-671B-SFT-Guide@ScienceOne-AI

    Solución de código abierto para el ajuste fino de parámetros completos de DeepSeek-V3/R1 671B, que incluye código y scripts completos desde el entrenamiento hasta la inferencia, así como experiencias prácticas y conclusiones.

    812+0Variación de estrellas de los últimos 7 días
  • trainable-agents@choosewhatulike

    Código y conjuntos de datos para "Character-LLM: A Trainable Agent for Role-Playing".

    647+1Variación de estrellas de los últimos 7 días
  • tensorflow-nlp-tutorial@ukairia777

    Repositorio de Deep Learning NLP que utiliza TensorFlow para cubrir desde el preprocesamiento de texto hasta tareas posteriores con modelos modernos como Topic Models, BERT, GPT y LLM.

    581+0Variación de estrellas de los últimos 7 días
  • LoongForge@baidu-baige

    A high-performance framework for training LLMs, VLMs, diffusion, and embodied models on NVIDIA GPUs and Kunlun XPUs.

    549+15Variación de estrellas de los últimos 7 días
← Volver a temas