qwen
Repositorios de código abierto monitorizados etiquetados con qwen, ordenados por estrellas.
- #91
Repositorio oficial de SINQ: un método de cuantización novedoso, rápido y de alta calidad diseñado para reducir el tamaño de cualquier modelo de lenguaje grande preservando la precisión [ICML 2026]
★ 630+1Variación de estrellas de los últimos 7 días - #92
Swiftlet es un entorno de ejecución de Swift y Metal que ejecuta modelos de mezcla de expertos Qwen de gran tamaño localmente en dispositivos Apple mediante la transmisión de pesos de expertos desde el almacenamiento, permitiendo ejecutar modelos de 35B y 80B con poca memoria RAM, incluso en iPhone.
★ 628+58Variación de estrellas de los últimos 7 días - #93
ComfyUI DyPE+SEGA, permite la generación de imágenes 4K+ sin artefactos: Z-Image, Qwen, Flux, Krea2
★ 623+7Variación de estrellas de los últimos 7 días - #94
Ajuste fino (finetuning) fácil y eficiente para LLMs. (Compatible con LLama, LLama2, LLama3, Qwen, Baichuan, GLM, Falcon). Entrenamiento y despliegue eficiente de cuantización para grandes modelos.
★ 621+0Variación de estrellas de los últimos 7 días - #95★ 605+2Variación de estrellas de los últimos 7 días
- #96
🔴 ¡LISTA MUY GRANDE DE HERRAMIENTAS DE IA! 🔴 Lista seleccionada de herramientas de IA - Actualizada en 2026
★ 578+5Variación de estrellas de los últimos 7 días - #97
Plantilla MVP para una interfaz web de Chat Bot de un solo turno, desarrollada con Vue 3, Vite8, TypeScript, Naive UI, Pinia(v3) y UnoCSS. Integración sencilla de API de modelos grandes, modo de respuesta independiente sin contexto, soporte para efecto de escritura SSE, previsualización de markdown-it con Mermaid/KaTex/LaTex, y soporte para modelos como Deepseek V4/V3/R1 con etiquetas <think>.
★ 575+1Variación de estrellas de los últimos 7 días - #98
Proyecto ideal para contrataciones universitarias, de otoño, primavera y pasantías, que te guía en la implementación desde cero de un marco de inferencia de grandes modelos compatible con Llama2/3 y Qwen2.5.
★ 573+1Variación de estrellas de los últimos 7 días - #99
Ejecuta Qwen3-TTS de texto a voz localmente en Mac (M1/M2/M3/M4). Clonación de voz, diseño de voz y voces personalizadas. 100% offline usando MLX.
★ 561+4Variación de estrellas de los últimos 7 días - #100★ 559+0Variación de estrellas de los últimos 7 días
- #101★ 555+3Variación de estrellas de los últimos 7 días
- #102
FlashRT es un motor de inferencia en tiempo real de alto rendimiento para cargas de trabajo de IA de lotes pequeños y sensibles a la latencia. Su integración principal es el control VLA de producción para Pi0, Pi0.5, GROOT N1.6 y Pi0-FAST. También admite LLM como qwen3.6-27B.
★ 553+18Variación de estrellas de los últimos 7 días - #103★ 552—Variación de estrellas de los últimos 7 días
- #104
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 549—Variación de estrellas de los últimos 7 días - #105
CLI-first orchestration for AI coding agents: run selected agents and models in parallel, compare raw answers, and coordinate review or implementation workflows.
★ 514+8Variación de estrellas de los últimos 7 días - #106
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Variación de estrellas de los últimos 7 días - #107
A curated list of awesome tools, extensions, and resources for Gemini CLI.
★ 503—Variación de estrellas de los últimos 7 días