qwen3
Repositorios de código abierto monitorizados etiquetados con qwen3, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a qwen3 en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con qwen3.
- #1
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1191 - #2
Qwen3.8-27B (bf16) on a free Kaggle TPU: OpenAI-compatible endpoint, 262k context, ~130 tok/s, works with Claude Code, Codex, Opencode and Pi.
★ 142
- #1
Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs
★ 90.817+402Variación de estrellas de los últimos 7 días - #2
🔥 MaxKB es una plataforma de código abierto para construir agentes de nivel empresarial.
★ 22.699+52Variación de estrellas de los últimos 7 días - #3
Usa PEFT o parámetros completos para CPT/SFT/DPO/GRPO en más de 600 LLMs (Qwen3.6, DeepSeek-V4, GLM-5.1, InternLM3, Llama4, ...) y más de 300 MLLMs (Qwen3-VL, Qwen3-Omni, InternVL3.5, Ovis2.5, GLM4.5v, Gemma4, Llava, Phi4, ...) (AAAI 2025).
★ 15.488+88Variación de estrellas de los últimos 7 días - #4
Agent Reinforcement Trainer: entrena agentes multipaso para tareas del mundo real utilizando GRPO. Dale a tus agentes entrenamiento práctico. ¡Aprendizaje por refuerzo para Qwen3.6, GPT-OSS, Llama y más!
★ 10.689+10Variación de estrellas de los últimos 7 días - #5
Ejecuta LLMs y VLMs de vanguardia localmente en dispositivos Qualcomm a través de NPU, GPU y CPU con unas pocas líneas de código
★ 8347+9Variación de estrellas de los últimos 7 días - #6
Alternativa de código abierto de investigación profunda para razonar y buscar en datos privados. Escrito en Python.
★ 8251+20Variación de estrellas de los últimos 7 días - #7
📚 Una lista seleccionada de los mejores artículos de inferencia LLM/VLM con código: Flash-Attention, Paged-Attention, WINT8/4, paralelismo, etc. 🎉
★ 5482+3Variación de estrellas de los últimos 7 días - #8
Una aplicación nativa de macOS que permite a los usuarios chatear con un LLM local capaz de responder con información de archivos, carpetas y sitios web en tu Mac sin instalar ningún otro software. Desarrollado con llama.cpp.
★ 3312-2Variación de estrellas de los últimos 7 días - #9
Generador de subtítulos ASR/STT. Utiliza Qwen3-ASR, LLM local, Whisper, TEN-VAD. Robusto frente al ruido para JAV
★ 2196+17Variación de estrellas de los últimos 7 días - #10
kubewall - Dashboard de Kubernetes de un solo binario con gestión multiclúster e integración de IA. (OpenAI / Claude 4 / Gemini / DeepSeek / OpenRouter / Ollama / Qwen / LMStudio)
★ 1933+3Variación de estrellas de los últimos 7 días - #11
Chat2API permite el acceso sin costo a modelos de IA líderes aprovechando las interfaces web oficiales. Soporta proveedores como DeepSeek, GLM, Kimi, MiniMax, Qwen y Z.ai, e integra perfectamente con herramientas como openlcaw, Cline y Roo-Code.
★ 1560+16Variación de estrellas de los últimos 7 días - #12
Habla con tu Mac, consulta tus documentos, sin necesidad de la nube. IA de voz en el dispositivo + RAG.
★ 1542+0Variación de estrellas de los últimos 7 días - #13
Herramienta impulsada por IA para la revisión eficiente de resúmenes y archivos PDF en revisiones sistemáticas.
★ 1328+0Variación de estrellas de los últimos 7 días - #14
Framework totalmente abierto para el entrenamiento multimodal democratizado.
★ 1195+1Variación de estrellas de los últimos 7 días - #15
Qwen3.8-27B on a single RTX 3090 with vLLM: ~1,000 tok/s at 64 concurrent (int8 tensor-core GEMMs, fp16 DeltaNet state), ~114 tok/s single-user at default sampling / ~124 greedy (MTP drafts, own-output draft vocab, calibrated int4 lm_head, split-KV verify attention), 150k-262k context; patches, requant scripts, benchmarks
★ 1191+285Variación de estrellas de los últimos 7 días - #16
Genera imágenes desde cualquier punto de vista de cámara mediante control interactivo 3D. Arrastra la cámara en el espacio 3D o usa deslizadores para ajustar azimut, elevación y distancia. Construido con Three.js y Gradio, con interfaz bilingüe en chino e inglés.
★ 942+188Variación de estrellas de los últimos 7 días - #17
大模型API网关-全新AI大模型接口管理与API聚合分发系统 , 支持将多种大模型转换成统一的OpenAI兼容接口,Claude接口,Gemini接口,可供个人或者企业内部大模型API 统一管理和渠道分发使用(key管理与二次分发),支持国际国内所有主流大模型,gemini,claude,qwen3,kimi-k2,豆包等,提供单可执行文件, docker镜像,一键部署,开箱即用,完全开源,自主可控!本项目基于New-API和One-API,整合了NewAPI,OneAPI所有功能及众多第三方插件为一身,功能超强!
★ 916+8Variación de estrellas de los últimos 7 días - #18
Biblioteca de entrenamiento nativo distribuido de Pytorch para LLMs/VLMs con soporte inmediato para Hugging Face
★ 906+24Variación de estrellas de los últimos 7 días - #19★ 855+15Variación de estrellas de los últimos 7 días
- #20
Una colección de proyectos públicos sobre modelos de lenguaje extensos (LLM), modelos de lenguaje visual (VLM), acción de lenguaje visual (VLA), contenido generado por IA (AIGC), y sus conjuntos de datos y aplicaciones relacionados.
★ 815+1Variación de estrellas de los últimos 7 días - #21
MimikaStudio: una aplicación local-first para macOS (Apple Silicon) con soporte para agentes MCP.
★ 731+0Variación de estrellas de los últimos 7 días - #22
Motor de inferencia LLM en Rust puro + CUDA; sin PyTorch, compatible con OpenAI, sirve desde Qwen3 hasta Kimi-K2
★ 677+14Variación de estrellas de los últimos 7 días - #23★ 559+0Variación de estrellas de los últimos 7 días
- #24★ 513+7Variación de estrellas de los últimos 7 días