voice-ai
Repositorios de código abierto monitorizados etiquetados con voice-ai, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a voice-ai en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con voice-ai.
- #1
Un tiempo de ejecución de voz en tiempo real que mantiene a los agentes hablando, trabajando y presentes. Tiempo de ejecución de voz en tiempo real para agentes de IA
★ 2362 - #2
Medidor de gastos y control de presupuesto para agentes de voz con IA. Mide STT, TTS, LLM y telefonía por llamada (Pipecat, LiveKit — Python y TypeScript). Detiene la ejecución antes de exceder el límite establecido. Local, sin cuentas ni telemetría. Creado por Floe para el control de costes en Voice AI.
★ 434
- #1★ 52.177+379Variación de estrellas de los últimos 7 días
- #2★ 20.664+85Variación de estrellas de los últimos 7 días
- #3
VoiceStudio es la alternativa a ElevenLabs de código abierto y totalmente local: clonación de voz, diseño de voz, doblaje de vídeo, dictado, transcripción y creación de audiolibros en 646 idiomas.
★ 14.835+2880Variación de estrellas de los últimos 7 días - #4
Herramientas listas para producción para ejecutar IA de forma local.
★ 10.281+1Variación de estrellas de los últimos 7 días - #5
Modelo de código abierto SenseVoiceSmall para ASR en mandarín, cantonés, inglés, japonés y coreano, identificación de idiomas, reconocimiento de emociones y detección de eventos de audio.
★ 9209+37Variación de estrellas de los últimos 7 días - #6
Open Vision Agents de Stream. Crea agentes de voz y visión rápidamente con cualquier modelo o proveedor de video. Utiliza la red perimetral de Stream para una latencia ultrabaja.
★ 8113+9Variación de estrellas de los últimos 7 días - #7
Ejecuta Claude Code 100% en el dispositivo con IA local en Apple Silicon. Servidor de API de Anthropic nativo de MLX. 6 luchadores incl. Muse-Glimmer 30B (ahora multimodal — lee imágenes, abliterado), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privado, sin conexión, listo para air-gap. Diseñado para flujos de trabajo de NDA / legales / de salud.
★ 3255+12Variación de estrellas de los últimos 7 días - #8
Voice AI SDK es una biblioteca reutilizable para Android que proporciona a cualquier aplicación una tubería de conversación de IA totalmente controlada por voz en minutos. Asistente de voz + AI de voz para Android + SDK + MVVM + Kotlin
★ 2580+0Variación de estrellas de los últimos 7 días - #9
El sistema de autocodificación para tu aplicación — Alan AI SDK para Web.
★ 2427-3Variación de estrellas de los últimos 7 días - #10
Un tiempo de ejecución de voz en tiempo real que mantiene a los agentes hablando, trabajando y presentes. Tiempo de ejecución de voz en tiempo real para agentes de IA
★ 2362+72Variación de estrellas de los últimos 7 días - #11
El sistema de autocodificación para tu app — Alan AI SDK para iOS
★ 1878-3Variación de estrellas de los últimos 7 días - #12
El sistema de autocodificación para tu aplicación: Alan AI SDK para Flutter.
★ 1756-1Variación de estrellas de los últimos 7 días - #13
El sistema de autocodificación para su aplicación: SDK de Alan AI para Ionic.
★ 1649-1Variación de estrellas de los últimos 7 días - #14
Anteriormente Better Chatbot. Navigator es un espacio de trabajo de IA de código abierto para agentes, MCP y automatización de flujos de trabajo.
★ 1171+1Variación de estrellas de los últimos 7 días - #15
SDK de voz con IA de código abierto. La alternativa a Vapi/Retell para desarrolladores que desean ser dueños de su stack. Asigna un número de teléfono a tu agente de IA en 4 líneas: Python y TypeScript, bajo licencia MIT, compatible con Twilio, Telnyx y Plivo.
★ 1051+11Variación de estrellas de los últimos 7 días - #16
Modelos Whisper optimizados para streaming y uso en dispositivos.
★ 897+0Variación de estrellas de los últimos 7 días - #17
Asistente de voz en tiempo real: streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible con la API Realtime de OpenAI. Clonación de voz, interrupción (barge-in), ~9x tiempo real en una 4090. Licencia Apache 2.0.
★ 757+10Variación de estrellas de los últimos 7 días - #18
JARVIS: un asistente de IA basado en voz para macOS, inspirado en el MCU. Habla con tu computadora, responde y realiza tareas.
★ 733+16Variación de estrellas de los últimos 7 días - #19
Rapida es una plataforma de orquestación de voz con IA de código abierto para crear agentes de voz conversacionales en tiempo real, con streaming de audio, STT, TTS, VAD, integración multicanal, gestión de estado del agente y observabilidad.
★ 722+1Variación de estrellas de los últimos 7 días - #20
La capa de recuperación para sistemas de IA en producción. Búsqueda ultrarrápida (<10ms) sin bases de datos vectoriales. Diseñado para navegador, edge, dispositivos y la nube.
★ 670+4Variación de estrellas de los últimos 7 días - #21
Framework de agentes de IA en TypeScript: memoria cognitiva, creación de herramientas en tiempo de ejecución, orquestación multi-agente y 11 proveedores de LLM
★ 622+2Variación de estrellas de los últimos 7 días - #22
El sistema de autocodificación para tu aplicación: Alan AI SDK para React Native
★ 575+0Variación de estrellas de los últimos 7 días - #23★ 563-1Variación de estrellas de los últimos 7 días
- #24
El primer modelo de diálogo hablado de extremo a extremo en tiempo real de código abierto con clonación de voz personalizada.
★ 549-1Variación de estrellas de los últimos 7 días