voice-ai
Dépôts open source suivis étiquetés voice-ai, triés par étoiles.
Sujets associés
Sujets qui apparaissent souvent aux côtés de voice-ai sur un même dépôt.
Ascensions récentes
Dépôts créés au cours des 90 derniers jours et étiquetés voice-ai.
- #1
Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.
★ 2 358 - #2
Compteur de dépenses et limiteur de budget pour agents vocaux IA. Mesure le STT, TTS, LLM et la téléphonie par appel (Pipecat, LiveKit — Python & TypeScript). Bloque les requêtes avant de dépasser votre plafond. Local, sans compte, sans télémétrie. Créé par Floe — contrôle des coûts pour l'IA vocale.
★ 434
- #1★ 52 177+379Évolution des étoiles sur les 7 derniers jours
- #2★ 20 664+85Évolution des étoiles sur les 7 derniers jours
- #3
VoiceStudio est l'alternative open source et entièrement locale à ElevenLabs : clonage vocal, design vocal, doublage vidéo, dictée, transcription et création de livres audio en 646 langues.
★ 14 835+2 880Évolution des étoiles sur les 7 derniers jours - #4
Boîte à outils prête pour la production pour exécuter l'IA localement.
★ 10 281+1Évolution des étoiles sur les 7 derniers jours - #5
Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.
★ 9 209+37Évolution des étoiles sur les 7 derniers jours - #6
Open Vision Agents par Stream. Créez rapidement des agents vocaux et visuels avec n'importe quel modèle ou fournisseur vidéo. Utilise le réseau edge de Stream pour une latence ultra-faible.
★ 8 113+9Évolution des étoiles sur les 7 derniers jours - #7
Exécutez Claude Code à 100 % sur l'appareil avec une IA locale sur Apple Silicon. Serveur Anthropic-API natif MLX. Inclut 6 modèles dont Muse-Glimmer 30B (désormais multimodal, lit les images, abliterated), Gemma 4 31B, Qwen 3.5 122B (65 tok/s), DeepSeek V4 Flash (1M ctx). Privé, hors ligne, prêt pour les environnements isolés. Conçu pour les flux de travail juridiques, de santé ou sous NDA.
★ 3 255+12Évolution des étoiles sur les 7 derniers jours - #8
Voice AI SDK est une bibliothèque Android réutilisable permettant d'intégrer en quelques minutes un pipeline complet de conversation IA vocale dans n'importe quelle application. Assistant vocal + Voice AI Android + SDK + MVVM + Kotlin.
★ 2 580+0Évolution des étoiles sur les 7 derniers jours - #9
Le système d'auto-codage pour votre application — SDK Alan AI pour le Web
★ 2 427-3Évolution des étoiles sur les 7 derniers jours - #10
Un moteur d'exécution vocal en temps réel permettant aux agents de communiquer, de travailler et d'être présents. Moteur d'exécution vocal en temps réel pour agents IA.
★ 2 358+68Évolution des étoiles sur les 7 derniers jours - #11
Le système d'auto-codage pour votre application — SDK Alan AI pour iOS
★ 1 878-3Évolution des étoiles sur les 7 derniers jours - #12
Le système d'auto-codage pour votre application — SDK Alan AI pour Flutter
★ 1 756-1Évolution des étoiles sur les 7 derniers jours - #13
Le système d'auto-codage pour votre application — SDK Alan AI pour Ionic.
★ 1 649-1Évolution des étoiles sur les 7 derniers jours - #14
Anciennement Better Chatbot. Navigator est un espace de travail IA open source pour les agents, MCP et l'automatisation des flux de travail.
★ 1 171+1Évolution des étoiles sur les 7 derniers jours - #15
SDK d'IA vocale open-source. L'alternative à Vapi/Retell pour les développeurs souhaitant maîtriser leur stack. Donnez un numéro de téléphone à votre agent IA en 4 lignes — Python et TypeScript, sous licence MIT, compatible Twilio, Telnyx et Plivo.
★ 1 050+10Évolution des étoiles sur les 7 derniers jours - #16
Modèles Whisper optimisés pour le streaming et l'utilisation sur appareil
★ 897+0Évolution des étoiles sur les 7 derniers jours - #17
Assistant vocal en temps réel — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatible avec l'API OpenAI Realtime. Clonage vocal, interruption (barge-in), ~9× temps réel sur une 4090. Licence Apache 2.0.
★ 756+9Évolution des étoiles sur les 7 derniers jours - #18
Rapida est une plateforme d'orchestration d'IA vocale open source pour créer des agents conversationnels en temps réel avec streaming audio, STT, TTS, VAD, intégration multicanal, gestion d'état et observabilité.
★ 721+1Évolution des étoiles sur les 7 derniers jours - #19
JARVIS — Un assistant IA vocal pour macOS, inspiré du MCU. Parlez à votre ordinateur, il vous répond et exécute des tâches.
★ 716+9Évolution des étoiles sur les 7 derniers jours - #20
Couche de récupération pour les systèmes IA de production. Recherche ultra‑rapide (<10 ms) sans bases de données vectorielles. Conçue pour le browser, le edge, l'on‑device et le cloud.
★ 671+4Évolution des étoiles sur les 7 derniers jours - #21
Cadre d'agents IA TypeScript : mémoire cognitive, forge d'outils d'exécution, orchestration multi‑agents, 11 fournisseurs de LLM
★ 621+2Évolution des étoiles sur les 7 derniers jours - #22
Le système d'autocodage pour votre application — Alan AI SDK pour React Native
★ 575+0Évolution des étoiles sur les 7 derniers jours - #23★ 563-1Évolution des étoiles sur les 7 derniers jours
- #24
Le premier modèle de dialogue parlé en temps réel de bout en bout open-source au monde avec clonage de voix personnalisé.
★ 549-1Évolution des étoiles sur les 7 derniers jours