speech-to-text
Dépôts open source suivis étiquetés speech-to-text, triés par étoiles.
- #61
Reconnaissance vocale locale pour macOS utilisant l'IA sur l'appareil, entièrement privée, avec option cloud
★ 1 759+0Évolution des étoiles sur les 7 derniers jours - #62
Méthode déclarative pour exécuter des modèles d'IA sur appareil dans React Native, propulsée par ExecuTorch.
★ 1 707+0Évolution des étoiles sur les 7 derniers jours - #63
Collecte de tout le contenu de Hu Chenfeng.
★ 1 650+0Évolution des étoiles sur les 7 derniers jours - #64
Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.
★ 1 622+0Évolution des étoiles sur les 7 derniers jours - #65
Plugin OBS pour la reconnaissance vocale et le sous-titrage local utilisant l'IA.
★ 1 597+0Évolution des étoiles sur les 7 derniers jours - #66
Serveur d'inférence LLM haute performance compatible OpenAI et Anthropic pour Apple Silicon. Support natif MLX, traitement par lots continu, modèles multimodaux, appel d'outils MCP et support de Claude Code.
★ 1 557+0Évolution des étoiles sur les 7 derniers jours - #67
API TikTok LIVE pour Python : la bibliothèque tierce de référence pour recevoir en temps réel les événements de livestream (commentaires, cadeaux, etc.) depuis TikTok LIVE.
★ 1 544+0Évolution des étoiles sur les 7 derniers jours - #68
Interagissez avec votre Mac et interrogez vos documents sans cloud. IA vocale locale et RAG sur appareil.
★ 1 542+0Évolution des étoiles sur les 7 derniers jours - #69
Nœuds personnalisés étendant les capacités de Comfyui.
★ 1 525+0Évolution des étoiles sur les 7 derniers jours - #70
🎙️ Application de dictée IA - Open Source et locale. ⚡ Tapez 3 fois plus vite, sans clavier. 🆓 Propulsée par des modèles open source, fonctionne hors ligne, rapide et précise.
★ 1 520+0Évolution des étoiles sur les 7 derniers jours - #71
Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.
★ 1 512+0Évolution des étoiles sur les 7 derniers jours - #72
Chaque réunion, chaque idée, chaque note vocale, consultable par votre IA. Une couche de mémoire de conversation open source axée sur la confidentialité.
★ 1 462+0Évolution des étoiles sur les 7 derniers jours - #73
Traduction synchronisée pour vidéos. Doublage vidéo.
★ 1 413+0Évolution des étoiles sur les 7 derniers jours - #74
Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.
★ 1 399+0Évolution des étoiles sur les 7 derniers jours - #75
Fine-tuning de LLM sur Mac avec Apple Silicon. Support natif MLX pour SFT, DPO, GRPO, Vision, TTS, STT, Embedding et OCR. API compatible avec Unsloth.
★ 1 398+0Évolution des étoiles sur les 7 derniers jours - #76
Application Whisper multi-backend. Ultra-rapide, optimisée pour Mac-arm, installation facile. Transcrivez des fichiers locaux ou des URL avec Whisper AI de manière totalement privée et gratuite.
★ 1 394+0Évolution des étoiles sur les 7 derniers jours - #77
Client en ligne de commande pour Whisper, compatible avec le client OpenAI original et basé sur CTranslate2.
★ 1 346+0Évolution des étoiles sur les 7 derniers jours - #78★ 1 338+0Évolution des étoiles sur les 7 derniers jours
- #79
Gp.nvim : plugin d'IA pour Neovim permettant des sessions ChatGPT, des opérations de texte/code instructives et la conversion parole-texte [OpenAI, Ollama, Anthropic, ..]
★ 1 320+0Évolution des étoiles sur les 7 derniers jours - #80
Moteur d'inférence hors ligne pour l'art, les conversations vocales en temps réel, les chatbots basés sur LLM et les flux de travail automatisés.
★ 1 314+0Évolution des étoiles sur les 7 derniers jours - #81
StreamSpeech est un modèle tout-en-un fluide pour la reconnaissance vocale, la traduction et la synthèse vocale, en mode hors ligne et simultané.
★ 1 288+0Évolution des étoiles sur les 7 derniers jours - #82★ 1 212+0Évolution des étoiles sur les 7 derniers jours
- #83
Reconnaissance vocale native pour Linux - Dictée système rapide, précise, privée et personnalisable
★ 1 189+0Évolution des étoiles sur les 7 derniers jours - #84
Studio d'IA local non censuré pour Windows, Linux et macOS. Interface graphique sans configuration pour la génération d'images, les LLM GGUF, la synthèse vocale et la reconnaissance vocale.
★ 1 118+13Évolution des étoiles sur les 7 derniers jours - #85
Vtuber IA pour le streaming sur Youtube/Twitch
★ 1 116+3Évolution des étoiles sur les 7 derniers jours - #86
Muesli - transcription et dictée de réunions locales natives pour macOS (alternative à Granola et WisprFlow)
★ 1 105+35Évolution des étoiles sur les 7 derniers jours - #87
L'application iOS open source qui rend la transcription vocale de qualité plus accessible sur les appareils mobiles.
★ 1 102+6Évolution des étoiles sur les 7 derniers jours - #88
💬📝 Une petite application de dictée utilisant le modèle de reconnaissance vocale Whisper d'OpenAI.
★ 1 100+0Évolution des étoiles sur les 7 derniers jours - #89
Transcription parole-texte entièrement locale, privée et multiplateforme avec post-traitement par LLM
★ 1 056+9Évolution des étoiles sur les 7 derniers jours - #90
SDK d'IA vocale open-source. L'alternative à Vapi/Retell pour les développeurs souhaitant maîtriser leur stack. Donnez un numéro de téléphone à votre agent IA en 4 lignes — Python et TypeScript, sous licence MIT, compatible Twilio, Telnyx et Plivo.
★ 1 051+7Évolution des étoiles sur les 7 derniers jours