Aller au contenu principal
buildradar
Sign in
Sujet · stt

stt

Dépôts open source suivis étiquetés stt, triés par étoiles.

Dépôts
33
Total d'étoiles
109 255
Étoiles en moyenne
3 311
Part
0,01%

Sujets qui apparaissent souvent aux côtés de stt sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés stt.

  • floe-guard@Floe-Labs

    Compteur de dépenses et limiteur de budget pour agents vocaux IA. Mesure le STT, TTS, LLM et la téléphonie par appel (Pipecat, LiveKit — Python & TypeScript). Bloque les requêtes avant de dépasser votre plafond. Local, sans compte, sans télémétrie. Créé par Floe — contrôle des coûts pour l'IA vocale.

    434
  • khoj@khoj-ai

    Votre second cerveau basé sur l'IA. Auto-hébergeable. Obtenez des réponses depuis le web ou vos documents. Créez des agents personnalisés, planifiez des automatisations, effectuez des recherches approfondies. Transformez n'importe quel LLM local ou en ligne en votre IA autonome personnelle (gpt, claude, gemini, llama, qwen, mistral). Commencez gratuitement.

    37 010+223Évolution des étoiles sur les 7 derniers jours
  • vosk-api@alphacep

    API de reconnaissance vocale hors ligne pour Android, iOS, Raspberry Pi et serveurs avec Python, Java, C# et Node.

    15 101+17Évolution des étoiles sur les 7 derniers jours
  • moonshine@moonshine-ai

    Reconnaissance vocale, intentionnelle et synthèse vocale à très faible latence pour la création d'agents et d'interfaces vocaux.

    10 997+33Évolution des étoiles sur les 7 derniers jours
  • Vision-Agents@GetStream

    Open Vision Agents par Stream. Créez rapidement des agents vocaux et visuels avec n'importe quel modèle ou fournisseur vidéo. Utilise le réseau edge de Stream pour une latence ultra-faible.

    8 113+9Évolution des étoiles sur les 7 derniers jours
  • stt@jianchang512

    Outil de reconnaissance vocale hors ligne pour générer des sous-titres au format JSON, SRT ou texte brut.

    4 780+9Évolution des étoiles sur les 7 derniers jours
  • whishper@pluja

    Transcrivez n'importe quel audio en texte, traduisez et modifiez des sous-titres 100 % localement avec une interface web. Propulsé par les modèles whisper !

    3 068+2Évolution des étoiles sur les 7 derniers jours
  • STT@coqui-ai

    🐸STT - La boîte à outils de deep learning pour la conversion parole-texte. L'entraînement et le déploiement de modèles STT n'ont jamais été aussi simples.

    2 606+1Évolution des étoiles sur les 7 derniers jours
  • 🎙 Reconnaissance vocale utilisant le framework de deep learning TensorFlow et des réseaux de neurones sequence-to-sequence

    2 173+0Évolution des étoiles sur les 7 derniers jours
  • ElatoAI@akdeb

    Jouets vocaux IA en temps réel avec plus de 100 modèles sur Arduino ESP32, utilisant des WebSockets sécurisés et des Edge Functions pour des compagnons et appareils IA.

    1 938+5Évolution des étoiles sur les 7 derniers jours
  • Découvrez Ava, l'agent WhatsApp.

    1 675+2Évolution des étoiles sur les 7 derniers jours
  • dsnote@mkiol

    Application Linux Speech Note. Prise de notes, lecture et traduction avec reconnaissance vocale, synthèse vocale et traduction automatique hors ligne.

    1 622+8Évolution des étoiles sur les 7 derniers jours
  • dicio-android@DicioTeam

    Application d'assistant Dicio pour Android

    1 463+3Évolution des étoiles sur les 7 derniers jours
  • Speech-AI-Forge@lenML

    Speech-AI-Forge est un projet articulé autour d'un modèle de génération TTS, implémentant un serveur API et une interface Web basée sur Gradio.

    1 418+0Évolution des étoiles sur les 7 derniers jours
  • SoniTranslate@R3gm

    Traduction synchronisée pour vidéos. Doublage vidéo.

    1 413+2Évolution des étoiles sur les 7 derniers jours
  • Une liste de corpus vocaux accessibles pour l'ASR, le TTS et d'autres technologies vocales.

    1 399+0Évolution des étoiles sur les 7 derniers jours
  • Plateforme de gestion Java d'entreprise pour Xiaozhi ESP32, offrant une solution intégrée front-end, back-end et serveur pour la surveillance des appareils, la personnalisation de la voix, le changement de rôle et la gestion de l'historique des conversations.

    1 337+1Évolution des étoiles sur les 7 derniers jours
  • gp.nvim@Robitx

    Gp.nvim : plugin d'IA pour Neovim permettant des sessions ChatGPT, des opérations de texte/code instructives et la conversion parole-texte [OpenAI, Ollama, Anthropic, ..]

    1 320+0Évolution des étoiles sur les 7 derniers jours
  • my-translator@phuc-nt

    Traduction vocale en temps réel pour macOS et Windows, TTS gratuit, sans serveur, utilisant uniquement vos clés API

    1 278+2Évolution des étoiles sur les 7 derniers jours
  • sokuji@kizuna-ai-lab

    Traduction vocale bidirectionnelle en temps réel pour les réunions bilingues : détection automatique de la langue et traduction dans les deux sens, via le cloud ou entièrement hors ligne sur l'appareil. Disponible sur bureau (Windows, macOS, Linux) et via extension de navigateur (Chrome, Edge) pour Zoom, Meet, Teams et toute autre application.

    1 186+40Évolution des étoiles sur les 7 derniers jours
  • nobodywho@nobodywho-ooo

    NobodyWho est un moteur d'inférence permettant d'exécuter des LLM localement et efficacement sur n'importe quel appareil.

    1 094+13Évolution des étoiles sur les 7 derniers jours
  • voxt@hehehai

    🎙️ Un assistant vocal intelligent qui transforme la parole en texte propre, en actions utiles et en connaissances structurées. Il aide les utilisateurs à capturer des idées, communiquer naturellement, automatiser les tâches répétitives et rester productifs à travers différentes applications et flux de travail.

    807+5Évolution des étoiles sur les 7 derniers jours
  • lobe-tts@lobehub

    🎤 Lobe TTS - Une bibliothèque TTS/STT fiable et de haute qualité pour serveur et navigateur.

    805+1Évolution des étoiles sur les 7 derniers jours
  • Speech to Text to Speech. Chanson en cours de lecture. Envoie du texte sous forme de messages OSC vers VRChat pour affichage sur l'avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4Évolution des étoiles sur les 7 derniers jours
  • mlx-audio-swift@Blaizzy

    Un SDK Swift modulaire pour le traitement audio avec MLX sur Apple Silicon

    772+6Évolution des étoiles sur les 7 derniers jours
  • Exécution du modèle de reconnaissance vocale whisper.cpp dans Unity3d en local

    751+1Évolution des étoiles sur les 7 derniers jours
  • mlx-omni-server@madroidmaq

    MLX Omni Server est un serveur d'inférence local propulsé par le framework MLX d'Apple, spécifiquement conçu pour les puces Apple Silicon (série M). Il implémente des points de terminaison d'API compatibles avec OpenAI, permettant une intégration transparente avec les clients SDK OpenAI existants tout en tirant parti de la puissance de l'inférence ML locale.

    741+1Évolution des étoiles sur les 7 derniers jours
  • cheetah@Picovoice

    Moteur de diffusion de reconnaissance vocale à la volée exécuté sur appareil, alimenté par l'apprentissage profond.

    671+0Évolution des étoiles sur les 7 derniers jours
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) pour Node avec détection de mots-clés hors ligne

    638+0Évolution des étoiles sur les 7 derniers jours
  • Un composant React pour faciliter et accélérer la correction des transcriptions automatisées audio et vidéo. Par BBC News Labs. - En cours de développement

    621-1Évolution des étoiles sur les 7 derniers jours
  • CrispASR@CrispStrobe

    Hub d'exécution ggml en C++ pour les modèles ASR et TTS multilingues : Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2, etc., plus alignement forcé universel, et plus encore

    611+20Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets