Aller au contenu principal
buildradar
Sign in
Sujet · transcription

transcription

Dépôts open source suivis étiquetés transcription, triés par étoiles.

Dépôts
53
Total d'étoiles
175 951
Étoiles en moyenne
3 320
Part
0,01%

Sujets qui apparaissent souvent aux côtés de transcription sur un même dépôt.

Ascensions récentes

Dépôts créés au cours des 90 derniers jours et étiquetés transcription.

  • claude-real-video@HUANGCHIHHUNGLeo

    Permet à Claude (ou tout autre LLM) de visionner une vidéo : analyse de scènes, déduplication d'images et transcription, à partir d'une URL ou d'un fichier local. Exécution locale, sous licence MIT.

    2 109
  • rescript@wassgha

    Éditeur vidéo/audio open source basé sur la transcription, fonctionnant dans le navigateur.

    865
  • meetily@Zackriya-Solutions

    Assistant de réunion IA axé sur la confidentialité, avec transcription en direct 4x plus rapide via Parakeet/Whisper, diarisation des locuteurs et résumé par Ollama, le tout en Rust. Traitement 100 % local, sans cloud. Meetily est l'outil open-source auto-hébergé de prise de notes de réunion pour macOS et Windows.

    30 252+195Évolution des étoiles sur les 7 derniers jours
  • FunASR@modelscope

    Boîte à outils de reconnaissance vocale open source pour l'entraînement, l'inférence, l'ASR en streaming, le VAD, la ponctuation, les pipelines de diarisation du locuteur et le service compatible OpenAI/MCP.

    20 136+64Évolution des étoiles sur les 7 derniers jours
  • VoiceStudio@debpalash

    VoiceStudio est l'alternative open source et entièrement locale à ElevenLabs : clonage vocal, design vocal, doublage vidéo, dictée, transcription et création de livres audio en 646 langues.

    14 835+2 880Évolution des étoiles sur les 7 derniers jours
  • omi@BasedHardware

    Une IA qui observe votre écran, écoute vos conversations et vous guide sur les actions à entreprendre.

    13 377+46Évolution des étoiles sur les 7 derniers jours
  • voice-pro@abus-aikorea

    Interface Web Gradio pour créateurs et développeurs, intégrant des fonctionnalités clés de TTS (Edge-TTS, kokoro) et de clonage vocal zero-shot (E2 & F5-TTS, CosyVoice), avec traitement audio Whisper, téléchargement YouTube, isolation vocale Demucs et traduction multilingue.

    12 730+54Évolution des étoiles sur les 7 derniers jours
  • SenseVoice@QwenAudio

    Modèle open source SenseVoiceSmall pour la reconnaissance vocale (ASR) en mandarin, cantonais, anglais, japonais et coréen, incluant l'identification de la langue, la reconnaissance des émotions et la détection d'événements audio.

    9 209+37Évolution des étoiles sur les 7 derniers jours
  • FunClip@modelscope

    Outil de transcription vidéo, de génération de sous-titres et de découpage assisté par LLM basé sur FunASR, avec une interface Gradio locale.

    6 210+13Évolution des étoiles sur les 7 derniers jours
  • basic-pitch@spotify

    Un convertisseur audio-vers-MIDI léger mais puissant avec détection de pitch bend.

    5 522+21Évolution des étoiles sur les 7 derniers jours
  • auto-subs@tmoroney

    Génération de sous-titres sur l'appareil, avec intégration directe pour DaVinci Resolve, Premiere et After Effects.

    4 122+20Évolution des étoiles sur les 7 derniers jours
  • speaches@speaches-ai
    3 638+8Évolution des étoiles sur les 7 derniers jours
  • whishper@pluja

    Transcrivez n'importe quel audio en texte, traduisez et modifiez des sous-titres 100 % localement avec une interface web. Propulsé par les modèles whisper !

    3 068+2Évolution des étoiles sur les 7 derniers jours
  • Scriberr@rishikanthc

    Transcription audio par IA auto-hébergée.

    3 016+14Évolution des étoiles sur les 7 derniers jours
  • Hex@kitlangton

    VOIX → MOTS

    2 893+2Évolution des étoiles sur les 7 derniers jours
  • vexa@Vexa-ai

    API open-source de transcription de réunions pour Google Meet, Microsoft Teams et Zoom. Inclut des bots de connexion automatique, des transcriptions WebSocket en temps réel et un serveur MCP pour les agents IA. Auto-hébergement ou SaaS disponible.

    2 741+15Évolution des étoiles sur les 7 derniers jours
  • awesome-whisper@sindresorhus

    Liste de ressources pour Whisper, un système de reconnaissance vocale open-source propulsé par l'IA développé par OpenAI

    2 375+1Évolution des étoiles sur les 7 derniers jours
  • kalosm@floneum

    Modèles d'IA pré-entraînés instantanés, contrôlables et locaux en Rust

    2 226+3Évolution des étoiles sur les 7 derniers jours
  • noScribe@kaixxx

    Technologie IA de pointe pour la transcription audio automatisée. Une interface graphique pour Whisper d'OpenAI et pyannote (identification du locuteur)

    2 145+8Évolution des étoiles sur les 7 derniers jours
  • claude-real-video@HUANGCHIHHUNGLeo

    Permet à Claude (ou tout autre LLM) de visionner une vidéo : analyse de scènes, déduplication d'images et transcription, à partir d'une URL ou d'un fichier local. Exécution locale, sous licence MIT.

    2 109+20Évolution des étoiles sur les 7 derniers jours
  • diart@juanmc2005

    Un package Python pour créer des applications audio en temps réel basées sur l'IA.

    2 024+1Évolution des étoiles sur les 7 derniers jours
  • audapolis@bugbakery

    Un éditeur pour l'audio parlé avec transcription automatique

    1 892+2Évolution des étoiles sur les 7 derniers jours
  • typewhisper-mac@TypeWhisper

    Reconnaissance vocale locale pour macOS utilisant l'IA sur l'appareil, entièrement privée, avec option cloud

    1 759+12Évolution des étoiles sur les 7 derniers jours
  • Plugin OBS pour la reconnaissance vocale et le sous-titrage local utilisant l'IA.

    1 597+8Évolution des étoiles sur les 7 derniers jours
  • amical@amicalhq

    🎙️ Application de dictée IA - Open Source et locale. ⚡ Tapez 3 fois plus vite, sans clavier. 🆓 Propulsée par des modèles open source, fonctionne hors ligne, rapide et précise.

    1 520+8Évolution des étoiles sur les 7 derniers jours
  • pianotrans@azuwis

    Interface graphique simple pour la transcription de piano avec pédales de ByteDance

    1 514+3Évolution des étoiles sur les 7 derniers jours
  • Fun-ASR@QwenAudio

    Famille de modèles ASR open-source basés sur LLM pour le chinois, les dialectes, les accents et la parole multilingue, avec runtimes FunASR, vLLM, streaming et llama.cpp.

    1 512+10Évolution des étoiles sur les 7 derniers jours
  • minutes@silverstein

    Chaque réunion, chaque idée, chaque note vocale, consultable par votre IA. Une couche de mémoire de conversation open source axée sur la confidentialité.

    1 462+6Évolution des étoiles sur les 7 derniers jours
  • Application Whisper multi-backend. Ultra-rapide, optimisée pour Mac-arm, installation facile. Transcrivez des fichiers locaux ou des URL avec Whisper AI de manière totalement privée et gratuite.

    1 394+0Évolution des étoiles sur les 7 derniers jours
  • CrisperWhisper@nyrahealth

    Transcription contrôlable. Verbatim (chaque mot, remplissage, pause, bégaiement, son vocal) ou intentionnelle (ce que l'orateur voulait dire, optimisé pour la lisibilité) avec horodatage au niveau du mot.

    1 371+13Évolution des étoiles sur les 7 derniers jours
  • book@hardhackerlabs

    Hardcore Hacker - Le parcours vers 12 000 $ d'ARR en deux mois. Ce livre documente l'histoire du produit Podwise, couvrant l'inspiration, la construction, le lancement, la croissance et l'analyse rétrospective.

    1 370+0Évolution des étoiles sur les 7 derniers jours
  • Génération de sous-titres vidéo et audio au format srt. Transcription locale sans API tierce. Cadre de génération de sous-titres basé sur Transformer. Outil GUI pour générer des sous-titres à partir de vidéos.

    1 179+3Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets