whisper
Repositórios de código aberto acompanhados marcados com whisper, ordenados por estrelas.
- #91
Software de geração automática de legendas completo, cobrindo todo o processo de download, transcrição, tradução e gravação, sem necessidade de intervenção humana.
★ 811+3Variação de estrelas nos últimos 7 dias - #92
Ditado de voz gratuito, de código aberto e 100% offline para Linux. Fale e digite em qualquer lugar via motores whisper.cpp, Whisper e VOSK, acelerado por GPU, funciona em X11 + Wayland!
★ 808+21Variação de estrelas nos últimos 7 dias - #93
🎙️ Um assistente de produtividade de voz inteligente que transforma fala em texto limpo, ações úteis e conhecimento estruturado. Ajuda os usuários a capturar ideias, comunicar-se naturalmente, automatizar tarefas repetitivas e manter a produtividade em diferentes aplicativos e fluxos de trabalho.
★ 807+5Variação de estrelas nos últimos 7 dias - #94
Binding para React Native do whisper.cpp.
★ 801-1Variação de estrelas nos últimos 7 dias - #95
Chatbot de voz local para conversas envolventes, utilizando Ollama, Hugging Face Transformers e Coqui TTS Toolkit.
★ 788+1Variação de estrelas nos últimos 7 dias - #96
Projeto que permite usar um microfone com o OpenAI Whisper.
★ 787+0Variação de estrelas nos últimos 7 dias - #97
React hook para OpenAI Whisper com gravador de voz, transcrição em tempo real e remoção de silêncio integrada
★ 786+0Variação de estrelas nos últimos 7 dias - #98
🎤 A maneira mais fácil de transcrever áudio em Swift
★ 785-1Variação de estrelas nos últimos 7 dias - #99
BiBi Keyboard: um aplicativo de teclado com método de entrada de voz por LLM e ASR para a plataforma Android baseado em Kotlin
★ 772+17Variação de estrelas nos últimos 7 dias - #100
Seu assistente de edição de vídeo baseado em CrewAI.
★ 762+1Variação de estrelas nos últimos 7 dias - #101
Assistente de voz em tempo real — streaming WebRTC, ASR faster-whisper, LLM local, TTS Vui Nano (300M). Compatível com a API Realtime da OpenAI. Clonagem de voz, interrupção (barge-in), ~9× em tempo real em uma 4090. Apache 2.0.
★ 757+10Variação de estrelas nos últimos 7 dias - #102
Executando o modelo de fala para texto (whisper.cpp) no Unity3d em sua máquina local.
★ 751+1Variação de estrelas nos últimos 7 dias - #103★ 750+6Variação de estrelas nos últimos 7 dias
- #104
Um aplicativo de Speech-To-Text totalmente local e privado, oferecendo múltiplos backends de modelos, diarização e modo de calendário - Disponível para Windows, macOS e Linux
★ 716+5Variação de estrelas nos últimos 7 dias - #105
Resumo de reuniões de IA de código aberto, com foco em privacidade e nativo para macOS
★ 712+2Variação de estrelas nos últimos 7 dias - #106
Transforme facilmente uma playlist inteira do YouTube em transcrições de alta qualidade usando o Whisper.
★ 689+2Variação de estrelas nos últimos 7 dias - #107
Reconhecimento de fala offline com OpenAI Whisper e TensorFlow Lite para Android
★ 688+0Variação de estrelas nos últimos 7 dias - #108
Um aplicativo de desktop local e gratuito para extrair legendas (SRT) de vídeos e traduzi-las para qualquer idioma — uso ilimitado, sem cadastro, sem nuvem.
★ 682+22Variação de estrelas nos últimos 7 dias - #109★ 677+0Variação de estrelas nos últimos 7 dias
- #110
Transcreva e traduza áudio em arquivos LRC usando Whisper e LLMs (GPT, Claude, etc.).
★ 675+1Variação de estrelas nos últimos 7 dias - #111
Um aplicativo de transcrição e tradução de fala em tempo real usando o Whisper da OpenAI e API de tradução gratuita. Interface feita usando Tkinter. Código escrito inteiramente em Python.
★ 660+1Variação de estrelas nos últimos 7 dias - #112★ 657+1Variação de estrelas nos últimos 7 dias
- #113
Editor de Método de Entrada (IME) para Android baseado no Whisper
★ 633+6Variação de estrelas nos últimos 7 dias - #114
Transcrição em tempo real usando faster-whisper
★ 614+0Variação de estrelas nos últimos 7 dias - #115★ 592+0Variação de estrelas nos últimos 7 dias
- #116
SDK de IA local open-source - execute IA no dispositivo sem nuvem e sem chaves de API. Suporta GGUF, RAG, geração de imagem, música e vídeo, conversão de fala em texto, inferência P2P e muito mais. Multiplataforma: Linux, macOS, Windows, Android, iOS.
★ 591+33Variação de estrelas nos últimos 7 dias - #117★ 589+0Variação de estrelas nos últimos 7 dias
- #118
Um pipeline otimizado de Speech-to-Text para o modelo Whisper, suportando múltiplos motores de inferência
★ 578+1Variação de estrelas nos últimos 7 dias - #119★ 578+8Variação de estrelas nos últimos 7 dias
- #120
Resumos de vídeo por IA e base de conhecimento para Bilibili, YouTube e vídeos locais.
★ 565+30Variação de estrelas nos últimos 7 dias