funasr
Repositórios de código aberto acompanhados marcados com funasr, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de funasr no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com funasr.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Kit de ferramentas de reconhecimento de fala de código aberto para treinamento, inferência, streaming ASR, VAD, pontuação, pipelines de diarização de locutores e atendimento compatível com OpenAI/MCP.
★ 20.136+64Variação de estrelas nos últimos 7 dias - #2
Modelo SenseVoiceSmall de código aberto para ASR em mandarim, cantonês, inglês, japonês e coreano, identificação de idioma, reconhecimento de emoção e detecção de eventos de áudio.
★ 9.209+37Variação de estrelas nos últimos 7 dias - #3
Ferramenta de transcrição de vídeo, geração de legendas e edição assistida por LLM baseada em FunASR, com interface Gradio local.
★ 6.210+13Variação de estrelas nos últimos 7 dias - #4
Aplicativo desktop gratuito e de código aberto para gerar, traduzir, dublar e embutir legendas em vídeos — conversão de voz em texto local com Whisper, dublagem por IA e clonagem de voz, offline e com aceleração por GPU.
★ 4.863+48Variação de estrelas nos últimos 7 dias - #5
Extraia rapidamente conteúdo de áudio e vídeo e organize-o em notas estruturadas em markdown.
★ 2.483+7Variação de estrelas nos últimos 7 dias - #6
Alternativa open source e gratuita ao Wispr Flow | Fluxo de trabalho de voz para desktop em chinês de próxima geração, integrando o modelo local FunASR e modelos de linguagem grandes configuráveis.
★ 2.278+5Variação de estrelas nos últimos 7 dias - #7
Bailing é um robô de diálogo por voz semelhante ao GPT-4o, implementado via ASR+LLM+TTS, integrado com grandes modelos como o DeepSeek R1 e openClaw. Um verdadeiro assistente de voz pessoal com latência de até 800ms, capaz de rodar em dispositivos de baixa configuração como Mac e com suporte a interrupções.
★ 1.759+2Variação de estrelas nos últimos 7 dias - #8
Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.
★ 1.512+10Variação de estrelas nos últimos 7 dias - #9
O MTools é um aplicativo de desktop multifuncional poderoso que integra processamento de áudio e vídeo, edição de imagem, manipulação de texto e ferramentas de codificação, com recursos de IA integrados. Projetado para simplificar seu fluxo de trabalho e aumentar a produtividade.
★ 1.305+5Variação de estrelas nos últimos 7 dias - #10
VocoType é uma ferramenta de entrada de voz local, privada e segura que converte voz em texto em tempo real via atalhos de teclado. Suporta MCP de voz para texto, otimização de texto por IA, dicionários de substituição personalizados e transcrição de áudio/vídeo.
★ 928+5Variação de estrelas nos últimos 7 dias - #11
Tradução de áudio em tempo real: captura o áudio do sistema e microfone, executa ASR (Whisper/SenseVoice) e traduz via API de LLM com exibição em streaming. Ideal para VTubers, streamers e consumo de conteúdo em idioma estrangeiro no Windows.
★ 625+34Variação de estrelas nos últimos 7 dias