Pular para o conteúdo principal
buildradar
Sign in
Tópico · funasr

funasr

Repositórios de código aberto acompanhados marcados com funasr, ordenados por estrelas.

Repositórios
11
Total de estrelas
51.274
Média de estrelas
4.661
Participação
0,00%

Tópicos que aparecem com frequência ao lado de funasr no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com funasr.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • FunASR@modelscope

    Kit de ferramentas de reconhecimento de fala de código aberto para treinamento, inferência, streaming ASR, VAD, pontuação, pipelines de diarização de locutores e atendimento compatível com OpenAI/MCP.

    20.136+64Variação de estrelas nos últimos 7 dias
  • SenseVoice@QwenAudio

    Modelo SenseVoiceSmall de código aberto para ASR em mandarim, cantonês, inglês, japonês e coreano, identificação de idioma, reconhecimento de emoção e detecção de eventos de áudio.

    9.209+37Variação de estrelas nos últimos 7 dias
  • FunClip@modelscope

    Ferramenta de transcrição de vídeo, geração de legendas e edição assistida por LLM baseada em FunASR, com interface Gradio local.

    6.210+13Variação de estrelas nos últimos 7 dias
  • SmartSub@buxuku

    Aplicativo desktop gratuito e de código aberto para gerar, traduzir, dublar e embutir legendas em vídeos — conversão de voz em texto local com Whisper, dublagem por IA e clonagem de voz, offline e com aceleração por GPU.

    4.863+48Variação de estrelas nos últimos 7 dias
  • AudioNotes@harry0703

    Extraia rapidamente conteúdo de áudio e vídeo e organize-o em notas estruturadas em markdown.

    2.483+7Variação de estrelas nos últimos 7 dias
  • ququ@yan5xu

    Alternativa open source e gratuita ao Wispr Flow | Fluxo de trabalho de voz para desktop em chinês de próxima geração, integrando o modelo local FunASR e modelos de linguagem grandes configuráveis.

    2.278+5Variação de estrelas nos últimos 7 dias
  • bailing@wwbin2017

    Bailing é um robô de diálogo por voz semelhante ao GPT-4o, implementado via ASR+LLM+TTS, integrado com grandes modelos como o DeepSeek R1 e openClaw. Um verdadeiro assistente de voz pessoal com latência de até 800ms, capaz de rodar em dispositivos de baixa configuração como Mac e com suporte a interrupções.

    1.759+2Variação de estrelas nos últimos 7 dias
  • Fun-ASR@QwenAudio

    Família de modelos ASR de código aberto baseados em LLM para chinês, dialetos, sotaques e fala multilíngue, com runtimes FunASR, vLLM, streaming e llama.cpp.

    1.512+10Variação de estrelas nos últimos 7 dias
  • MTools@HG-ha

    O MTools é um aplicativo de desktop multifuncional poderoso que integra processamento de áudio e vídeo, edição de imagem, manipulação de texto e ferramentas de codificação, com recursos de IA integrados. Projetado para simplificar seu fluxo de trabalho e aumentar a produtividade.

    1.305+5Variação de estrelas nos últimos 7 dias
  • vocotype-cli@233stone

    VocoType é uma ferramenta de entrada de voz local, privada e segura que converte voz em texto em tempo real via atalhos de teclado. Suporta MCP de voz para texto, otimização de texto por IA, dicionários de substituição personalizados e transcrição de áudio/vídeo.

    928+5Variação de estrelas nos últimos 7 dias
  • LiveTranslate@TheDeathDragon

    Tradução de áudio em tempo real: captura o áudio do sistema e microfone, executa ASR (Whisper/SenseVoice) e traduz via API de LLM com exibição em streaming. Ideal para VTubers, streamers e consumo de conteúdo em idioma estrangeiro no Windows.

    625+34Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos