speech-to-speech
Repositórios de código aberto acompanhados marcados com speech-to-speech, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de speech-to-speech no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com speech-to-speech.
- #1
Plataforma de voz AI de código aberto. Alternativa auto-hospedada ao Vapi e Retell. On-prem, BYOK para Speech to Speech ou LLM/STT/TTS, com construtor visual de fluxo de trabalho, suporte nativo a MCP e telefonia.
★ 5.568+45Variação de estrelas nos últimos 7 dias - #2
Uma ferramenta de conversão de voz simples e de alta qualidade, focada em facilidade de uso e desempenho.
★ 3.674+14Variação de estrelas nos últimos 7 dias - #3
LLaMA-Omni é um modelo de interação de voz end-to-end de baixa latência e alta qualidade construído sobre o Llama-3.1-8B-Instruct, visando alcançar capacidades de voz no nível do GPT-4o.
★ 3.147+1Variação de estrelas nos últimos 7 dias - #4
Um motor de inferência tudo-em-um em C++ puro para modelos de áudio, alimentado por ggml. Suporta TTS, STT, VAD, conversão de voz, geração de música e mais, com desempenho altamente otimizado. Sem dependência de Python.
★ 2.214+115Variação de estrelas nos últimos 7 dias - #5
Brinquedos de IA de voz em tempo real com mais de 100 modelos no Arduino ESP32, com WebSockets seguros e Edge Functions para companheiros e dispositivos de IA.
★ 1.938+5Variação de estrelas nos últimos 7 dias - #6
Toolkit de fala de IA para Apple Silicon — ASR, TTS, speech-to-speech, VAD e diarização alimentados por MLX e CoreML
★ 1.161+4Variação de estrelas nos últimos 7 dias - #7
Um aplicativo assistente de IA móvel ultrarrápido e multiplataforma construído com React Native.
★ 856+3Variação de estrelas nos últimos 7 dias - #8
Um SDK modular em Swift para processamento de áudio com MLX em Apple Silicon
★ 772+6Variação de estrelas nos últimos 7 dias - #9
O primeiro modelo de diálogo falado de ponta a ponta em tempo real de código aberto do mundo com clonagem de voz personalizada.
★ 549-1Variação de estrelas nos últimos 7 dias - #10
Agente interativo de fala para fala (Speech-to-Speech) de alta qualidade e em streaming implementado em um único arquivo.
★ 541+0Variação de estrelas nos últimos 7 dias