Pular para o conteúdo principal
buildradar
Entrar
Tópico · text-to-speech

text-to-speech

Repositórios de código aberto acompanhados marcados com text-to-speech, ordenados por estrelas.

150 repositórios
  • flutter_tts@dlutton

    Pacote Text to Speech para Flutter

    753+0Variação de estrelas nos últimos 7 dias
  • kokoro-web@eduardolat

    🔊 Kokoro Web: Conversão gratuita de texto em fala por IA, online ou auto-hospedado, compatível com OpenAI!

    733+2Variação de estrelas nos últimos 7 dias
  • voice-ai@rapidaai

    Rapida é uma plataforma de orquestração de IA de voz de ponta a ponta para construir agentes de voz conversacionais em tempo real com streaming de áudio, STT, TTS, VAD, integração multicanal, gerenciamento de estado de agentes e observabilidade.

    723+4Variação de estrelas nos últimos 7 dias
  • curses@mmpneo

    Legendas de fala para texto e entrada de KB para OBS, VRChat, chat do Twitch e Discord

    718-1Variação de estrelas nos últimos 7 dias
  • voicebox-pytorch@lucidrains

    Implementação em Pytorch do Voicebox, a nova rede de Text-to-speech SOTA da MetaAI

    703+0Variação de estrelas nos últimos 7 dias
  • podcast-maker@FelippeChemello

    Criador de vídeos totalmente automatizado usando gráficos em movimento e síntese de texto para fala para transformar boletins informativos em vídeos diários para o YouTube.

    703+0Variação de estrelas nos últimos 7 dias
  • Reconhecimento de fala offline com OpenAI Whisper e TensorFlow Lite para Android

    689+0Variação de estrelas nos últimos 7 dias
  • chatterbox-tts-api@travisvn

    API de texto para fala (TTS) local e compatível com OpenAI usando o Chatterbox, permitindo que os usuários gerem fala clonada em qualquer lugar onde a API da OpenAI seja usada (ex.: Open WebUI, AnythingLLM, etc.)

    677+1Variação de estrelas nos últimos 7 dias
  • dictionariez@pnlpal

    📚 Uma extensão de dicionário personalizável que suporta consultas com dois cliques em mais de 20 idiomas, mais de 1000 dicionários, conversão de texto em fala, tradução e integração com o Anki.

    671+1Variação de estrelas nos últimos 7 dias
  • LLaSA_training@zhenye234

    LLaSA: Escalando a computação de tempo de treinamento e inferência para Síntese de Fala baseada em LLaMA

    658+1Variação de estrelas nos últimos 7 dias
  • f5-tts-mlx@lucasnewman

    Implementação do F5-TTS em MLX

    644+0Variação de estrelas nos últimos 7 dias
  • examples@elevenlabs
    626+2Variação de estrelas nos últimos 7 dias
  • Pandrator@lukaszliniewicz

    Converta PDFs e EPUBs em audiolivros; legendas ou vídeos em vídeos dublados (incluindo tradução) e muito mais. De graça. O Pandrator usa modelos locais, incluindo clonagem de voz (instantânea, aprimorada por RVC, ajuste fino XTTS) e processamento por LLM. Ele aspira ser um aplicativo amigável com interface gráfica, instalador e pacotes tudo em um.

    620+3Variação de estrelas nos últimos 7 dias
  • tiktok-voice@oscie57

    Script Python simples para interagir com a API de TTS do TikTok

    611+0Variação de estrelas nos últimos 7 dias
  • ComfyUI-VibeVoice@wildminder

    Nó personalizado do ComfyUI para o VibeVoice TTS. Áudio conversacional expressivo, de formato longo e com múltiplos falantes

    596-1Variação de estrelas nos últimos 7 dias
  • Versão modificada do Chatterbox que aceita arquivos de texto como entrada e não possui restrições de caracteres. Eu o uso para criar audiolivros, especialmente para meus filhos.

    575-1Variação de estrelas nos últimos 7 dias
  • O sistema de autoprogramação para seu aplicativo — Alan AI SDK para React Native

    575+0Variação de estrelas nos últimos 7 dias
  • Execute o Qwen3-TTS localmente no Mac (M1/M2/M3/M4). Clonagem de voz, design de voz e vozes personalizadas. 100% offline usando MLX.

    561+2Variação de estrelas nos últimos 7 dias
  • 🔥🔥🔥 Uma lista selecionada de artigos sobre geração multimodal baseada em LLMs (imagem, vídeo, 3D e áudio).

    552+0Variação de estrelas nos últimos 7 dias
  • orpheus-tts-local@isaiahbjork

    Execute o Orpheus 3B localmente com o LM Studio.

    549+0Variação de estrelas nos últimos 7 dias
  • vits2_pytorch@p0p4k

    Implementação não oficial do vits2-TTS em pytorch

    549+1Variação de estrelas nos últimos 7 dias
  • payload-ai@ashbuilds

    AI Plugin é uma extensão poderosa para o Payload CMS, integrando recursos avançados de IA para aprimorar a criação e o gerenciamento de conteúdo.

    547-1Variação de estrelas nos últimos 7 dias
  • ComfyUI-OmniVoice-TTS@Saganaki22

    Nós OmniVoice TTS para ComfyUI - Conversão de texto em fala multilíngue zero-shot com clonagem de voz, design de voz e diálogos com múltiplos falantes.

    545+5Variação de estrelas nos últimos 7 dias
  • Talkify@tornikegomareli

    Ditado por voz ultrarrápido, gratuito, local e com transcrição no próprio dispositivo para macOS

    544+11Variação de estrelas nos últimos 7 dias
  • EDDI@EDCD

    Aplicativo complementar para Elite Dangerous

    525+2Variação de estrelas nos últimos 7 dias
  • e2-tts-pytorch@lucidrains

    Implementação do E2-TTS, "Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS", em Pytorch

    517+0Variação de estrelas nos últimos 7 dias
  • vixtts-demo@thinhlpg

    Um modelo de Text-to-Speech com clonagem de voz em vietnamita ✨

    516+0Variação de estrelas nos últimos 7 dias
  • Servidor de inferência de linguagem de código aberto, local e auto-hospedado altamente otimizado com suporte a ASR/STT, TTS e LLM via WebRTC, REST e WS

    512+0Variação de estrelas nos últimos 7 dias
  • ComfyUI-VoxCPM@wildminder

    Nó do ComfyUI para fala altamente expressiva e clonagem de voz zero-shot realista

    509-1Variação de estrelas nos últimos 7 dias
  • openreader@richardr1126

    An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

    506+5Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos