tts
tts 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61★ 2,305+24최근 7일 스타 변화
- #62★ 2,296+7최근 7일 스타 변화
- #63
VALL-E(Zero-Shot Text-To-Speech)의 PyTorch 구현, 데모 재생 링크: https://lifeiteng.github.io/valle/index.html
★ 2,215+0최근 7일 스타 변화 - #64
ggml 기반의 오디오 모델용 올인원 순수 C++ 추론 엔진. 고조율된 성능으로 TTS, STT, VAD, 음성 변환, 음악 생성 등을 지원합니다. Python 의존성이 없습니다.
★ 2,214+115최근 7일 스타 변화 - #65
7000개 이상의 언어를 지원하는 제어 가능하고 빠른 텍스트 음성 변환(TTS)!
★ 2,207-1최근 7일 스타 변화 - #66
OpenAI, Azure, ElevenLabs를 대체할 수 있는 무료 고품질 텍스트 음성 변환 API 엔드포인트
★ 2,075+5최근 7일 스타 변화 - #67
Audiobookshelf에 최적화된 EPUB 오디오북 변환기, WebUI 포함
★ 2,064+1최근 7일 스타 변화 - #68
보안 Websockets 및 Edge Functions를 사용하여 Arduino ESP32에서 100개 이상의 모델로 AI 동반자 및 장치를 위한 실시간 음성 AI 장난감
★ 1,938+5최근 7일 스타 변화 - #69
Home Assistant에서 Alice를 사용하여 Yandex.Station 및 기타 스마트홈 기기 제어
★ 1,917-1최근 7일 스타 변화 - #70★ 1,912+1최근 7일 스타 변화
- #71
워크플로우-투-앱, 화면 공유 및 플로팅 비디오, GPT 및 3D, 음성 인식 및 TTS
★ 1,861-2최근 7일 스타 변화 - #72★ 1,836+1최근 7일 스타 변화
- #73
Kokoro 모델을 사용하는 CLI 텍스트 음성 변환(TTS) 도구로, 여러 언어, 음성(블렌딩 지원), 그리고 EPUB 책 및 PDF 문서를 포함한 다양한 입력 형식을 지원합니다.
★ 1,835+14최근 7일 스타 변화 - #74★ 1,760+3최근 7일 스타 변화
- #75
백령(Bailing)은 ASR+LLM+TTS를 통해 구현된 GPT-4o 유사 음성 대화 봇으로, DeepSeek R1 등 우수한 대형 모델을 통합하고 openClaw를 연동한 진정한 개인용 음성 비서입니다. 지연 시간이 800ms에 불과하며 Mac 등 저사양 환경에서도 실행 가능하고 인터럽트를 지원합니다.
★ 1,759+2최근 7일 스타 변화 - #76★ 1,749+14최근 7일 스타 변화
- #77
자막 파일을 기반으로 동영상 텍스트를 자동으로 번역한 다음, AI 음성 서비스를 사용하여 자막 타이밍에 맞춰 음성이 동기화된 새로운 더빙 및 번역 오디오 트랙을 생성합니다.
★ 1,746-1최근 7일 스타 변화 - #78
Atlas Cloud와 ffmpeg를 이용해 하나의 주제를 Vox 스타일의 완성된 종이 콜라주 설명/광고 영상으로 엔드투엔드로 자동 변환합니다. 에이전트 스킬입니다.
★ 1,698+67최근 7일 스타 변화 - #79★ 1,687+4최근 7일 스타 변화
- #80
WhatsApp 에이전트, Ava를 만나보세요
★ 1,675+2최근 7일 스타 변화 - #81
PyTorch를 이용한 비공식 Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN)
★ 1,646+1최근 7일 스타 변화 - #82★ 1,622+8최근 7일 스타 변화
- #83★ 1,591-2최근 7일 스타 변화
- #84
Microsoft의 VibeVoice 텍스트 음성 변환(TTS) 모델을 위한 포괄적인 ComfyUI 통합으로, ComfyUI 워크플로 내에서 직접 고품질의 단일 및 다중 화자 음성 합성을 지원합니다.
★ 1,555+4최근 7일 스타 변화 - #85★ 1,548+60최근 7일 스타 변화
- #86
Android용 Dicio 어시스턴트 앱
★ 1,463+3최근 7일 스타 변화 - #87★ 1,449+1최근 7일 스타 변화
- #88
사람의 목소리를 손쉽게 합성할 수 있는 Python/PyTorch 앱입니다.
★ 1,440+0최근 7일 스타 변화 - #89★ 1,437+0최근 7일 스타 변화
- #90
강력한 Chatterbox TTS 모델을 자체 호스팅하세요. 이 서버는 사용자 친화적인 Web UI, 유연한 API 엔드포인트(OpenAI 호환 포함), 사전 정의된 목소리, 목소리 복제, 대규모 오디오북 수준의 텍스트 처리를 제공합니다. NVIDIA (CUDA), AMD (ROCm) 및 CPU에서 가속화되어 실행됩니다.
★ 1,427+1최근 7일 스타 변화