voice-cloning
voice-cloning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #31
실시간 음성 비서로 WebRTC 스트리밍, faster-whisper ASR, 로컬 LLM, Vui Nano(300M) TTS를 지원합니다. OpenAI Realtime API와 호환되며 음성 복제, 끼어들기(barge-in) 기능을 제공하고 4090 환경에서 실시간 대비 약 9배 속도로 작동합니다. Apache 2.0 라이선스.
★ 757+10최근 7일 스타 변화 - #32
MimikaStudio - macOS(Apple Silicon)용 로컬 우선 애플리케이션 및 Agentic MCP 지원
★ 731+0최근 7일 스타 변화 - #33
Chatterbox를 활용한 로컬 OpenAI 호환 텍스트 음성 변환(TTS) API로, Open WebUI나 AnythingLLM 등 OpenAI API를 사용하는 모든 곳에서 음성 복제 기능을 제공
★ 677+5최근 7일 스타 변화 - #34
PDF와 EPUB을 오디오북으로 변환하거나 자막 및 영상을 더빙 영상으로 변환하는 무료 도구. 로컬 모델을 사용하여 음성 복제(즉시 생성, RVC 강화, XTTS 파인튜닝) 및 LLM 처리를 지원하며 GUI와 설치 프로그램을 포함한 사용자 친화적 앱을 지향
★ 620+3최근 7일 스타 변화 - #35
YouDub은 고품질 YouTube 영상을 자동으로 번역하고 더빙하여 중국 인터넷 플랫폼에 게시할 수 있도록 설계된 오픈 소스 도구입니다. AI 음성 인식으로 오디오를 텍스트로 변환하고, LLM으로 번역한 뒤, AI 음성 복제 기술을 사용하여 원본 유튜버의 목소리로 중국어 더빙 영상을 생성합니다.
★ 614-2최근 7일 스타 변화 - #36
VibeVoice TTS용 ComfyUI 커스텀 노드. 표현력 풍부하고 긴 형식의 다중 화자 대화형 오디오
★ 597+0최근 7일 스타 변화 - #37
텍스트 파일을 입력으로 받고 글자 수 제한이 없는 Chatterbox 수정 버전입니다. 주로 아이들을 위한 오디오북 제작에 사용합니다.
★ 575-1최근 7일 스타 변화 - #38
Mac(M1/M2/M3/M4)에서 Qwen3-TTS 텍스트 음성 변환을 로컬로 실행합니다. MLX를 사용하여 음성 복제, 음성 디자인, 사용자 지정 음성을 100% 오프라인으로 지원합니다.
★ 561+4최근 7일 스타 변화 - #39
개인화된 음성 복제 기능을 갖춘 세계 최초의 오픈소스 실시간 엔드투엔드 음성 대화 모델
★ 549-1최근 7일 스타 변화 - #40
ComfyUI용 OmniVoice TTS 노드 - 음성 복제, 음성 디자인 및 다중 화자 대화를 지원하는 제로샷 다국어 텍스트 음성 변환
★ 543+5최근 7일 스타 변화 - #41
고품격 음성과 사실적인 제로샷 음성 복제를 위한 ComfyUI 노드
★ 510+1최근 7일 스타 변화