voice-cloning
voice-cloning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 voice-cloning 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 voice-cloning 태그가 달린 리포지토리예요.
- #1
1분의 음성 데이터로도 훌륭한 TTS 모델을 학습할 수 있습니다! (퓨샷 음성 클로닝)
★ 61,476+138최근 7일 스타 변화 - #2
5초 만에 목소리를 복제하여 실시간으로 임의의 음성을 생성합니다
★ 60,117-4최근 7일 스타 변화 - #3★ 45,985+18최근 7일 스타 변화
- #4★ 36,595+345최근 7일 스타 변화
- #5★ 23,426+359최근 7일 스타 변화
- #6
전자책으로 오디오북 생성, 음성 복제 및 1,158개 이상의 언어 지원!
★ 20,097+34최근 7일 스타 변화 - #7
넷플릭스 수준의 자막 커팅, 번역, 정렬, 더빙까지 - 원클릭 완전 자동화 AI 비디오 자막 팀
★ 18,339+49최근 7일 스타 변화 - #8
VoiceStudio는 완전 로컬 환경에서 실행되는 오픈 소스 ElevenLabs 대안으로, 646개 언어의 음성 복제, 음성 디자인, 비디오 더빙, 받아쓰기, 전사 및 오디오북 생성을 지원합니다.
★ 14,835+2,880최근 7일 스타 변화 - #9
크리에이터와 개발자를 위한 Gradio WebUI. 주요 TTS(Edge-TTS, kokoro) 및 제로샷 음성 복제(E2 & F5-TTS, CosyVoice)를 지원하며, Whisper 오디오 처리, YouTube 다운로드, Demucs 보컬 분리 및 다국어 번역 기능을 제공합니다.
★ 12,730+54최근 7일 스타 변화 - #10
자기 지도 학습 모델, 구두점이 포함된 SOTA/스트리밍 ASR, 텍스트 프론트엔드가 포함된 스트리밍 TTS, 화자 인증 시스템, 엔드투엔드 음성 번역 및 키워드 스포팅을 포함하는 사용하기 쉬운 음성 툴킷. NAACL2022 최우수 시연상(Best Demo Award) 수상
★ 12,676+5최근 7일 스타 변화 - #11★ 6,416+8최근 7일 스타 변화
- #12
오픈 소스 AI 비디오 로컬라이제이션 도구: YouTube/Bilibili 비디오 다운로드, 자막 인식 및 번역, 음성 복제 더빙, 오디오 트랙 믹싱 및 자막 삽입을 자동으로 수행합니다.
★ 5,404+25최근 7일 스타 변화 - #13
MOSS‑TTS Family는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 음성 및 사운드 생성 모델 패밀리입니다. 고충실도, 고표현력, 복잡한 실제 시나리오를 위해 설계되었으며 안정적인 장문 음성, 다화자 대화, 목소리/캐릭터 디자인, 환경 음향 효과 및 실시간 스트리밍 TTS를 지원합니다.
★ 4,058+18최근 7일 스타 변화 - #14★ 3,674+14최근 7일 스타 변화
- #15★ 2,818+1최근 7일 스타 변화
- #16
ggml 기반의 오디오 모델용 올인원 순수 C++ 추론 엔진. 고조율된 성능으로 TTS, STT, VAD, 음성 변환, 음악 생성 등을 지원합니다. Python 의존성이 없습니다.
★ 2,214+115최근 7일 스타 변화 - #17★ 1,760+3최근 7일 스타 변화
- #18
강력한 텍스트 음성 변환, 이미지 생성, 비디오 생성 API와의 상호작용을 지원하는 공식 MiniMax Model Context Protocol(MCP) 서버.
★ 1,573+2최근 7일 스타 변화 - #19
Microsoft의 VibeVoice 텍스트 음성 변환(TTS) 모델을 위한 포괄적인 ComfyUI 통합으로, ComfyUI 워크플로 내에서 직접 고품질의 단일 및 다중 화자 음성 합성을 지원합니다.
★ 1,555+4최근 7일 스타 변화 - #20
사람의 목소리를 손쉽게 합성할 수 있는 Python/PyTorch 앱입니다.
★ 1,440+0최근 7일 스타 변화 - #21
강력한 Chatterbox TTS 모델을 자체 호스팅하세요. 이 서버는 사용자 친화적인 Web UI, 유연한 API 엔드포인트(OpenAI 호환 포함), 사전 정의된 목소리, 목소리 복제, 대규모 오디오북 수준의 텍스트 처리를 제공합니다. NVIDIA (CUDA), AMD (ROCm) 및 CPU에서 가속화되어 실행됩니다.
★ 1,427+1최근 7일 스타 변화 - #22
💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록
★ 1,399+0최근 7일 스타 변화 - #23★ 1,289-1최근 7일 스타 변화
- #24
다양한 오디오 관련 Neural Network를 위한 웹 UI
★ 1,246+0최근 7일 스타 변화 - #25
이모지 기반 스타일 제어를 지원하는 Flow Matching 방식의 텍스트 음성 변환(TTS) 모델
★ 1,228+4최근 7일 스타 변화 - #26
로컬 다중 엔진 다국어 텍스트 음성 변환(TTS) 및 음성 변환을 위한 ComfyUI 커스텀 노드 통합입니다. RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2/3, VibeVoice를 지원하며 무제한 텍스트 길이, SRT 타이밍, 캐릭터 지원 및 다양한 오디오 도구를 제공합니다.
★ 1,187+7최근 7일 스타 변화 - #27
Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.
★ 1,115+245최근 7일 스타 변화 - #28
AI 기반 멀티 보이스 오디오북 생성기 — LLM 대본 주석, 음성 복제, 음성 디자인, LoRA 학습, 라인별 스타일 제어 및 MP3, 챕터별 M4B 또는 Audacity 멀티트랙 내보내기 지원. Qwen3-TTS 기반으로 구축됨.
★ 999+17최근 7일 스타 변화 - #29
감정, 화법, 준언어 편집에 탁월하며 강력한 제로샷 음성 합성(TTS) 기능을 갖춘 강력한 3B 파라미터 LLM 기반 강화 학습 오디오 편집 모델
★ 972+1최근 7일 스타 변화 - #30★ 803+2최근 7일 스타 변화