본문으로 건너뛰기
buildradar
Sign in
토픽 · voice-cloning

voice-cloning

voice-cloning 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
41
총 스타
355,522
평균 스타
8,671
비중
0.02%

같은 리포지토리에 voice-cloning 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 voice-cloning 태그가 달린 리포지토리예요.

  • audio.cpp@0xShug0

    ggml 기반의 오디오 모델용 올인원 순수 C++ 추론 엔진. 고조율된 성능으로 TTS, STT, VAD, 음성 변환, 음악 생성 등을 지원합니다. Python 의존성이 없습니다.

    2,214
  • GPT-SoVITS@RVC-Boss

    1분의 음성 데이터로도 훌륭한 TTS 모델을 학습할 수 있습니다! (퓨샷 음성 클로닝)

    61,476+138최근 7일 스타 변화
  • 5초 만에 목소리를 복제하여 실시간으로 임의의 음성을 생성합니다

    60,117-4최근 7일 스타 변화
  • TTS@coqui-ai

    🐸💬 - 연구 및 프로덕션에서 검증된 텍스트 음성 변환(TTS)을 위한 딥러닝 툴킷

    45,985+18최근 7일 스타 변화
  • VoxCPM@OpenBMB

    VoxCPM2: 다국어 음성 생성, 창의적인 음성 디자인, 실감나는 클로닝을 위한 토크나이저 프리 TTS

    36,595+345최근 7일 스타 변화
  • CosyVoice@QwenAudio

    추론, 학습, 배포를 위한 풀스택 기능을 제공하는 다국어 대규모 음성 생성 모델

    23,426+359최근 7일 스타 변화
  • ebook2audiobook@DrewThomasson

    전자책으로 오디오북 생성, 음성 복제 및 1,158개 이상의 언어 지원!

    20,097+34최근 7일 스타 변화
  • VideoLingo@Huanshere

    넷플릭스 수준의 자막 커팅, 번역, 정렬, 더빙까지 - 원클릭 완전 자동화 AI 비디오 자막 팀

    18,339+49최근 7일 스타 변화
  • VoiceStudio@debpalash

    VoiceStudio는 완전 로컬 환경에서 실행되는 오픈 소스 ElevenLabs 대안으로, 646개 언어의 음성 복제, 음성 디자인, 비디오 더빙, 받아쓰기, 전사 및 오디오북 생성을 지원합니다.

    14,835+2,880최근 7일 스타 변화
  • voice-pro@abus-aikorea

    크리에이터와 개발자를 위한 Gradio WebUI. 주요 TTS(Edge-TTS, kokoro) 및 제로샷 음성 복제(E2 & F5-TTS, CosyVoice)를 지원하며, Whisper 오디오 처리, YouTube 다운로드, Demucs 보컬 분리 및 다국어 번역 기능을 제공합니다.

    12,730+54최근 7일 스타 변화
  • PaddleSpeech@PaddlePaddle

    자기 지도 학습 모델, 구두점이 포함된 SOTA/스트리밍 ASR, 텍스트 프론트엔드가 포함된 스트리밍 TTS, 화자 인증 시스템, 엔드투엔드 음성 번역 및 키워드 스포팅을 포함하는 사용하기 쉬운 음성 툴킷. NAACL2022 최우수 시연상(Best Demo Award) 수상

    12,676+5최근 7일 스타 변화
  • YuE@multimodal-art-projection

    YuE: 오픈 풀송 음악 생성 파운데이션 모델, Suno.ai와 유사하지만 오픈소스임

    6,416+8최근 7일 스타 변화
  • YouDub-webui@liuzhao1225

    오픈 소스 AI 비디오 로컬라이제이션 도구: YouTube/Bilibili 비디오 다운로드, 자막 인식 및 번역, 음성 복제 더빙, 오디오 트랙 믹싱 및 자막 삽입을 자동으로 수행합니다.

    5,404+25최근 7일 스타 변화
  • MOSS-TTS@OpenMOSS

    MOSS‑TTS Family는 MOSI.AI와 OpenMOSS 팀이 개발한 오픈소스 음성 및 사운드 생성 모델 패밀리입니다. 고충실도, 고표현력, 복잡한 실제 시나리오를 위해 설계되었으며 안정적인 장문 음성, 다화자 대화, 목소리/캐릭터 디자인, 환경 음향 효과 및 실시간 스트리밍 TTS를 지원합니다.

    4,058+18최근 7일 스타 변화
  • Applio@IAHispano

    사용 편의성과 성능에 중점을 둔 간편하고 고품질의 음성 변환 도구.

    3,674+14최근 7일 스타 변화
  • MARS5-TTS@Camb-ai

    CAMB.AI의 MARS5 음성 모델 (TTS)

    2,818+1최근 7일 스타 변화
  • audio.cpp@0xShug0

    ggml 기반의 오디오 모델용 올인원 순수 C++ 추론 엔진. 고조율된 성능으로 TTS, STT, VAD, 음성 변환, 음악 생성 등을 지원합니다. Python 의존성이 없습니다.

    2,214+115최근 7일 스타 변화
  • Genie-TTS@High-Logic

    GPT-SoVITS ONNX 추론 엔진 및 모델 변환기

    1,760+3최근 7일 스타 변화
  • MiniMax-MCP@MiniMax-AI

    강력한 텍스트 음성 변환, 이미지 생성, 비디오 생성 API와의 상호작용을 지원하는 공식 MiniMax Model Context Protocol(MCP) 서버.

    1,573+2최근 7일 스타 변화
  • VibeVoice-ComfyUI@Enemyx-net

    Microsoft의 VibeVoice 텍스트 음성 변환(TTS) 모델을 위한 포괄적인 ComfyUI 통합으로, ComfyUI 워크플로 내에서 직접 고품질의 단일 및 다중 화자 음성 합성을 지원합니다.

    1,555+4최근 7일 스타 변화
  • Voice-Cloning-App@voice-cloning-app

    사람의 목소리를 손쉽게 합성할 수 있는 Python/PyTorch 앱입니다.

    1,440+0최근 7일 스타 변화
  • 강력한 Chatterbox TTS 모델을 자체 호스팅하세요. 이 서버는 사용자 친화적인 Web UI, 유연한 API 엔드포인트(OpenAI 호환 포함), 사전 정의된 목소리, 목소리 복제, 대규모 오디오북 수준의 텍스트 처리를 제공합니다. NVIDIA (CUDA), AMD (ROCm) 및 CPU에서 가속화되어 실행됩니다.

    1,427+1최근 7일 스타 변화
  • 💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록

    1,399+0최근 7일 스타 변화
  • Twocast@panyanyany

    이중 언어 에피소드 및 다국어를 지원하는 AI 팟캐스트 생성기, NotebookLLM의 대안

    1,289-1최근 7일 스타 변화
  • audio-webui@gitmylo

    다양한 오디오 관련 Neural Network를 위한 웹 UI

    1,246+0최근 7일 스타 변화
  • Irodori-TTS@Aratako

    이모지 기반 스타일 제어를 지원하는 Flow Matching 방식의 텍스트 음성 변환(TTS) 모델

    1,228+4최근 7일 스타 변화
  • TTS-Audio-Suite@diodiogod

    로컬 다중 엔진 다국어 텍스트 음성 변환(TTS) 및 음성 변환을 위한 ComfyUI 커스텀 노드 통합입니다. RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2/3, VibeVoice를 지원하며 무제한 텍스트 길이, SRT 타이밍, 캐릭터 지원 및 다양한 오디오 도구를 제공합니다.

    1,187+7최근 7일 스타 변화
  • mlx-serve@ddalcu

    Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.

    1,115+245최근 7일 스타 변화
  • alexandria-audiobook@Finrandojin

    AI 기반 멀티 보이스 오디오북 생성기 — LLM 대본 주석, 음성 복제, 음성 디자인, LoRA 학습, 라인별 스타일 제어 및 MP3, 챕터별 M4B 또는 Audacity 멀티트랙 내보내기 지원. Qwen3-TTS 기반으로 구축됨.

    999+17최근 7일 스타 변화
  • Step-Audio-EditX@stepfun-ai

    감정, 화법, 준언어 편집에 탁월하며 강력한 제로샷 음성 합성(TTS) 기능을 갖춘 강력한 3B 파라미터 LLM 기반 강화 학습 오디오 편집 모델

    972+1최근 7일 스타 변화
  • CloneTTS@sipeter

    원활한 시스템 전반의 음성 복제 및 고충실도 텍스트 읽기를 지원하는 경량 오프라인 안드로이드 Text-to-Speech (TTS) 엔진.

    803+2최근 7일 스타 변화
← 토픽 목록으로