본문으로 건너뛰기
buildradar
Sign in
토픽 · text-to-speech

text-to-speech

text-to-speech 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 150개
  • TTS-Audio-Suite@diodiogod

    로컬 다중 엔진 다국어 텍스트 음성 변환(TTS) 및 음성 변환을 위한 ComfyUI 커스텀 노드 통합입니다. RVC, Echo-TTS, Qwen3-TTS, Cozy Voice 3, Step Audio EditX, IndexTTS-2, Chatterbox, F5-TTS, Higgs Audio 2/3, VibeVoice를 지원하며 무제한 텍스트 길이, SRT 타이밍, 캐릭터 지원 및 다양한 오디오 도구를 제공합니다.

    1,187+0최근 7일 스타 변화
  • Apple의 Foundation Models 프레임워크를 사용하여 앱을 빌드, 테스트 및 평가하기 위한 실습 랩

    1,178+0최근 7일 스타 변화
  • dia2@nari-labs

    실시간으로 대화형 오디오를 스트리밍할 수 있는 TTS 모델

    1,173+0최근 7일 스타 변화
  • speech-swift@soniqo

    Apple Silicon용 AI 음성 toolkit — MLX 및 CoreML 기반 ASR, TTS, 음성 대 음성, VAD 및 화자 분할

    1,161+0최근 7일 스타 변화
  • 앱을 위한 셀프 코딩 시스템 — Cordova용 Alan AI SDK

    1,132+0최근 7일 스타 변화
  • Uncensored-Local-Studio@techjarves

    Windows, Linux, macOS를 위한 검열 없는 로컬 AI 스튜디오. 이미지 생성, GGUF LLM, 텍스트 음성 변환 및 음성 텍스트 변환을 위한 제로 설정 GUI

    1,118+13최근 7일 스타 변화
  • sglang-omni@sgl-project

    SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.

    1,118+56최근 7일 스타 변화
  • Patter@PatterAI

    오픈소스 음성 AI SDK. 스택을 직접 소유하려는 개발자를 위한 Vapi/Retell 대안. 4줄의 코드로 AI 에이전트에 전화번호 부여 — Python 및 TypeScript, MIT 라이선스, Twilio, Telnyx, Plivo 지원

    1,051+7최근 7일 스타 변화
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services의 일부인 Microsoft Text-to-Speech API 다국어 샘플 코드.

    1,014+1최근 7일 스타 변화
  • alexandria-audiobook@Finrandojin

    AI 기반 멀티 보이스 오디오북 생성기 — LLM 대본 주석, 음성 복제, 음성 디자인, LoRA 학습, 라인별 스타일 제어 및 MP3, 챕터별 M4B 또는 Audacity 멀티트랙 내보내기 지원. Qwen3-TTS 기반으로 구축됨.

    1,000+10최근 7일 스타 변화
  • Step-Audio-EditX@stepfun-ai

    감정, 화법, 준언어 편집에 탁월하며 강력한 제로샷 음성 합성(TTS) 기능을 갖춘 강력한 3B 파라미터 LLM 기반 강화 학습 오디오 편집 모델

    973+1최근 7일 스타 변화
  • NISQA@gabrielmittag

    NISQA - 비침습적 음성 품질 및 TTS 자연스러움 평가 도구

    972+4최근 7일 스타 변화
  • botium-speech-processing@codeforequity-at

    Botium 음성 처리

    943+0최근 7일 스타 변화
  • Azure의 자연스러운 TTS 음성을 모든 SAPI 5 호환 애플리케이션에서 사용할 수 있도록 지원합니다.

    934+7최근 7일 스타 변화
  • PHP용 Vonage REST API 클라이언트. SMS, 음성, 텍스트 음성 변환, 번호, 인증(2FA) 등을 지원합니다.

    931-1최근 7일 스타 변화
  • FireRedTTS@FireRedTeam

    오픈 소스 LLM 기반 Foundation TTS 시스템

    919-1최근 7일 스타 변화
  • EDDiscovery@EDDiscovery

    Elite Dangerous를 위한 캡틴스 로그 및 3D 성도

    900+4최근 7일 스타 변화
  • diffwave@lmnt-com

    DiffWave는 빠르고 고품질인 뉴럴 보코더 및 파형 신시사이저입니다.

    884-1최근 7일 스타 변화
  • bark.cpp@PABannier

    빠른 텍스트 음성 변환(TTS) 생성을 위한 Suno AI Bark 모델의 C/C++ 구현체

    868+2최근 7일 스타 변화
  • lobe-tts@lobehub

    🎤 Lobe TTS - 서버와 브라우저를 위한 고품질의 안정적인 TTS/STT 라이브러리

    805-1최근 7일 스타 변화
  • lue@paulilaaso

    오디오북 품질의 텍스트 음성 변환을 지원하는 터미널 기반 전자책 리더 — EPUB, PDF, DOCX, HTML, RTF, TXT, MD 지원

    805+1최근 7일 스타 변화
  • CloneTTS@sipeter

    원활한 시스템 전반의 음성 복제 및 고충실도 텍스트 읽기를 지원하는 경량 오프라인 안드로이드 Text-to-Speech (TTS) 엔진.

    804+5최근 7일 스타 변화
  • Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    804+5최근 7일 스타 변화
  • ai-video-editor@MartinDelophy

    크리에이터와 AI 에이전트가 동일한 타임라인에서 작업할 수 있는 로컬 우선 오픈소스 영상 편집기

    798+82최근 7일 스타 변화
  • 루트 권한이 필요 없는 오픈소스 Android 실시간 화면 번역 도구. 게임, 비주얼 노벨, 만화에 적합하며 온디바이스 및 클라우드 OCR, 오프라인 LLM, 다중 번역 서비스, TTS를 지원하고 화면 위에 직접 번역문을 표시합니다.

    794+73최근 7일 스타 변화
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 다국어 및 교차 언어 제로샷 TTS 엔진

    794+6최근 7일 스타 변화
  • june@mezbaul-h

    Ollama, Hugging Face Transformers, Coqui TTS Toolkit 기반의 대화형 로컬 음성 챗봇

    788+1최근 7일 스타 변화
  • mlx-audio-swift@Blaizzy

    Apple Silicon의 MLX를 활용한 오디오 처리를 위한 모듈형 Swift SDK

    774+5최근 7일 스타 변화
  • vui@fluxions-ai

    실시간 음성 비서로 WebRTC 스트리밍, faster-whisper ASR, 로컬 LLM, Vui Nano(300M) TTS를 지원합니다. OpenAI Realtime API와 호환되며 음성 복제, 끼어들기(barge-in) 기능을 제공하고 4090 환경에서 실시간 대비 약 9배 속도로 작동합니다. Apache 2.0 라이선스.

    759+7최근 7일 스타 변화
  • cboard@cboard-org

    브라우저용 텍스트 음성 변환(TTS) 기능이 포함된 보완 대체 의사소통(AAC) 시스템

    756+9최근 7일 스타 변화
← 토픽 목록으로