본문으로 건너뛰기
buildradar
로그인
토픽 · text-to-speech

text-to-speech

text-to-speech 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 150개
  • flutter_tts@dlutton

    Flutter 텍스트 음성 변환(TTS) 패키지.

    753+0최근 7일 스타 변화
  • kokoro-web@eduardolat

    🔊 Kokoro Web: 온라인 또는 자체 호스팅이 가능한 무료 AI 텍스트 음성 변환(TTS), OpenAI 호환!

    733+2최근 7일 스타 변화
  • voice-ai@rapidaai

    Rapida는 오디오 스트리밍, STT, TTS, VAD, 다중 채널 통합, 에이전트 상태 관리 및 관찰 가능성을 제공하여 실시간 대화형 음성 에이전트를 구축할 수 있는 오픈소스 엔드투엔드 음성 AI 오케스트레이션 플랫폼입니다.

    723+4최근 7일 스타 변화
  • curses@mmpneo

    OBS, VRChat, Twitch 채팅, Discord를 위한 음성 인식(Speech to Text) 및 KB 입력 자막

    718-1최근 7일 스타 변화
  • podcast-maker@FelippeChemello

    모션 그래픽과 텍스트 음성 변환(TTS)을 사용하여 뉴스레터를 일일 YouTube 영상으로 자동 제작하는 도구

    703+0최근 7일 스타 변화
  • voicebox-pytorch@lucidrains

    MetaAI의 최신 SOTA 텍스트 음성 변환 네트워크인 Voicebox의 Pytorch 구현

    703+0최근 7일 스타 변화
  • Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.

    688+0최근 7일 스타 변화
  • chatterbox-tts-api@travisvn

    Chatterbox를 활용한 로컬 OpenAI 호환 텍스트 음성 변환(TTS) API로, Open WebUI나 AnythingLLM 등 OpenAI API를 사용하는 모든 곳에서 음성 복제 기능을 제공

    677+1최근 7일 스타 변화
  • dictionariez@pnlpal

    20개 이상의 언어, 1000개 이상의 사전, TTS, 번역 및 Anki 연동을 지원하는 더블 클릭 검색 가능한 맞춤형 사전 확장 프로그램

    671+1최근 7일 스타 변화
  • LLaSA_training@zhenye234

    LLaSA: LLaMA 기반 음성 합성을 위한 학습 및 추론 시간 연산 확장

    658+1최근 7일 스타 변화
  • f5-tts-mlx@lucasnewman

    MLX 기반의 F5-TTS 구현체입니다.

    644+0최근 7일 스타 변화
  • examples@elevenlabs
    626+2최근 7일 스타 변화
  • Pandrator@lukaszliniewicz

    PDF와 EPUB을 오디오북으로 변환하거나 자막 및 영상을 더빙 영상으로 변환하는 무료 도구. 로컬 모델을 사용하여 음성 복제(즉시 생성, RVC 강화, XTTS 파인튜닝) 및 LLM 처리를 지원하며 GUI와 설치 프로그램을 포함한 사용자 친화적 앱을 지향

    620+3최근 7일 스타 변화
  • tiktok-voice@oscie57

    TikTok TTS API와 상호작용하기 위한 간단한 Python 스크립트

    611+0최근 7일 스타 변화
  • ComfyUI-VibeVoice@wildminder

    VibeVoice TTS용 ComfyUI 커스텀 노드. 표현력 풍부하고 긴 형식의 다중 화자 대화형 오디오

    596-1최근 7일 스타 변화
  • 텍스트 파일을 입력으로 받고 글자 수 제한이 없는 Chatterbox 수정 버전입니다. 주로 아이들을 위한 오디오북 제작에 사용합니다.

    575-1최근 7일 스타 변화
  • 앱을 위한 셀프 코딩 시스템 — React Native용 Alan AI SDK.

    575+0최근 7일 스타 변화
  • Mac(M1/M2/M3/M4)에서 Qwen3-TTS 텍스트 음성 변환을 로컬로 실행합니다. MLX를 사용하여 음성 복제, 음성 디자인, 사용자 지정 음성을 100% 오프라인으로 지원합니다.

    561+2최근 7일 스타 변화
  • LLM 기반 멀티모달 생성(이미지, 비디오, 3D, 오디오) 관련 논문 큐레이션 리스트

    552+0최근 7일 스타 변화
  • orpheus-tts-local@isaiahbjork

    LM Studio로 로컬에서 Orpheus 3B 실행하기

    549+0최근 7일 스타 변화
  • vits2_pytorch@p0p4k

    PyTorch 기반의 비공식 vits2-TTS 구현

    549+1최근 7일 스타 변화
  • payload-ai@ashbuilds

    AI Plugin은 Payload CMS를 위한 강력한 확장 기능으로, 고급 AI 기능을 통합하여 콘텐츠 생성 및 관리를 향상함

    547-1최근 7일 스타 변화
  • ComfyUI-OmniVoice-TTS@Saganaki22

    ComfyUI용 OmniVoice TTS 노드 - 음성 복제, 음성 디자인 및 다중 화자 대화를 지원하는 제로샷 다국어 텍스트 음성 변환

    545+5최근 7일 스타 변화
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    544+11최근 7일 스타 변화
  • EDDI@EDCD

    Elite Dangerous용 컴패니언 애플리케이션

    525+2최근 7일 스타 변화
  • e2-tts-pytorch@lucidrains

    Pytorch로 구현한 E2-TTS (Embarrassingly Easy Fully Non-Autoregressive Zero-Shot TTS).

    517+0최근 7일 스타 변화
  • vixtts-demo@thinhlpg

    베트남어 음성 복제 텍스트 음성 변환(TTS) 모델.

    516+0최근 7일 스타 변화
  • WebRTC, REST, WS를 통해 ASR/STT, TTS, LLM을 지원하는 오픈 소스, 로컬, 자체 호스팅 최적화 언어 추론 서버

    512+0최근 7일 스타 변화
  • ComfyUI-VoxCPM@wildminder

    고품격 음성과 사실적인 제로샷 음성 복제를 위한 ComfyUI 노드

    509-1최근 7일 스타 변화
  • openreader@richardr1126

    An open-source read-along document reader server with high-quality TTS options, synchronized highlighting, and audiobook export for EPUB, PDF, DOCX, TXT, and MD.

    506+5최근 7일 스타 변화
← 토픽 목록으로