본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-synthesis

speech-synthesis

speech-synthesis 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 66개
  • chat-with-gpt@cogentapps

    음성 기능이 포함된 오픈소스 ChatGPT 앱

    2,350-1최근 7일 스타 변화
  • IMS-Toucan@DigitalPhonetics

    7000개 이상의 언어를 지원하는 제어 가능하고 빠른 텍스트 음성 변환(TTS)!

    2,207-1최근 7일 스타 변화
  • RHVoice@RHVoice

    러시아어 및 기타 언어를 위한 무료 오픈소스 음성 합성기

    1,836+1최근 7일 스타 변화
  • ParallelWaveGAN@kan-bayashi

    PyTorch를 이용한 비공식 Parallel WaveGAN (+ MelGAN & Multi-band MelGAN & HiFi-GAN & StyleMelGAN)

    1,646+1최근 7일 스타 변화
  • dsnote@mkiol

    Speech Note Linux 앱. 오프라인 음성 인식(STT), 음성 합성(TTS) 및 기계 번역을 통한 메모 작성, 읽기 및 번역.

    1,622+8최근 7일 스타 변화
  • ComfyUI의 기능을 확장하는 커스텀 노드

    1,525+1최근 7일 스타 변화
  • SAM@s-macke

    소프트웨어 자동 음성(Software Automatic Mouth) - 초소형 음성 합성기

    1,498+0최근 7일 스타 변화
  • SpeechT5@microsoft

    음성 언어 처리를 위한 통합 모달 음성-텍스트 사전 학습

    1,449+0최근 7일 스타 변화
  • 강력한 Chatterbox TTS 모델을 자체 호스팅하세요. 이 서버는 사용자 친화적인 Web UI, 유연한 API 엔드포인트(OpenAI 호환 포함), 사전 정의된 목소리, 목소리 복제, 대규모 오디오북 수준의 텍스트 처리를 제공합니다. NVIDIA (CUDA), AMD (ROCm) 및 CPU에서 가속화되어 실행됩니다.

    1,427+1최근 7일 스타 변화
  • 💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록

    1,399+0최근 7일 스타 변화
  • voicefixer@haoheliu

    일반 음성 복원

    1,375+0최근 7일 스타 변화
  • World@mmorise

    고품질 음성 분석, 조작 및 합성 시스템

    1,339+0최근 7일 스타 변화
  • StreamSpeech@ictnlp

    StreamSpeech는 오프라인 및 동시 음성 인식, 음성 번역, 음성 합성을 위한 "All in One" 심리스 모델입니다.

    1,288+0최근 7일 스타 변화
  • Irodori-TTS@Aratako

    이모지 기반 스타일 제어를 지원하는 Flow Matching 방식의 텍스트 음성 변환(TTS) 모델

    1,228+4최근 7일 스타 변화
  • BigVGAN@NVIDIA

    BigVGAN 공식 PyTorch 구현 (ICLR 2023)

    1,227+1최근 7일 스타 변화
  • 오프라인에서 작동하는 러시아어 음성 어시스턴트 Ирина. 플러그인을 통한 스킬을 지원합니다.

    1,153+0최근 7일 스타 변화
  • AI-Waifu-Vtuber@ardha27

    Youtube 및 Twitch 스트리밍을 위한 AI Vtuber

    1,115+1최근 7일 스타 변화
  • autovc@auspicious3000

    AutoVC: 오토인코더 손실만 사용하는 제로샷 음성 스타일 전송

    1,100+0최근 7일 스타 변화
  • YourTTS@Edresson

    YourTTS: 누구나 사용할 수 있는 제로샷 다화자 TTS 및 제로샷 음성 변환을 향하여

    1,053+0최근 7일 스타 변화
  • Cognitive-Speech-TTS@Azure-Samples

    Cognitive Services의 일부인 Microsoft Text-to-Speech API 다국어 샘플 코드.

    1,014+3최근 7일 스타 변화
  • alexandria-audiobook@Finrandojin

    AI 기반 멀티 보이스 오디오북 생성기 — LLM 대본 주석, 음성 복제, 음성 디자인, LoRA 학습, 라인별 스타일 제어 및 MP3, 챕터별 M4B 또는 Audacity 멀티트랙 내보내기 지원. Qwen3-TTS 기반으로 구축됨.

    996+17최근 7일 스타 변화
  • NISQA@gabrielmittag

    NISQA - 비침습적 음성 품질 및 TTS 자연스러움 평가 도구

    970+2최근 7일 스타 변화
  • Azure의 자연스러운 TTS 음성을 모든 SAPI 5 호환 애플리케이션에서 사용할 수 있도록 지원합니다.

    933+12최근 7일 스타 변화
  • FireRedTTS@FireRedTeam

    오픈 소스 LLM 기반 Foundation TTS 시스템

    920+1최근 7일 스타 변화
  • 인터넷 없이 내 컴퓨터에서 실행되는 말하는 LLM

    891+2최근 7일 스타 변화
  • diffwave@lmnt-com

    DiffWave는 빠르고 고품질인 뉴럴 보코더 및 파형 신시사이저입니다.

    885+0최근 7일 스타 변화
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 다국어 및 교차 언어 제로샷 TTS 엔진

    794+10최근 7일 스타 변화
  • vui@fluxions-ai

    실시간 음성 비서로 WebRTC 스트리밍, faster-whisper ASR, 로컬 LLM, Vui Nano(300M) TTS를 지원합니다. OpenAI Realtime API와 호환되며 음성 복제, 끼어들기(barge-in) 기능을 제공하고 4090 환경에서 실시간 대비 약 9배 속도로 작동합니다. Apache 2.0 라이선스.

    757+10최근 7일 스타 변화
  • Thorsten-Voice@thorstenMueller

    Thorsten-Voice: 라이선스 문제없이 모든 프로젝트에서 사용할 수 있는 무료, 오프라인 지원, 고품질 독일어 TTS 음성

    729+1최근 7일 스타 변화
  • INTERSPEECH 2023-2024 논문 모음: INTERSPEECH 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 전체 컬렉션입니다. 음성 및 언어 처리 분야의 최신 기술 발전을 확인해 보세요. 코드 포함.

    684+0최근 7일 스타 변화
← 토픽 목록으로