본문으로 건너뛰기
buildradar
Sign in
토픽 · tts

tts

tts 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 189개
  • alexandria-audiobook@Finrandojin

    AI 기반 멀티 보이스 오디오북 생성기 — LLM 대본 주석, 음성 복제, 음성 디자인, LoRA 학습, 라인별 스타일 제어 및 MP3, 챕터별 M4B 또는 Audacity 멀티트랙 내보내기 지원. Qwen3-TTS 기반으로 구축됨.

    999+17최근 7일 스타 변화
  • lobe-vidol@lobehub

    🧸 Lobe Vidol - 누구나 쉽게 접근할 수 있는 가상 아이돌

    986+1최근 7일 스타 변화
  • Step-Audio-EditX@stepfun-ai

    감정, 화법, 준언어 편집에 탁월하며 강력한 제로샷 음성 합성(TTS) 기능을 갖춘 강력한 3B 파라미터 LLM 기반 강화 학습 오디오 편집 모델

    972+1최근 7일 스타 변화
  • NISQA@gabrielmittag

    NISQA - 비침습적 음성 품질 및 TTS 자연스러움 평가 도구

    971+2최근 7일 스타 변화
  • epub2tts@aedocw

    epub 또는 텍스트 파일을 오디오북으로 변환

    955-1최근 7일 스타 변화
  • audio-ai-hub@BinWang28

    오디오 AI 연구 허브: 오디오 LLM, 음성 인식, TTS, 음악 및 오디오 생성을 아우르는 논문, 오픈 모델, 벤치마크 및 데이터셋

    953+3최근 7일 스타 변화
  • Azure의 자연스러운 TTS 음성을 모든 SAPI 5 호환 애플리케이션에서 사용할 수 있도록 지원합니다.

    934+12최근 7일 스타 변화
  • FireRedTTS@FireRedTeam

    오픈 소스 LLM 기반 Foundation TTS 시스템

    920+1최근 7일 스타 변화
  • SmartJavaAI@geekwenjie

    🔥🔥🔥 자바 무료 오프라인 AI 알고리즘 툴박스. 얼굴 인식, 라이브니스 감지, 표정 인식, 객체 검출, 인스턴스 분할, 보행자 검출, OCR 문자 인식, 번호판 인식, 표 인식, ASR+TTS, 기계 번역 등 기능 지원, Maven 의존성 추가로 사용 가능. PyTorch, Tensorflow 지원, Mtcnn, InsightFace, SeetaFace6, YOLOv8~v12, PaddleOCR(PPOCRv5), Whisper 등 주류 모델 통합 완료

    909+3최근 7일 스타 변화
  • mosec@mosecorg

    고성능 ML 모델 서빙 프레임워크로, 컴퓨팅 머신을 최대한 활용할 수 있도록 동적 배칭 및 CPU/GPU 파이프라인을 제공합니다.

    902+0최근 7일 스타 변화
  • xtts-webui@daswer123

    XTTS 사용 및 미세 조정을 위한 웹 UI입니다.

    896+0최근 7일 스타 변화
  • diffwave@lmnt-com

    DiffWave는 빠르고 고품질인 뉴럴 보코더 및 파형 신시사이저입니다.

    885+0최근 7일 스타 변화
  • pdf-to-podcast@NVIDIA-AI-Blueprints

    이동 중에도 흥미롭게 들을 수 있는 오디오 콘텐츠를 위해 PDF를 AI 팟캐스트로 변환합니다.

    874+1최근 7일 스타 변화
  • Easy-Voice-Toolkit@Spr-Aachen

    음성 인식, 전사, 변환 등을 위한 사용자 친화적인 툴킷 | 간편하게 사용할 수 있는 음성 도구 상자

    873+0최근 7일 스타 변화
  • bark.cpp@PABannier

    빠른 텍스트 음성 변환(TTS) 생성을 위한 Suno AI Bark 모델의 C/C++ 구현체

    867+1최근 7일 스타 변화
  • esp-ai@wangzongming

    가장 간단하고 비용 효율적인 AI 통합 솔루션

    856+2최근 7일 스타 변화
  • SumatraPDF fork: Chinese EPUB/MOBI, smart PDF dark mode, OCR, TTS, offline dictionary.

    829+15최근 7일 스타 변화
  • 네이티브 및 브라우저에서 실행되는 Voxtral ASR & TTS. Burn ML 프레임워크를 사용하여 Mistral의 Voxtral mini 실시간 ASR/TTS를 Rust로 구현

    819+2최근 7일 스타 변화
  • Kokoros@lucasjinreal

    🔥🔥 Rust로 구현된 Kokoro. https://huggingface.co/hexgrad/Kokoro-82M 지금까지 경험한 것 중 가장 뛰어난 품질을 자랑하는 미친듯이 빠른 실시간 TTS.

    818+1최근 7일 스타 변화
  • gitpodcast@BandarLabs

    모든 git 저장소를 흥미로운 팟캐스트로 변환

    814-1최근 7일 스타 변화
  • lue@paulilaaso

    오디오북 품질의 텍스트 음성 변환을 지원하는 터미널 기반 전자책 리더 — EPUB, PDF, DOCX, HTML, RTF, TXT, MD 지원

    806+2최근 7일 스타 변화
  • lobe-tts@lobehub

    🎤 Lobe TTS - 서버와 브라우저를 위한 고품질의 안정적인 TTS/STT 라이브러리

    805+1최근 7일 스타 변화
  • CloneTTS@sipeter

    원활한 시스템 전반의 음성 복제 및 고충실도 텍스트 읽기를 지원하는 경량 오프라인 안드로이드 Text-to-Speech (TTS) 엔진.

    803+2최근 7일 스타 변화
  • Speech to Text to Speech. 현재 재생 중인 곡. 텍스트를 OSC 메시지로 VRChat에 전송하여 아바타에 표시합니다. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4최근 7일 스타 변화
  • ZerolanLiveRobot@AkagawaTsurunaki

    LLM, ASR, TTS, OCR, CV 등 다양한 기술을 활용하여 라이브 스트리밍을 하거나 함께 Minecraft를 플레이하는 AI VTuber

    803+5최근 7일 스타 변화
  • Confucius4-TTS@netease-youdao

    Confucius4-TTS: 다국어 및 교차 언어 제로샷 TTS 엔진

    794+10최근 7일 스타 변화
  • 루트 권한이 필요 없는 오픈소스 Android 실시간 화면 번역 도구. 게임, 비주얼 노벨, 만화에 적합하며 온디바이스 및 클라우드 OCR, 오프라인 LLM, 다중 번역 서비스, TTS를 지원하고 화면 위에 직접 번역문을 표시합니다.

    786+82최근 7일 스타 변화
  • mlx-audio-swift@Blaizzy

    Apple Silicon의 MLX를 활용한 오디오 처리를 위한 모듈형 Swift SDK

    772+6최근 7일 스타 변화
  • dla@markovka17

    오디오 처리를 위한 딥러닝

    762+1최근 7일 스타 변화
  • vui@fluxions-ai

    실시간 음성 비서로 WebRTC 스트리밍, faster-whisper ASR, 로컬 LLM, Vui Nano(300M) TTS를 지원합니다. OpenAI Realtime API와 호환되며 음성 복제, 끼어들기(barge-in) 기능을 제공하고 4090 환경에서 실시간 대비 약 9배 속도로 작동합니다. Apache 2.0 라이선스.

    757+10최근 7일 스타 변화
← 토픽 목록으로