본문으로 건너뛰기
buildradar
Sign in
토픽 · text-to-audio

text-to-audio

text-to-audio 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
13
총 스타
27,818
평균 스타
2,140
비중
0.00%

같은 리포지토리에 text-to-audio 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 text-to-audio 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • Amphion@open-mmlab

    Amphion(/æmˈfaɪən/)은 오디오, 음악 및 음성 생성을 위한 툴킷입니다. 재현 가능한 연구를 지원하고 초보 연구자와 엔지니어가 오디오, 음악 및 음성 생성 연구 및 개발 분야에 쉽게 입문할 수 있도록 돕는 것을 목적으로 합니다.

    10,276+1최근 7일 스타 변화
  • abogen@denizsafak

    동기화된 자막과 함께 EPUB, PDF 및 텍스트에서 오디오북 생성

    5,831+45최근 7일 스타 변화
  • MMAudio@hkchengrex

    [CVPR 2025] MMAudio: 고품질 비디오-오디오 합성을 위한 멀티모달 공동 학습 최적화

    2,264+0최근 7일 스타 변화
  • ThinkSound@QwenAudio

    [NeurIPS 2025] Chain-of-Thought(CoT) 추론을 바탕으로 모든 양식에서 오디오를 생성하는 통합 프레임워크인 [ThinkSound]의 PyTorch 구현

    1,378+0최근 7일 스타 변화
  • StreamSpeech@ictnlp

    StreamSpeech는 오프라인 및 동시 음성 인식, 음성 번역, 음성 합성을 위한 "All in One" 심리스 모델입니다.

    1,288+0최근 7일 스타 변화
  • audio-webui@gitmylo

    다양한 오디오 관련 Neural Network를 위한 웹 UI

    1,246+0최근 7일 스타 변화
  • tango@declare-lab

    텍스트-오디오 생성을 위한 디퓨전 모델 패밀리.

    1,238-1최근 7일 스타 변화
  • HunyuanVideo-Foley@Tencent-Hunyuan

    HunyuanVideo-Foley: 고충실도 폴리 오디오 생성을 위한 표현 정렬 기반 멀티모달 디퓨전

    1,056+4최근 7일 스타 변화
  • TangoFlux@declare-lab

    [ICLR 2026] TangoFlux: Flow Matching을 사용한 초고속 및 고품질 Text to Audio 생성

    882+0최근 7일 스타 변화
  • Make-An-Audio@Text-to-Audio

    Text-to-Audio 생성 모델인 Make-An-Audio(ICML'23)의 PyTorch 구현

    668+0최근 7일 스타 변화
  • OpenMusic@ivcylc

    OpenMusic: 최신 텍스트-음악(TTM) 생성 모델

    631+1최근 7일 스타 변화
  • LLM 기반 멀티모달 생성(이미지, 비디오, 3D, 오디오) 관련 논문 큐레이션 리스트

    552+0최근 7일 스타 변화
  • unified-audio@alibaba

    오디오 처리와 생성을 통합하기 위한 오픈소스 프로젝트

    512+1최근 7일 스타 변화
← 토픽 목록으로