본문으로 건너뛰기
buildradar
Sign in
토픽 · speech

speech

speech 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 74개
  • TTS-papers@coqui-ai

    🐸 TTS 논문 모음

    734+1최근 7일 스타 변화
  • MASR@yeyupiaoling

    Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함

    727+0최근 7일 스타 변화
  • FreeVC@OlaWod

    FreeVC: 고품질 텍스트 없는 원샷 음성 변환을 향하여

    716+0최근 7일 스타 변화
  • openspeech@openspeech-team

    PyTorch-Lightning과 Hydra를 활용한 엔드투엔드 음성 인식 오픈소스 툴킷

    714+0최근 7일 스타 변화
  • BabelDuck@Orenoid

    초보자 친화적인 AI 대화 연습 애플리케이션입니다.

    693+1최근 7일 스타 변화
  • chatterbox-tts-api@travisvn

    Chatterbox를 활용한 로컬 OpenAI 호환 텍스트 음성 변환(TTS) API로, Open WebUI나 AnythingLLM 등 OpenAI API를 사용하는 모든 곳에서 음성 복제 기능을 제공

    677+5최근 7일 스타 변화
  • MOSS-Audio@OpenMOSS

    MOSS-Audio는 통합 오디오 이해를 위한 오픈 소스 파운데이션 모델로, 실제 환경에서 음성, 소리, 음악, 캡션, QA 및 추론 기능을 제공합니다.

    656+5최근 7일 스타 변화
  • sonus@evancohen

    Node.js용 STT(Speech to Text) 라이브러리, 오프라인 핫워드 감지 기능 포함

    638+0최근 7일 스타 변화
  • 음성 분야 연구실/기업/리소스/인턴십 등, 추천이나 자원 환영

    610+1최근 7일 스타 변화
  • 공개된 룸 임펄스 응답(RIR) 데이터셋 목록 및 다운로드 스크립트

    609+2최근 7일 스타 변화
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: 자동 음성 인식(ASR)을 위한 대규모의 강력하고 포괄적인 벤치마킹 플랫폼입니다.

    553+3최근 7일 스타 변화
  • tacotron@google

    엔드투엔드 음성 합성 모델인 Tacotron 관련 출판물에 포함된 오디오 샘플입니다.

    539+0최근 7일 스타 변화
  • knn-vc@bshall

    최근접 이웃(Nearest Neighbors)만을 활용한 음성 변환

    524+1최근 7일 스타 변화
  • StarGANv2-VC@yl4579

    StarGANv2-VC: 자연스러운 음성 변환을 위한 다양하고 비지도 방식의 비병렬 프레임워크입니다.

    522+0최근 7일 스타 변화
← 토픽 목록으로