본문으로 건너뛰기
buildradar
Sign in
토픽 · speaker-diarization

speaker-diarization

speaker-diarization 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
20
총 스타
98,208
평균 스타
4,910
비중
0.01%

같은 리포지토리에 speaker-diarization 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 speaker-diarization 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • FunASR@modelscope

    학습, 추론, 스트리밍 ASR, VAD, 구두점, 화자 분리 파이프라인, OpenAI 호환/MCP 서빙을 위한 오픈소스 음성 인식 툴킷.

    20,136+64최근 7일 스타 변화
  • speechbrain@speechbrain

    PyTorch 기반 음성 툴킷

    11,802+10최근 7일 스타 변화
  • WhisperLiveKit@QuentinFuxa

    스트리밍 ASR, 화자 분리, 번역, OpenAI/Deepgram 호환 API를 지원하는 실시간 로컬 음성 인식(STT) 도구

    10,990+16최근 7일 스타 변화
  • pyannote-audio@pyannote

    화자 분할을 위한 신경망 빌딩 블록: 음성 활동 감지, 화자 변경 감지, 겹친 음성 감지, 화자 임베딩

    10,500+16최근 7일 스타 변화
  • espnet@espnet

    엔드투엔드 음성 처리 툴킷

    9,949+3최근 7일 스타 변화
  • argmax-oss-swift@argmaxinc

    Apple Silicon을 위한 온디바이스 음성 AI

    6,353+8최근 7일 스타 변화
  • whisper-diarization@MahmoudAshraf97

    OpenAI Whisper 기반 화자 분리(Speaker Diarization)를 지원하는 자동 음성 인식(ASR)

    5,634+1최근 7일 스타 변화
  • Python을 다루기 귀찮은 분들을 위한 Whisper 및 Faster-Whisper 독립형 실행 파일.

    3,171+2최근 7일 스타 변화
  • 3D-Speaker@modelscope

    단일 및 다중 모달 화자 인증, 화자 인식 및 화자 분할을 위한 저장소

    3,128+3최근 7일 스타 변화
  • whisper-timestamped@linto-ai

    단어 수준 타임스탬프와 신뢰도를 제공하는 다국어 자동 음성 인식

    2,842+1최근 7일 스타 변화
  • FluidAudio@FluidInference

    앱에서 사용하는 프론티어 CoreML 오디오 모델 — 텍스트 음성 변환, 음성 텍스트 변환, 음성 활동 감지 및 화자 분리. Swift 기반, SOTA 오픈소스 구동.

    2,723+13최근 7일 스타 변화
  • diart@juanmc2005

    AI 기반 실시간 오디오 애플리케이션을 구축하기 위한 파이썬 패키지

    2,024+1최근 7일 스타 변화
  • 화자 분할(Speaker Diarization) 관련 우수 논문, 라이브러리, 데이터셋 및 기타 리소스 모음

    1,894+1최근 7일 스타 변화
  • Fun-ASR@QwenAudio

    FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리

    1,512+10최근 7일 스타 변화
  • wespeaker@wenet-e2e

    연구 및 프로덕션 지향 화자 검증, 인식 및 화자 분할 툴킷

    1,402+8최근 7일 스타 변화
  • speech-swift@soniqo

    Apple Silicon용 AI 음성 toolkit — MLX 및 CoreML 기반 ASR, TTS, 음성 대 음성, VAD 및 화자 분할

    1,161+4최근 7일 스타 변화
  • transcriptionstream@transcriptionstream

    LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스

    948+2최근 7일 스타 변화
  • MioSub@corvo007

    다운로드, 전사, 번역, 인코딩까지 전 과정을 자동화한 원스톱 자막 생성 소프트웨어로, 사람의 개입이 필요 없습니다.

    810+3최근 7일 스타 변화
  • pyannote-whisper@yinruiqing
    677+0최근 7일 스타 변화
  • SpectralCluster@wq2012

    Google의 화자 분할(speaker diarization) 논문에 사용된 (제약) 스펙트럼 군집화 알고리즘의 Python 재구현 버전입니다.

    555+0최근 7일 스타 변화
← 토픽 목록으로