speaker-diarization
speaker-diarization 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 speaker-diarization 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 speaker-diarization 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 20,136+64최근 7일 스타 변화
- #2
PyTorch 기반 음성 툴킷
★ 11,802+10최근 7일 스타 변화 - #3
스트리밍 ASR, 화자 분리, 번역, OpenAI/Deepgram 호환 API를 지원하는 실시간 로컬 음성 인식(STT) 도구
★ 10,990+16최근 7일 스타 변화 - #4
화자 분할을 위한 신경망 빌딩 블록: 음성 활동 감지, 화자 변경 감지, 겹친 음성 감지, 화자 임베딩
★ 10,500+16최근 7일 스타 변화 - #5★ 9,949+3최근 7일 스타 변화
- #6
Apple Silicon을 위한 온디바이스 음성 AI
★ 6,353+8최근 7일 스타 변화 - #7
OpenAI Whisper 기반 화자 분리(Speaker Diarization)를 지원하는 자동 음성 인식(ASR)
★ 5,634+1최근 7일 스타 변화 - #8
Python을 다루기 귀찮은 분들을 위한 Whisper 및 Faster-Whisper 독립형 실행 파일.
★ 3,171+2최근 7일 스타 변화 - #9
단일 및 다중 모달 화자 인증, 화자 인식 및 화자 분할을 위한 저장소
★ 3,128+3최근 7일 스타 변화 - #10
단어 수준 타임스탬프와 신뢰도를 제공하는 다국어 자동 음성 인식
★ 2,842+1최근 7일 스타 변화 - #11
앱에서 사용하는 프론티어 CoreML 오디오 모델 — 텍스트 음성 변환, 음성 텍스트 변환, 음성 활동 감지 및 화자 분리. Swift 기반, SOTA 오픈소스 구동.
★ 2,723+13최근 7일 스타 변화 - #12★ 2,024+1최근 7일 스타 변화
- #13
화자 분할(Speaker Diarization) 관련 우수 논문, 라이브러리, 데이터셋 및 기타 리소스 모음
★ 1,894+1최근 7일 스타 변화 - #14
FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리
★ 1,512+10최근 7일 스타 변화 - #15★ 1,402+8최근 7일 스타 변화
- #16
Apple Silicon용 AI 음성 toolkit — MLX 및 CoreML 기반 ASR, TTS, 음성 대 음성, VAD 및 화자 분할
★ 1,161+4최근 7일 스타 변화 - #17
LLM 요약 기능이 포함된 턴키 방식의 자체 호스팅 오프라인 음성 변환 및 화자 분리 서비스
★ 948+2최근 7일 스타 변화 - #18★ 810+3최근 7일 스타 변화
- #19★ 677+0최근 7일 스타 변화
- #20
Google의 화자 분할(speaker diarization) 논문에 사용된 (제약) 스펙트럼 군집화 알고리즘의 Python 재구현 버전입니다.
★ 555+0최근 7일 스타 변화