본문으로 건너뛰기
buildradar
Sign in
토픽 · voice-activity-detection

voice-activity-detection

voice-activity-detection 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
23
총 스타
83,655
평균 스타
3,637
비중
0.00%

같은 리포지토리에 voice-activity-detection 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 voice-activity-detection 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • FunASR@modelscope

    학습, 추론, 스트리밍 ASR, VAD, 구두점, 화자 분리 파이프라인, OpenAI 호환/MCP 서빙을 위한 오픈소스 음성 인식 툴킷.

    20,136+64최근 7일 스타 변화
  • pyannote-audio@pyannote

    화자 분할을 위한 신경망 빌딩 블록: 음성 활동 감지, 화자 변경 감지, 겹친 음성 감지, 화자 임베딩

    10,500+16최근 7일 스타 변화
  • NoiseTorch@noisetorch

    Linux용 실시간 마이크 노이즈 억제 기능.

    10,315+2최근 7일 스타 변화
  • silero-vad@snakers4

    Silero VAD: 사전 학습된 엔터프라이즈급 음성 활성 감지기(Voice Activity Detector)

    10,112+29최근 7일 스타 변화
  • ffsubsync@smacke

    비디오와 자막을 자동으로 동기화합니다.

    7,864+7최근 7일 스타 변화
  • FluidAudio@FluidInference

    앱에서 사용하는 프론티어 CoreML 오디오 모델 — 텍스트 음성 변환, 음성 텍스트 변환, 음성 활동 감지 및 화자 분리. Swift 기반, SOTA 오픈소스 구동.

    2,723+13최근 7일 스타 변화
  • pluely@iamsrikanthnani

    Cluely의 오픈 소스 대안 - 회의, 면접, 대화 중 상대방 모르게 원활하게 작동하는 초고속, 프라이버시 우선 AI 어시스턴트. Tauri로 빌드되어 네이티브 성능을 제공하며 용량은 불과 10MB입니다. 화상 통화, 화면 공유, 녹화 시 전혀 감지되지 않습니다.

    2,619+12최근 7일 스타 변화
  • ten-vad@TEN-framework

    음성 활동 감지기(VAD): 저지연, 고성능, 경량화

    2,256+7최근 7일 스타 변화
  • voice_datasets@jim-schwoebel

    🔊 음성 및 사운드 컴퓨팅을 위한 종합적인 오픈소스 데이터셋 목록 (95개 이상 데이터셋).

    2,223+1최근 7일 스타 변화
  • vad@ricky0123

    간단한 API를 제공하는 브라우저용 음성 활동 감지기(VAD)

    2,046+1최근 7일 스타 변화
  • diart@juanmc2005

    AI 기반 실시간 오디오 애플리케이션을 구축하기 위한 파이썬 패키지

    2,024+1최근 7일 스타 변화
  • sherpa-ncnn@k2-fsa

    인터넷 연결 없이 ncnn을 사용하는 차세대 Kaldi 기반 실시간 음성 인식 및 음성 활동 감지(VAD). iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A 등 지원

    1,777-1최근 7일 스타 변화
  • 💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록

    1,399+0최근 7일 스타 변화
  • speech-swift@soniqo

    Apple Silicon용 AI 음성 toolkit — MLX 및 CoreML 기반 ASR, TTS, 음성 대 음성, VAD 및 화자 분할

    1,161+4최근 7일 스타 변화
  • Python AI 어시스턴트 🧠

    1,014+0최근 7일 스타 변화
  • whisper.net@sandrohanea

    Whisper.net. Whisper 모델을 사용하여 간편하게 구현하는 음성 인식(STT)

    941+1최근 7일 스타 변화
  • inaSpeechSegmenter@ina-foss

    CNN 기반 오디오 분할 툴킷입니다. 음성, 음악, 소음 및 화자의 성별을 감지할 수 있습니다. 성별별 발화 시간을 기반으로 하는 대규모 성평등 연구를 위해 설계되었습니다.

    910+1최근 7일 스타 변화
  • auditok@amsehili

    음성 활성 감지 및 오디오 세분화 도구

    860+1최근 7일 스타 변화
  • FireRedASR2S@FireRedTeam

    ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함

    669+12최근 7일 스타 변화
  • WhisperS2T@shashikg

    다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인

    578+1최근 7일 스타 변화
  • FireRedVAD@FireRedTeam

    100개 이상의 언어를 지원하며 Silero-VAD, TEN-VAD, FunASR-VAD 및 WebRTC-VAD보다 뛰어난 성능을 제공하는 산업용 음성 및 오디오 이벤트 감지 도구

    520+5최근 7일 스타 변화
  • subaligner@baxtree

    사전 학습된 DNN, 강제 정렬(Forced Alignment) 및 Transformer를 사용하여 자막을 자동으로 동기화 및 번역하거나 전사를 통해 새로운 자막을 생성합니다. https://subaligner.readthedocs.io/

    509+0최근 7일 스타 변화
  • android-vad@gkonovalov

    Android 음성 활동 감지(VAD) 라이브러리. WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN 모델을 지원합니다.

    506+1최근 7일 스타 변화
← 토픽 목록으로