voice-activity-detection
voice-activity-detection 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 voice-activity-detection 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 voice-activity-detection 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 20,136+64최근 7일 스타 변화
- #2
화자 분할을 위한 신경망 빌딩 블록: 음성 활동 감지, 화자 변경 감지, 겹친 음성 감지, 화자 임베딩
★ 10,500+16최근 7일 스타 변화 - #3
Linux용 실시간 마이크 노이즈 억제 기능.
★ 10,315+2최근 7일 스타 변화 - #4
Silero VAD: 사전 학습된 엔터프라이즈급 음성 활성 감지기(Voice Activity Detector)
★ 10,112+29최근 7일 스타 변화 - #5★ 7,864+7최근 7일 스타 변화
- #6
앱에서 사용하는 프론티어 CoreML 오디오 모델 — 텍스트 음성 변환, 음성 텍스트 변환, 음성 활동 감지 및 화자 분리. Swift 기반, SOTA 오픈소스 구동.
★ 2,723+13최근 7일 스타 변화 - #7
Cluely의 오픈 소스 대안 - 회의, 면접, 대화 중 상대방 모르게 원활하게 작동하는 초고속, 프라이버시 우선 AI 어시스턴트. Tauri로 빌드되어 네이티브 성능을 제공하며 용량은 불과 10MB입니다. 화상 통화, 화면 공유, 녹화 시 전혀 감지되지 않습니다.
★ 2,619+12최근 7일 스타 변화 - #8★ 2,256+7최근 7일 스타 변화
- #9
🔊 음성 및 사운드 컴퓨팅을 위한 종합적인 오픈소스 데이터셋 목록 (95개 이상 데이터셋).
★ 2,223+1최근 7일 스타 변화 - #10★ 2,046+1최근 7일 스타 변화
- #11★ 2,024+1최근 7일 스타 변화
- #12
인터넷 연결 없이 ncnn을 사용하는 차세대 Kaldi 기반 실시간 음성 인식 및 음성 활동 감지(VAD). iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A 등 지원
★ 1,777-1최근 7일 스타 변화 - #13
💎 ASR, TTS 및 기타 음성 기술을 위한 접근 가능한 음성 말뭉치(speech corpora) 목록
★ 1,399+0최근 7일 스타 변화 - #14
Apple Silicon용 AI 음성 toolkit — MLX 및 CoreML 기반 ASR, TTS, 음성 대 음성, VAD 및 화자 분할
★ 1,161+4최근 7일 스타 변화 - #15
Python AI 어시스턴트 🧠
★ 1,014+0최근 7일 스타 변화 - #16
Whisper.net. Whisper 모델을 사용하여 간편하게 구현하는 음성 인식(STT)
★ 941+1최근 7일 스타 변화 - #17
CNN 기반 오디오 분할 툴킷입니다. 음성, 음악, 소음 및 화자의 성별을 감지할 수 있습니다. 성별별 발화 시간을 기반으로 하는 대규모 성평등 연구를 위해 설계되었습니다.
★ 910+1최근 7일 스타 변화 - #18★ 860+1최근 7일 스타 변화
- #19
ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함
★ 669+12최근 7일 스타 변화 - #20
다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인
★ 578+1최근 7일 스타 변화 - #21
100개 이상의 언어를 지원하며 Silero-VAD, TEN-VAD, FunASR-VAD 및 WebRTC-VAD보다 뛰어난 성능을 제공하는 산업용 음성 및 오디오 이벤트 감지 도구
★ 520+5최근 7일 스타 변화 - #22
사전 학습된 DNN, 강제 정렬(Forced Alignment) 및 Transformer를 사용하여 자막을 자동으로 동기화 및 번역하거나 전사를 통해 새로운 자막을 생성합니다. https://subaligner.readthedocs.io/
★ 509+0최근 7일 스타 변화 - #23
Android 음성 활동 감지(VAD) 라이브러리. WebRTC VAD GMM, Silero VAD DNN, Yamnet VAD DNN 모델을 지원합니다.
★ 506+1최근 7일 스타 변화