본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-recognition

speech-recognition

speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 156개
  • adapt@MycroftAI

    Adapt 의도 파서(Intent Parser)

    719+0최근 7일 스타 변화
  • curses@mmpneo

    OBS, VRChat, Twitch 채팅, Discord를 위한 음성 인식(Speech to Text) 및 KB 입력 자막

    718+0최근 7일 스타 변화
  • openspeech@openspeech-team

    PyTorch-Lightning과 Hydra를 활용한 엔드투엔드 음성 인식 오픈소스 툴킷

    714+0최근 7일 스타 변화
  • rhino@Picovoice

    딥러닝 기반의 온디바이스 Speech-to-Intent 엔진

    712+3최근 7일 스타 변화
  • speech-demo@Baidu-AIP

    음성 API 예제

    708+0최근 7일 스타 변화
  • 음성 인식(Speech-to-Text) 벤치마크 프레임워크

    697+0최근 7일 스타 변화
  • Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.

    688+0최근 7일 스타 변화
  • INTERSPEECH 2023-2024 논문 모음: INTERSPEECH 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 전체 컬렉션입니다. 음성 및 언어 처리 분야의 최신 기술 발전을 확인해 보세요. 코드 포함.

    684+0최근 7일 스타 변화
  • 음성 숫자로 구성된 무료 오디오 데이터셋. MNIST의 오디오 버전.

    678+0최근 7일 스타 변화
  • React Native Expo 프로젝트를 위한 음성 인식 라이브러리

    677+6최근 7일 스타 변화
  • cheetah@Picovoice

    딥러닝 기반의 온디바이스 스트리밍 음성 인식(STT) 엔진

    671+0최근 7일 스타 변화
  • FireRedASR2S@FireRedTeam

    ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함

    670+13최근 7일 스타 변화
  • hear@sveinbjornt

    macOS 내장 음성 인식 및 전사 기능을 위한 커맨드 라인 인터페이스

    669+0최근 7일 스타 변화
  • gpt-home@judahpaul16

    홈메이드 ChatGPT! LiteLLM과 LangGraph를 사용하여 Raspberry Pi 기반으로 구축된 상용 스마트 홈 어시스턴트의 더 나은 대안

    648+1최근 7일 스타 변화
  • sonus@evancohen

    Node.js용 STT(Speech to Text) 라이브러리, 오프라인 핫워드 감지 기능 포함

    638+0최근 7일 스타 변화
  • whisperIME@woheller69

    Whisper 기반의 Android 입력 방식 편집기(IME)

    633+6최근 7일 스타 변화
  • LiveTranslate@TheDeathDragon

    실시간 오디오 번역 도구. 시스템 오디오와 마이크를 캡처하여 ASR(Whisper/SenseVoice)로 인식하고 LLM API를 통해 스트리밍 방식으로 번역 결과를 표시합니다. VTuber, 라이브 스트리머 및 외국어 콘텐츠 시청에 최적화되어 있습니다.

    626+38최근 7일 스타 변화
  • speech-to-text@reriiasu

    faster-whisper를 사용한 실시간 전사

    614+0최근 7일 스타 변화
  • CrispASR@CrispStrobe

    다국어 ASR 및 TTS 모델을 위한 C++ ggml 런타임 허브: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 등 지원 및 범용 강제 정렬(forced alignment) 기능 제공

    611+20최근 7일 스타 변화
  • CTCWordBeamSearch@githubharald

    사전 및 언어 모델을 포함한 CTC(Connectionist Temporal Classification) 디코더입니다.

    580+1최근 7일 스타 변화
  • WhisperS2T@shashikg

    다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인

    578+1최근 7일 스타 변화
  • 앱을 위한 셀프 코딩 시스템 — React Native용 Alan AI SDK.

    575+0최근 7일 스타 변화
  • VRCOSC@VolcanicArts

    VRChat을 위한 모듈형 노드 프로그래밍 언어, 프로그램 생성기, 애니메이션 시스템, 툴킷, 라우터 및 디버거

    562-1최근 7일 스타 변화
  • 사용자의 음성 권한을 획득하고 커스텀 가능한 UI를 통해 텍스트로 입력받는 오버레이

    557+1최근 7일 스타 변화
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: 자동 음성 인식(ASR)을 위한 대규모의 강력하고 포괄적인 벤치마킹 플랫폼입니다.

    553+3최근 7일 스타 변화
  • 한국어 음성인식(STT) API 목록 및 성능 벤치마크

    547+1최근 7일 스타 변화
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    541+14최근 7일 스타 변화
  • CleanS2S@opendilab

    단일 파일로 구현된 고품질 스트리밍 음성 대 음성(Speech-to-Speech) 대화형 에이전트

    540+0최근 7일 스타 변화
  • parrots@shibing624

    자동 음성 인식(ASR), 텍스트 음성 변환(TTS) 엔진. 중영 음성 인식, 다중 역할 음성 합성, 다국어 지원, 높은 정확도

    530+1최근 7일 스타 변화
  • vosk-browser@ccoreilly

    Vosk의 WebAssembly 빌드를 사용하여 브라우저에서 실행되는 음성 인식 라이브러리

    529+1최근 7일 스타 변화
← 토픽 목록으로