본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-recognition

speech-recognition

speech-recognition 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 156개
  • whisper-jax@sanchit-gandhi

    TPU에서 최대 70배 속도 향상을 제공하는 OpenAI Whisper 모델의 JAX 구현

    4,679-1최근 7일 스타 변화
  • pocketsphinx@cmusphinx

    소형 음성 인식기

    4,337+2최근 7일 스타 변화
  • distil-whisper@huggingface

    음성 인식을 위한 Whisper의 증류(Distilled) 변형 버전. 6배 더 빠르고, 50% 더 작으며, 단어 오류율 1% 이내.

    4,114+2최근 7일 스타 변화
  • OpenAI Whisper ASR 웹서비스 API

    3,328+2최근 7일 스타 변화
  • Python을 다루기 귀찮은 분들을 위한 Whisper 및 Faster-Whisper 독립형 실행 파일.

    3,171+2최근 7일 스타 변화
  • willow@HeyWillow

    오픈 소스, 로컬 및 자체 호스팅 기반의 Amazon Echo/Google Home 경쟁 음성 어시스턴트 대안

    3,101+1최근 7일 스타 변화
  • whishper@pluja

    웹 UI를 사용하여 100% 로컬에서 오디오를 텍스트로 변환하고 자막을 번역 및 편집합니다. Whisper 모델 구동!

    3,068+2최근 7일 스타 변화
  • lingvo@tensorflow

    Lingvo

    2,864+0최근 7일 스타 변화
  • whisper-timestamped@linto-ai

    단어 수준 타임스탬프와 신뢰도를 제공하는 다국어 자동 음성 인식

    2,842+1최근 7일 스타 변화
  • STT@coqui-ai

    🐸STT - 음성 인식(Speech-to-Text)을 위한 딥러닝 툴킷. STT 모델 학습과 배포가 그 어느 때 보다 쉬워집니다.

    2,606+1최근 7일 스타 변화
  • qwen-audio-agent@QwenAudio

    에이전트가 대화하고, 작업하고, 상주할 수 있도록 유지하는 실시간 음성 런타임. AI 에이전트를 위한 실시간 음성 런타임

    2,362+72최근 7일 스타 변화
  • tensorflow 딥러닝 프레임워크와 시퀀스 대 시퀀스 신경망을 사용한 음성 인식

    2,173+0최근 7일 스타 변화
  • parlor@fikrikarim

    GPT-Live와 유사한 기능을 갖춘 온디바이스 실시간 멀티모달 AI

    2,048+7최근 7일 스타 변화
  • FireRedASR@FireRedTeam

    만다린, 중국 방언 및 영어를 지원하는 오픈 소스 산업용 ASR 모델로, 공인된 만다린 ASR 벤치마크에서 새로운 SOTA를 달성하는 동시에 뛰어난 가사 인식 기능도 제공합니다.

    1,975+2최근 7일 스타 변화
  • masr@nobody132

    중국어 음성 인식; Mandarin Automatic Speech Recognition;

    1,968+0최근 7일 스타 변화
  • julius@julius-speech

    오픈소스 대용량 어휘 연속 음성 인식 엔진

    1,935+1최근 7일 스타 변화
  • 화자 분할(Speaker Diarization) 관련 우수 논문, 라이브러리, 데이터셋 및 기타 리소스 모음

    1,894+1최근 7일 스타 변화
  • alan-sdk-ios@alan-ai

    앱을 위한 셀프 코딩 시스템 — iOS용 Alan AI SDK

    1,878-3최근 7일 스타 변화
  • 앱을 위한 셀프 코딩 시스템 — 안드로이드용 Alan AI SDK

    1,807-1최근 7일 스타 변화
  • whisper-turbo@FL33TW00D

    크로스 플랫폼, GPU 가속 Whisper 🏎️

    1,794+0최근 7일 스타 변화
  • sherpa-ncnn@k2-fsa

    인터넷 연결 없이 ncnn을 사용하는 차세대 Kaldi 기반 실시간 음성 인식 및 음성 활동 감지(VAD). iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A 등 지원

    1,777-1최근 7일 스타 변화
  • 앱을 위한 자체 코딩 시스템 — Flutter용 Alan AI SDK

    1,756-1최근 7일 스타 변화
  • alan-sdk-ionic@alan-ai

    앱을 위한 셀프 코딩 시스템 — Ionic용 Alan AI SDK

    1,649-1최근 7일 스타 변화
  • dsnote@mkiol

    Speech Note Linux 앱. 오프라인 음성 인식(STT), 음성 합성(TTS) 및 기계 번역을 통한 메모 작성, 읽기 및 번역.

    1,622+8최근 7일 스타 변화
  • AI를 이용한 로컬 음성 인식 및 자막 생성을 위한 OBS 플러그인

    1,597+8최근 7일 스타 변화
  • amica@semperai

    Amica는 음성 합성 및 음성 인식을 통해 3D 캐릭터와 상호작용할 수 있는 오픈 소스 인터페이스입니다.

    1,591-2최근 7일 스타 변화
  • ComfyUI의 기능을 확장하는 커스텀 노드

    1,525+1최근 7일 스타 변화
  • SALMONN@bytedance

    SALMONN 제품군: 고급 멀티모달 LLM 모음

    1,521+3최근 7일 스타 변화
  • Fun-ASR@QwenAudio

    FunASR, vLLM, 스트리밍, llama.cpp 런타임을 지원하는 중국어, 방언, 사투리 및 다국어 음성을 위한 오픈소스 LLM 기반 ASR 모델 패밀리

    1,512+10최근 7일 스타 변화
  • SpeechT5@microsoft

    음성 언어 처리를 위한 통합 모달 음성-텍스트 사전 학습

    1,449+0최근 7일 스타 변화
← 토픽 목록으로