본문으로 건너뛰기
buildradar
Sign in
토픽 · speech-to-text

speech-to-text

speech-to-text 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 152개
  • Audio AI 분야의 LLM(거대 언어 모델) 활용 사례 리소스 모음

    738+1최근 7일 스타 변화
  • MASR@yeyupiaoling

    Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함

    727+0최근 7일 스타 변화
  • voice-ai@rapidaai

    Rapida는 오디오 스트리밍, STT, TTS, VAD, 다중 채널 통합, 에이전트 상태 관리 및 관찰 가능성을 제공하여 실시간 대화형 음성 에이전트를 구축할 수 있는 오픈소스 엔드투엔드 음성 AI 오케스트레이션 플랫폼입니다.

    723+2최근 7일 스타 변화
  • adapt@MycroftAI

    Adapt 의도 파서(Intent Parser)

    719+0최근 7일 스타 변화
  • curses@mmpneo

    OBS, VRChat, Twitch 채팅, Discord를 위한 음성 인식(Speech to Text) 및 KB 입력 자막

    718+0최근 7일 스타 변화
  • speech-demo@Baidu-AIP

    음성 API 예제

    707+0최근 7일 스타 변화
  • 음성 인식(Speech-to-Text) 벤치마크 프레임워크

    698+0최근 7일 스타 변화
  • WhisperSubTranslate@Blue-B

    비디오에서 자막(SRT)을 추출하고 원하는 언어로 번역할 수 있는 무료 로컬 데스크톱 앱. 무제한 사용 가능하며 가입이나 클라우드 연결이 필요 없습니다.

    684+27최근 7일 스타 변화
  • React Native Expo 프로젝트를 위한 음성 인식 라이브러리

    678+7최근 7일 스타 변화
  • openlrc@zh-plus

    Whisper와 LLM(GPT, Claude 등)을 사용하여 음성을 LRC 자막 파일로 변환 및 번역

    675+0최근 7일 스타 변화
  • cheetah@Picovoice

    딥러닝 기반의 온디바이스 스트리밍 음성 인식(STT) 엔진

    671+0최근 7일 스타 변화
  • sonus@evancohen

    Node.js용 STT(Speech to Text) 라이브러리, 오프라인 핫워드 감지 기능 포함

    638+0최근 7일 스타 변화
  • Proctoring-AI@vardanagarwal

    온라인 시험 감독 자동 모니터링 소프트웨어 개발

    634-1최근 7일 스타 변화
  • macparakeet@moona3k

    Apple Silicon Mac을 위한 빠르고 개인정보 보호 중심의 로컬 우선 음성 앱. 받아쓰기, 파일/미디어 전사, 회의 녹음, 변환 및 공개 자동화 CLI 제공. 무료 오픈 소스

    630+17최근 7일 스타 변화
  • pindrop@watzon

    WhisperKit을 사용하여 로컬 음성 인식 기능을 제공하는 macOS 메뉴바용 받아쓰기 앱

    620+3최근 7일 스타 변화
  • speech-to-text@reriiasu

    faster-whisper를 사용한 실시간 전사

    614+0최근 7일 스타 변화
  • CrispASR@CrispStrobe

    다국어 ASR 및 TTS 모델을 위한 C++ ggml 런타임 허브: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2 등 지원 및 범용 강제 정렬(forced alignment) 기능 제공

    612+22최근 7일 스타 변화
  • Sayboard@ElishaAz

    Vosk 라이브러리를 사용하는 Android용 오픈소스 온디바이스 음성 입력기(IME)

    581+3최근 7일 스타 변화
  • Playwright로 reCAPTCHA v2 및 v3를 해결하기 위한 Python 라이브러리

    579+5최근 7일 스타 변화
  • WhisperS2T@shashikg

    다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인

    578+1최근 7일 스타 변화
  • VRCOSC@VolcanicArts

    VRChat을 위한 모듈형 노드 프로그래밍 언어, 프로그램 생성기, 애니메이션 시스템, 툴킷, 라우터 및 디버거

    563-2최근 7일 스타 변화
  • 사용자의 음성 권한을 획득하고 커스텀 가능한 UI를 통해 텍스트로 입력받는 오버레이

    557+1최근 7일 스타 변화
  • 한국어 음성인식(STT) API 목록 및 성능 벤치마크

    547+1최근 7일 스타 변화
  • localstudio@ErickWendel

    Browser-only Canva-style presentation studio, powered by local Web AI.

    544최근 7일 스타 변화
  • Talkify@tornikegomareli

    Lightning-fast, free, local first voice dictation for macOS with on-device transcription

    542+15최근 7일 스타 변화
  • vosk-browser@ccoreilly

    Vosk의 WebAssembly 빌드를 사용하여 브라우저에서 실행되는 음성 인식 라이브러리

    529+1최근 7일 스타 변화
  • Phonetisaurus@AdolfVonKleist

    Phonetisaurus G2P

    521-1최근 7일 스타 변화
  • AI를 활용하여 발음을 평가하는 도구입니다.

    517+2최근 7일 스타 변화
  • transcribee@bugbakery

    오픈 소스 오디오 및 비디오 전사 소프트웨어

    515+2최근 7일 스타 변화
  • WebRTC, REST, WS를 통해 ASR/STT, TTS, LLM을 지원하는 오픈 소스, 로컬, 자체 호스팅 최적화 언어 추론 서버

    512+0최근 7일 스타 변화
← 토픽 목록으로