본문으로 건너뛰기
buildradar
Sign in
토픽 · asr

asr

asr 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 87개
  • GLM-ASR@zai-org

    GLM-ASR-Nano: 15억 개의 파라미터를 가진 강력한 오픈 소스 음성 인식 모델

    854+3최근 7일 스타 변화
  • 네이티브 및 브라우저에서 실행되는 Voxtral ASR & TTS. Burn ML 프레임워크를 사용하여 Mistral의 Voxtral mini 실시간 ASR/TTS를 Rust로 구현

    819+2최근 7일 스타 변화
  • voxt@hehehai

    🎙️ 음성을 깔끔한 텍스트, 유용한 작업, 구조화된 지식으로 변환해주는 지능형 음성 생산성 어시스턴트입니다. 사용자가 아이디어를 포착하고, 자연스럽게 소통하며, 반복 작업을 자동화하고, 다양한 앱과 워크플로우에서 생산성을 유지할 수 있도록 돕습니다.

    807+5최근 7일 스타 변화
  • ZerolanLiveRobot@AkagawaTsurunaki

    LLM, ASR, TTS, OCR, CV 등 다양한 기술을 활용하여 라이브 스트리밍을 하거나 함께 Minecraft를 플레이하는 AI VTuber

    803+5최근 7일 스타 변화
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Kotlin 기반의 Android 플랫폼 LLM 및 ASR 음성 입력기 키보드 애플리케이션

    772+17최근 7일 스타 변화
  • cn2an@Ailln

    📦 '중국어 숫자'와 '아라비아 숫자'를 빠르게 변환하는 도구 (최신 기능: 분수, 날짜, 온도 등 변환 지원)

    766+0최근 7일 스타 변화
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    PaddlePaddle 기반의 중국어 음성 인식 프로젝트. Windows 및 Linux 환경에서의 학습과 예측을 지원하며 Nvidia Jetson 개발 보드에서의 예측도 가능함

    763+0최근 7일 스타 변화
  • 로컬 머신의 Unity3d에서 음성 인식 모델(whisper.cpp) 실행하기.

    751+1최근 7일 스타 변화
  • MASR@yeyupiaoling

    Pytorch로 구현된 스트리밍 및 비스트리밍 자동 음성 인식 프레임워크. 온라인 및 오프라인 인식을 모두 지원하며 Conformer, Squeezeformer, DeepSpeech2 모델과 다양한 데이터 증강 방법을 지원함

    727+0최근 7일 스타 변화
  • openspeech@openspeech-team

    PyTorch-Lightning과 Hydra를 활용한 엔드투엔드 음성 인식 오픈소스 툴킷

    714+0최근 7일 스타 변화
  • Android용 OpenAI Whisper 및 TensorFlow Lite를 사용한 오프라인 음성 인식.

    688+0최근 7일 스타 변화
  • INTERSPEECH 2023-2024 논문 모음: INTERSPEECH 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 전체 컬렉션입니다. 음성 및 언어 처리 분야의 최신 기술 발전을 확인해 보세요. 코드 포함.

    684+0최근 7일 스타 변화
  • pyannote-whisper@yinruiqing
    677+0최근 7일 스타 변화
  • FireRedASR2S@FireRedTeam

    ASR, VAD, LID, Punc 모듈을 포함한 산업용 올인원 ASR 시스템. FireRedASR2는 중국어(표준어 및 20개 이상의 방언/억양), 영어, 코드 스위칭, 음성 및 노래 ASR을 지원하며, FireRedVAD는 100개 이상의 언어, FireRedLID는 100개 이상의 언어와 20개 이상의 중국어 방언, FireRedPunc는 중국어와 영어를 지원함

    672+13최근 7일 스타 변화
  • cheetah@Picovoice

    딥러닝 기반의 온디바이스 스트리밍 음성 인식(STT) 엔진

    671+0최근 7일 스타 변화
  • LiveTranslate@TheDeathDragon

    실시간 오디오 번역 도구. 시스템 오디오와 마이크를 캡처하여 ASR(Whisper/SenseVoice)로 인식하고 LLM API를 통해 스트리밍 방식으로 번역 결과를 표시합니다. VTuber, 라이브 스트리머 및 외국어 콘텐츠 시청에 최적화되어 있습니다.

    626+38최근 7일 스타 변화
  • ASR_Theory@zw76859420

    음성 인식 이론, 논문 및 PPT

    618+0최근 7일 스타 변화
  • optimum-intel@huggingface

    🤗 Optimum Intel: Intel 최적화 도구로 추론 가속화

    617+1최근 7일 스타 변화
  • RapidASR@RapidAI

    상용 수준의 오픈 소스 음성 자동 인식 라이브러리. 즉시 사용 가능하며 모든 플랫폼을 지원하고 중영 혼합 인식을 지원합니다. ONNXRuntime 및 FunASR을 기반으로 하는 크로스 플랫폼 ASR 추론 구현체입니다. ASR 모델을 호출하기 위한 더 쉬운 API 세트를 제공합니다.

    611+0최근 7일 스타 변화
  • echokit_server@second-state

    오픈 소스 음성 에이전트 플랫폼

    592+2최근 7일 스타 변화
  • WhisperS2T@shashikg

    다중 추론 엔진을 지원하는 Whisper 모델용 최적화된 음성 인식 파이프라인

    578+1최근 7일 스타 변화
  • auto-caption@HiMeditator

    크로스 플랫폼 실시간 자막 표시 소프트웨어

    578+4최근 7일 스타 변화
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: 자동 음성 인식(ASR)을 위한 대규모의 강력하고 포괄적인 벤치마킹 플랫폼입니다.

    553+3최근 7일 스타 변화
  • vosk-browser@ccoreilly

    Vosk의 WebAssembly 빌드를 사용하여 브라우저에서 실행되는 음성 인식 라이브러리

    529+1최근 7일 스타 변화
  • ICASSP-2023-24-Papers@DmitryRyumin

    ICASSP 2023-2024 논문: ICASSP 2023-24 컨퍼런스의 영향력 있고 흥미로운 연구 논문 모음. 음향, 음성 및 신호 처리 분야의 최신 발전을 탐색하세요. 코드 포함.

    526+1최근 7일 스타 변화
  • whisplay-ai-chatbot@PiSugar

    Raspberry Pi Zero 2W로 구축한 포켓 사이즈 AI 챗봇

    513+10최근 7일 스타 변화
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7최근 7일 스타 변화
← 토픽 목록으로