Lompat ke konten utama
buildradar
Sign in
Topik · speech-recognition

speech-recognition

Repositori open source terpantau bertanda speech-recognition, diurutkan berdasarkan bintang.

156 repositori
  • whisper-jax@sanchit-gandhi

    Implementasi JAX dari model Whisper OpenAI untuk peningkatan kecepatan hingga 70x pada TPU.

    4.679-1Perubahan bintang dalam 7 hari terakhir
  • pocketsphinx@cmusphinx

    Pengenal ucapan kecil

    4.337+2Perubahan bintang dalam 7 hari terakhir
  • distil-whisper@huggingface

    Varian distilasi dari Whisper untuk pengenalan suara. 6x lebih cepat, 50% lebih kecil, dengan tingkat kesalahan kata di bawah 1%.

    4.114+2Perubahan bintang dalam 7 hari terakhir
  • Layanan API ASR OpenAI Whisper

    3.328+2Perubahan bintang dalam 7 hari terakhir
  • Executable mandiri Whisper & Faster-Whisper bagi mereka yang tidak ingin repot dengan Python.

    3.171+2Perubahan bintang dalam 7 hari terakhir
  • willow@HeyWillow

    Alternatif asisten suara sumber terbuka, lokal, dan self-hosted untuk menyaingi Amazon Echo/Google Home

    3.101+1Perubahan bintang dalam 7 hari terakhir
  • whishper@pluja

    Transkripsikan audio apa pun menjadi teks, terjemahkan, dan edit subtitle 100% secara lokal dengan antarmuka web. Didukung oleh model whisper!

    3.068+2Perubahan bintang dalam 7 hari terakhir
  • lingvo@tensorflow

    Lingvo

    2.864+0Perubahan bintang dalam 7 hari terakhir
  • whisper-timestamped@linto-ai

    Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.

    2.842+1Perubahan bintang dalam 7 hari terakhir
  • STT@coqui-ai

    🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.

    2.606+1Perubahan bintang dalam 7 hari terakhir
  • qwen-audio-agent@QwenAudio

    Runtime suara real-time yang menjaga Agen tetap berbicara, bekerja, dan hadir. Runtime Suara Real-time untuk Agen AI.

    2.362+68Perubahan bintang dalam 7 hari terakhir
  • 🎙 Pengenalan ucapan menggunakan kerangka kerja deep learning tensorflow, jaringan saraf sequence-to-sequence

    2.173+0Perubahan bintang dalam 7 hari terakhir
  • parlor@fikrikarim

    AI multimodal waktu nyata pada perangkat dengan fitur yang mirip dengan GPT-Live

    2.048+7Perubahan bintang dalam 7 hari terakhir
  • FireRedASR@FireRedTeam

    Model ASR kelas industri sumber terbuka yang mendukung bahasa Mandarin, dialek Tiongkok, dan bahasa Inggris, mencapai SOTA baru pada tolok ukur ASR Mandarin publik, sekaligus menawarkan kemampuan pengenalan lirik lagu yang luar biasa.

    1.975+2Perubahan bintang dalam 7 hari terakhir
  • masr@nobody132

    Pengenalan suara bahasa Mandarin; Mandarin Automatic Speech Recognition;

    1.968+0Perubahan bintang dalam 7 hari terakhir
  • julius@julius-speech

    Mesin Pengenalan Ucapan Kontinu Kosakata Besar Sumber Terbuka

    1.935+1Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah, pustaka, dataset, dan sumber daya Speaker Diarization yang luar biasa.

    1.894+1Perubahan bintang dalam 7 hari terakhir
  • alan-sdk-ios@alan-ai

    Sistem pengodean mandiri untuk aplikasi Anda — Alan AI SDK untuk iOS.

    1.878-3Perubahan bintang dalam 7 hari terakhir
  • Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Android

    1.807-1Perubahan bintang dalam 7 hari terakhir
  • whisper-turbo@FL33TW00D

    Whisper Lintas Platform dengan Akselerasi GPU 🏎️

    1.794+0Perubahan bintang dalam 7 hari terakhir
  • sherpa-ncnn@k2-fsa

    Pengenalan suara waktu nyata dan deteksi aktivitas suara (VAD) menggunakan Kaldi generasi berikutnya dengan ncnn tanpa koneksi Internet. Mendukung iOS, Android, Linux, macOS, Windows, Raspberry Pi, VisionFive2, LicheePi4A, dll.

    1.777-1Perubahan bintang dalam 7 hari terakhir
  • Sistem pengkodean mandiri untuk aplikasi Anda — Alan AI SDK untuk Flutter

    1.756-1Perubahan bintang dalam 7 hari terakhir
  • alan-sdk-ionic@alan-ai

    Sistem Pengodean Mandiri untuk Aplikasi Anda — Alan AI SDK untuk Ionic

    1.649-1Perubahan bintang dalam 7 hari terakhir
  • dsnote@mkiol

    Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.

    1.622+8Perubahan bintang dalam 7 hari terakhir
  • Plugin OBS untuk pengenalan ucapan lokal dan pembuatan teks keterangan menggunakan AI

    1.597+8Perubahan bintang dalam 7 hari terakhir
  • amica@semperai

    Amica adalah antarmuka sumber terbuka untuk komunikasi interaktif dengan karakter 3D yang dilengkapi sintesis suara dan pengenalan ucapan.

    1.591-2Perubahan bintang dalam 7 hari terakhir
  • Node kustom yang memperluas kemampuan Comfyui

    1.525+1Perubahan bintang dalam 7 hari terakhir
  • SALMONN@bytedance

    Keluarga SALMONN: Sekumpulan multi-modal LLM tingkat lanjut

    1.521+3Perubahan bintang dalam 7 hari terakhir
  • Fun-ASR@QwenAudio

    Keluarga model ASR berbasis LLM open-source untuk bahasa Mandarin, dialek, aksen, dan ucapan multilingual, lengkap dengan runtime FunASR, vLLM, streaming, dan llama.cpp.

    1.512+10Perubahan bintang dalam 7 hari terakhir
  • SpeechT5@microsoft

    Pra-pelatihan Ucapan-Teks Modal-Terpadu untuk Pemrosesan Bahasa Lisan

    1.449+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik