Lompat ke konten utama
buildradar
Sign in
Topik · asr

asr

Repositori open source terpantau bertanda asr, diurutkan berdasarkan bintang.

86 repositori
  • Voxtral ASR & TTS berjalan secara native dan di dalam browser. Implementasi Rust dari ASR / TTS real-time mini Voxtral milik Mistral menggunakan framework Burn ML

    819+2Perubahan bintang dalam 7 hari terakhir
  • voxt@hehehai

    🎙️ Asisten produktivitas suara cerdas yang mengubah ucapan menjadi teks bersih, tindakan yang berguna, dan pengetahuan terstruktur. Membantu pengguna menangkap ide, berkomunikasi secara alami, mengotomatiskan tugas repetitif, dan tetap produktif di berbagai aplikasi dan alur kerja.

    807+5Perubahan bintang dalam 7 hari terakhir
  • ZerolanLiveRobot@AkagawaTsurunaki

    AI VTuber dengan teknologi LLM, ASR, TTS, OCR, CV, dan lainnya untuk siaran langsung atau bermain Minecraft bersama Anda.

    803+5Perubahan bintang dalam 7 hari terakhir
  • BiBi-Keyboard@BryceWG

    BiBi Keyboard: Aplikasi keyboard metode masukan suara LLM dan ASR untuk platform Android berbasis Kotlin

    772+17Perubahan bintang dalam 7 hari terakhir
  • cn2an@Ailln

    📦 Konversi cepat antara angka Tiongkok dan angka Arab (fitur terbaru: konversi pecahan, tanggal, suhu, dll.)

    766+0Perubahan bintang dalam 7 hari terakhir
  • PaddlePaddle-DeepSpeech@yeyupiaoling

    Pengenalan suara berbasis PaddlePaddle, pengenalan suara bahasa Mandarin. Proyek yang lengkap dengan hasil pengenalan yang baik. Mendukung pelatihan dan prediksi di bawah Windows dan Linux, serta mendukung prediksi papan pengembang Nvidia Jetson.

    763+0Perubahan bintang dalam 7 hari terakhir
  • Menjalankan model speech-to-text (whisper.cpp) di Unity3d pada mesin lokal Anda.

    751+1Perubahan bintang dalam 7 hari terakhir
  • MASR@yeyupiaoling

    Kerangka kerja Automatic Speech Recognition (ASR) streaming dan non-streaming yang diimplementasikan dengan PyTorch, kompatibel dengan pengenalan online dan offline, saat ini mendukung model Conformer, Squeezeformer, dan DeepSpeech2, serta berbagai metode augmentasi data.

    727+0Perubahan bintang dalam 7 hari terakhir
  • openspeech@openspeech-team

    Toolkit Open-Source untuk Pengenalan Ucapan End-to-End yang memanfaatkan PyTorch-Lightning dan Hydra.

    714+0Perubahan bintang dalam 7 hari terakhir
  • Pengenalan suara luring (offline) menggunakan OpenAI Whisper dan TensorFlow Lite untuk Android.

    688+0Perubahan bintang dalam 7 hari terakhir
  • Makalah INTERSPEECH 2023-2024: Kumpulan lengkap makalah penelitian yang berpengaruh dan menarik dari konferensi INTERSPEECH 2023-24. Jelajahi kemajuan terbaru dalam pemrosesan ucapan dan bahasa. Disertai kode. Beri bintang pada repositori untuk mendukung kemajuan teknologi ucapan!

    684+0Perubahan bintang dalam 7 hari terakhir
  • pyannote-whisper@yinruiqing
    677+0Perubahan bintang dalam 7 hari terakhir
  • FireRedASR2S@FireRedTeam

    Sistem ASR All-in-One Kelas Industri SOTA dengan modul ASR, VAD, LID, dan Punc. FireRedASR2 mendukung bahasa Mandarin (Mandarin, 20+ dialek/aksen), Inggris, pencampuran kode, serta ASR ucapan dan nyanyian. FireRedVAD mendukung ucapan/nyanyian/musik dalam 100+ bahasa. FireRedLID mendukung 100+ bahasa dan 20+ dialek Mandarin. FireRedPunc mendukung Mandarin dan Inggris.

    672+13Perubahan bintang dalam 7 hari terakhir
  • cheetah@Picovoice

    Mesin ucapan-ke-teks streaming on-device yang didukung oleh deep learning

    671+0Perubahan bintang dalam 7 hari terakhir
  • LiveTranslate@TheDeathDragon

    Terjemahan audio waktu nyata, menangkap audio sistem + mik, menjalankan ASR (Whisper/SenseVoice), menerjemahkan melalui LLM API dengan tampilan streaming. Sempurna untuk VTuber, streamer langsung, dan menonton konten asing.

    626+38Perubahan bintang dalam 7 hari terakhir
  • ASR_Theory@zw76859420

    Teori, makalah, dan PPT pengenalan suara.

    618+0Perubahan bintang dalam 7 hari terakhir
  • optimum-intel@huggingface

    🤗 Optimum Intel: Percepat inferensi dengan alat optimasi Intel

    617+1Perubahan bintang dalam 7 hari terakhir
  • RapidASR@RapidAI

    Pustaka program pengenalan suara otomatis sumber terbuka kelas komersial, siap pakai, dukungan lintas platform, dan pengenalan campuran Mandarin-Inggris. Implementasi lintas platform untuk inferensi ASR berbasis ONNXRuntime dan FunASR, menyediakan sekumpulan API yang lebih mudah untuk memanggil model ASR.

    611+0Perubahan bintang dalam 7 hari terakhir
  • echokit_server@second-state

    Platform Agen Suara Open Source.

    592+2Perubahan bintang dalam 7 hari terakhir
  • auto-caption@HiMeditator

    Perangkat lunak tampilan teks terjemahan waktu nyata lintas platform.

    578+4Perubahan bintang dalam 7 hari terakhir
  • WhisperS2T@shashikg

    Pipeline Speech-to-Text yang dioptimalkan untuk Model Whisper yang mendukung berbagai Inference Engine

    578+1Perubahan bintang dalam 7 hari terakhir
  • Leaderboard@SpeechColab

    SpeechIO Leaderboard: platform benchmarking yang besar, kuat, komprehensif untuk Automatic Speech Recognition.

    553+3Perubahan bintang dalam 7 hari terakhir
  • vosk-browser@ccoreilly

    Pustaka pengenalan suara yang berjalan di browser berkat build WebAssembly dari Vosk

    529+1Perubahan bintang dalam 7 hari terakhir
  • ICASSP-2023-24-Papers@DmitryRyumin

    Makalah ICASSP 2023-2024: Kumpulan lengkap makalah penelitian yang berpengaruh dan menarik dari konferensi ICASSP 2023-24. Jelajahi kemajuan terbaru dalam akustik, ucapan, dan pemrosesan sinyal. Kode disertakan. Beri bintang pada repositori untuk mendukung kemajuan pemrosesan audio dan sinyal!

    526+1Perubahan bintang dalam 7 hari terakhir
  • whisplay-ai-chatbot@PiSugar

    Chatbot AI seukuran saku yang dibangun menggunakan RPI Zero 2w / 5

    513+10Perubahan bintang dalam 7 hari terakhir
  • Audar-ASR-V1@AudarAI

    Arabic-first generative speech recognition — Audar-ASR-V1 (Flash + Turbo). #1 on the Open Universal Arabic ASR Leaderboard. Model cards, benchmarks & inference.

    501+7Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik