Lompat ke konten utama
buildradar
Sign in
Topik · voice-recognition

voice-recognition

Repositori open source terpantau bertanda voice-recognition, diurutkan berdasarkan bintang.

Repositori
23
Total bintang
85.588
Rata-rata bintang
3.721
Porsi
0,00%

Topik yang sering muncul berdampingan dengan voice-recognition di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda voice-recognition.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • vosk-api@alphacep

    API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.

    15.101+17Perubahan bintang dalam 7 hari terakhir
  • PaddleSpeech@PaddlePaddle

    Toolkit Speech yang mudah digunakan mencakup model Self-Supervised Learning, SOTA/Streaming ASR dengan tanda baca, Streaming TTS dengan frontend teks, Sistem Verifikasi Pembicara, End-to-End Speech Translation, dan Keyword Spotting. Pemenang Penghargaan Demo Terbaik NAACL2022.

    12.676+5Perubahan bintang dalam 7 hari terakhir
  • speechbrain@speechbrain

    Toolkit ucapan berbasis PyTorch

    11.802+10Perubahan bintang dalam 7 hari terakhir
  • moonshine@moonshine-ai

    Speech-to-text, pengenalan maksud, dan text-to-speech dengan latensi sangat rendah untuk membangun agen dan antarmuka suara

    10.997+33Perubahan bintang dalam 7 hari terakhir
  • silero-vad@snakers4

    Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya

    10.112+29Perubahan bintang dalam 7 hari terakhir
  • WhisperLive@collabora

    Implementasi hampir real-time dari Whisper OpenAI.

    4.246+3Perubahan bintang dalam 7 hari terakhir
  • cnchar@theajack

    Pustaka alat karakter Mandarin yang lengkap (pinyin, guratan, radikal, idiom, suara, visualisasi, dll.)

    3.087+3Perubahan bintang dalam 7 hari terakhir
  • STT@coqui-ai

    🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.

    2.606+1Perubahan bintang dalam 7 hari terakhir
  • ten-vad@TEN-framework

    Voice Activity Detector (VAD): latensi rendah, performa tinggi, dan ringan

    2.256+7Perubahan bintang dalam 7 hari terakhir
  • voice_datasets@jim-schwoebel

    🔊 Daftar lengkap dataset sumber terbuka untuk komputasi suara dan audio (95+ dataset).

    2.223+1Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • Proyek ini menggunakan berbagai model pengenalan sidik suara tingkat lanjut seperti EcapaTdnn, ResNetSE, ERes2Net, CAM++, dll. Kemungkinan model lain akan didukung di masa mendatang. Pada saat yang sama, proyek ini juga mendukung metode pra-pemrosesan data MelSpectrogram dan Spectrogram

    1.313+1Perubahan bintang dalam 7 hari terakhir
  • Asisten AI berbasis Python

    1.014+0Perubahan bintang dalam 7 hari terakhir
  • EDDiscovery@EDDiscovery

    Catatan kapten dan peta bintang 3D untuk Elite Dangerous

    898+2Perubahan bintang dalam 7 hari terakhir
  • rhino@Picovoice

    Mesin Speech-to-Intent pada perangkat yang didukung oleh deep learning.

    711+2Perubahan bintang dalam 7 hari terakhir
  • voicetypr@moinulmoin

    Voicetypr - alat dikte suara-ke-teks luring berbasis AI untuk pendiri yang sibuk, vibe coder, dan pengguna AI tingkat lanjut di macOS dan Windows. Alternatif untuk wispr flow dan superwhisper.

    707+12Perubahan bintang dalam 7 hari terakhir
  • framework tolok ukur speech to text

    697+0Perubahan bintang dalam 7 hari terakhir
  • Pengenalan Ucapan untuk proyek React Native Expo

    676+5Perubahan bintang dalam 7 hari terakhir
  • cheetah@Picovoice

    Mesin ucapan-ke-teks streaming on-device yang didukung oleh deep learning

    671+0Perubahan bintang dalam 7 hari terakhir
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) untuk Node dengan deteksi kata kunci offline.

    638+0Perubahan bintang dalam 7 hari terakhir
  • LiveTranslate@TheDeathDragon

    Terjemahan audio waktu nyata, menangkap audio sistem + mik, menjalankan ASR (Whisper/SenseVoice), menerjemahkan melalui LLM API dengan tampilan streaming. Sempurna untuk VTuber, streamer langsung, dan menonton konten asing.

    621+34Perubahan bintang dalam 7 hari terakhir
  • speech-to-text@reriiasu

    Transkripsi waktu nyata menggunakan faster-whisper

    614+0Perubahan bintang dalam 7 hari terakhir
  • 🗣 Overlay yang mendapatkan izin suara pengguna dan masukan sebagai teks dalam UI yang dapat disesuaikan

    557+1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik