Lompat ke konten utama
buildradar
Sign in
Topik · speech-processing

speech-processing

Repositori open source terpantau bertanda speech-processing, diurutkan berdasarkan bintang.

Repositori
20
Total bintang
71.137
Rata-rata bintang
3.557
Porsi
0,00%

Topik yang sering muncul berdampingan dengan speech-processing di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech-processing.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • speechbrain@speechbrain

    Toolkit ucapan berbasis PyTorch

    11.792+22Perubahan bintang dalam 7 hari terakhir
  • pyannote-audio@pyannote

    Blok bangunan neural untuk diarisasi pembicara: deteksi aktivitas suara, deteksi perubahan pembicara, deteksi ucapan tumpang tindih, embedding pembicara

    10.484+38Perubahan bintang dalam 7 hari terakhir
  • silero-vad@snakers4

    Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya

    10.083+52Perubahan bintang dalam 7 hari terakhir
  • maths-cs-ai-compendium@HenryNdubuaku

    Menjadi peneliti/insinyur AI/ML yang mahir dengan buku teks tidak konvensional yang mencakup matematika, komputasi, dan ML dengan pendekatan intuitif.

    7.379+33Perubahan bintang dalam 7 hari terakhir
  • Daftar bacaan untuk topik penelitian dalam machine learning multimodal.

    6.925+0Perubahan bintang dalam 7 hari terakhir
  • torchscale@microsoft

    Arsitektur fondasi untuk (M)LLM

    3.138+1Perubahan bintang dalam 7 hari terakhir
  • whisper-timestamped@linto-ai

    Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.

    2.841+2Perubahan bintang dalam 7 hari terakhir
  • resemble-enhance@resemble-ai

    Peredaman dan peningkatan kualitas suara berbasis AI.

    2.401+6Perubahan bintang dalam 7 hari terakhir
  • ten-vad@TEN-framework

    Voice Activity Detector (VAD): latensi rendah, performa tinggi, dan ringan

    2.250+4Perubahan bintang dalam 7 hari terakhir
  • IMS-Toucan@DigitalPhonetics

    Text-to-Speech yang cepat dan dapat dikontrol untuk lebih dari 7000 bahasa!

    2.208+0Perubahan bintang dalam 7 hari terakhir
  • Daftar kurasi makalah, pustaka, dataset, dan sumber daya Speaker Diarization yang luar biasa.

    1.893+2Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • voicefixer@haoheliu

    Pemulihan Ucapan Umum

    1.376+3Perubahan bintang dalam 7 hari terakhir
  • CrisperWhisper@nyrahealth

    Transkripsi yang Dapat Dikontrol. Verbatim (setiap kata, pengisi, jeda, gagap, suara vokal), atau yang dimaksudkan (apa yang ingin dikatakan pembicara, dioptimalkan untuk keterbacaan) dengan stempel waktu tingkat kata.

    1.362+21Perubahan bintang dalam 7 hari terakhir
  • StreamSpeech@ictnlp

    StreamSpeech adalah model "All in One" yang mulus untuk pengenalan suara offline dan simultan, terjemahan suara, serta sintesis suara.

    1.288+2Perubahan bintang dalam 7 hari terakhir
  • audino@midas-research

    Alat anotasi audio sumber terbuka untuk manusia

    1.146+0Perubahan bintang dalam 7 hari terakhir
  • SLAM-LLM@X-LANCE

    Kerangka kerja untuk Pemrosesan Ucapan, Bahasa, Audio, dan Musik dengan Large Language Model.

    1.056+0Perubahan bintang dalam 7 hari terakhir
  • Anda dapat menemukan algoritma ucapan yang Anda butuhkan di sini.

    878+1Perubahan bintang dalam 7 hari terakhir
  • MultiBench@pliang279

    [NeurIPS 2021] Benchmark Skala Multipel untuk Pembelajaran Representasi Multimodal

    636+0Perubahan bintang dalam 7 hari terakhir
  • Daftar laboratorium, perusahaan, sumber daya, dan magang di bidang pengenalan suara, rekomendasi atau pendaftaran mandiri dipersilakan

    609+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik