Lompat ke konten utama
buildradar
Sign in
Topik · speech

speech

Repositori open source terpantau bertanda speech, diurutkan berdasarkan bintang.

Repositori
72
Total bintang
379.232
Rata-rata bintang
5.267
Porsi
0,02%

Topik yang sering muncul berdampingan dengan speech di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda speech.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • TTS@coqui-ai

    🐸💬 - toolkit deep learning untuk Text-to-Speech, teruji dalam penelitian dan produksi

    45.967+36Perubahan bintang dalam 7 hari terakhir
  • MockingBird@babysor

    🚀 Kloning suara dalam 5 detik untuk menghasilkan ucapan arbitrer secara real-time.

    36.912-1Perubahan bintang dalam 7 hari terakhir
  • VoxCPM@OpenBMB

    VoxCPM2: TTS tanpa tokenizer untuk pembuatan ucapan multibahasa, desain suara kreatif, dan kloning suara yang realistis

    36.250+293Perubahan bintang dalam 7 hari terakhir
  • whisperX@m-bain

    WhisperX: Pengenalan Ucapan Otomatis dengan stempel waktu tingkat kata (& Diarisasi)

    23.803+117Perubahan bintang dalam 7 hari terakhir
  • datasets@huggingface

    🤗 Pusat dataset siap pakai terbesar untuk model AI dengan alat manipulasi data yang cepat, mudah digunakan, dan efisien.

    21.878+34Perubahan bintang dalam 7 hari terakhir
  • Grounded-Segment-Anything@IDEA-Research

    Grounded SAM: Menggabungkan Grounding DINO dengan Segment Anything & Stable Diffusion & Recognize Anything - Secara otomatis mendeteksi, melakukan segmentasi, dan menghasilkan apa pun

    17.713+3Perubahan bintang dalam 7 hari terakhir
  • kaldi@kaldi-asr

    kaldi-asr/kaldi adalah lokasi resmi dari proyek Kaldi.

    15.471+7Perubahan bintang dalam 7 hari terakhir
  • speech-to-speech@huggingface

    Membangun agen suara dengan model open-source

    12.933+180Perubahan bintang dalam 7 hari terakhir
  • AudioGPT@AIGC-Audio

    AudioGPT: Memahami dan Menghasilkan Ucapan, Musik, Suara, dan Talking Head

    10.166-2Perubahan bintang dalam 7 hari terakhir
  • silero-vad@snakers4

    Silero VAD: Voice Activity Detector tingkat perusahaan yang telah dilatih sebelumnya

    10.083+52Perubahan bintang dalam 7 hari terakhir
  • modelscope@modelscope

    ModelScope: wujudkan konsep Model-sebagai-Layanan (Model-as-a-Service).

    9.117+19Perubahan bintang dalam 7 hari terakhir
  • EmotiVoice@netease-youdao

    EmotiVoice 😊: Mesin TTS Multi-Suara dan Terkontrol-Prompt

    8.523+2Perubahan bintang dalam 7 hari terakhir
  • models@PaddlePaddle

    Dikelola secara resmi dan didukung oleh PaddlePaddle, mencakup CV, NLP, Speech, Rec, TS, model besar, dan lainnya.

    6.932+0Perubahan bintang dalam 7 hari terakhir
  • annyang@TalAter

    💬 Pengenalan ucapan untuk situs Anda

    6.816+1Perubahan bintang dalam 7 hari terakhir
  • silero-models@snakers4

    Silero Models: model text-to-speech pra-latih yang dibuat sangat sederhana

    6.085+11Perubahan bintang dalam 7 hari terakhir
  • cactus@cactus-compute

    Kuantisasi, kernel, runtime, dan mesin inferensi untuk perangkat seluler, perangkat yang dapat dikenakan, rumah pintar, dan robot.

    5.955+71Perubahan bintang dalam 7 hari terakhir
  • whisper-diarization@MahmoudAshraf97

    Pengenalan Ucapan Otomatis (ASR) dengan Speaker Diarization berbasis OpenAI Whisper

    5.633+7Perubahan bintang dalam 7 hari terakhir
  • stt@jianchang512

    Alat pengenalan suara ke teks, alat konversi audio/video ke subtitle yang berjalan secara lokal (offline), mendukung format output json, srt, dan teks biasa.

    4.771+7Perubahan bintang dalam 7 hari terakhir
  • DeepFilterNet@Rikorose

    Peredaman kebisingan menggunakan deep filtering

    4.636+14Perubahan bintang dalam 7 hari terakhir
  • ultravox@fixie-ai

    LLM multimodal yang cepat untuk suara waktu nyata

    4.556+7Perubahan bintang dalam 7 hari terakhir
  • ClearerVoice-Studio@modelscope

    Toolkit pemrosesan ucapan bertenaga AI dan SOTA Pretrained Models open source, mendukung peningkatan ucapan, pemisahan, dan ekstraksi target speaker, dll.

    4.449+19Perubahan bintang dalam 7 hari terakhir
  • metavoice-src@metavoiceio

    Model dasar untuk TTS yang ekspresif dan mirip manusia

    4.204-1Perubahan bintang dalam 7 hari terakhir
  • Amazing-Python-Scripts@avinashkranjan

    Koleksi pilihan skrip Python luar biasa dari tingkat dasar hingga lanjut dengan skrip tugas otomatisasi.

    3.663+5Perubahan bintang dalam 7 hari terakhir
  • Applio@IAHispano

    Alat konversi suara yang sederhana dan berkualitas tinggi dengan fokus pada kemudahan penggunaan dan performa.

    3.660+39Perubahan bintang dalam 7 hari terakhir
  • Layanan API ASR OpenAI Whisper

    3.326+2Perubahan bintang dalam 7 hari terakhir
  • iOS-10-Sampler@shu223

    Contoh kode untuk API baru di iOS 10.

    3.273-2Perubahan bintang dalam 7 hari terakhir
  • audio@pytorch

    Manipulasi dan transformasi data untuk pemrosesan sinyal audio, didukung oleh PyTorch

    2.931+6Perubahan bintang dalam 7 hari terakhir
  • lingvo@tensorflow

    Lingvo

    2.864+0Perubahan bintang dalam 7 hari terakhir
  • aeneas@readbeyond

    aeneas adalah pustaka Python/C dan sekumpulan alat untuk menyinkronkan audio dan teks secara otomatis (dikenal sebagai forced alignment)

    2.862-1Perubahan bintang dalam 7 hari terakhir
  • whisper-timestamped@linto-ai

    Pengenalan Ucapan Otomatis Multibahasa dengan stempel waktu tingkat kata dan tingkat kepercayaan.

    2.841+2Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik