Lompat ke konten utama
buildradar
Sign in
Topik · stt

stt

Repositori open source terpantau bertanda stt, diurutkan berdasarkan bintang.

Repositori
32
Total bintang
109.255
Rata-rata bintang
3.414
Porsi
0,01%

Topik yang sering muncul berdampingan dengan stt di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda stt.

  • floe-guard@Floe-Labs

    Pengukur pengeluaran dan gerbang anggaran untuk agen suara AI. Mengukur STT + TTS + LLM + telepon per panggilan secara langsung (Pipecat, LiveKit — Python & TypeScript). Menghentikan paksa giliran berikutnya sebelum melebihi batas Anda. Lokal, tanpa akun, tanpa telemetri. Dibangun oleh Floe — kontrol biaya untuk Voice AI.

    434
  • khoj@khoj-ai

    Otak kedua AI Anda. Dapat di-self-host. Dapatkan jawaban dari web atau dokumen Anda. Bangun agen kustom, jadwalkan otomatisasi, lakukan riset mendalam. Ubah LLM online atau lokal apa pun menjadi AI otonom pribadi Anda (gpt, claude, gemini, llama, qwen, mistral). Mulai secara gratis.

    37.010+223Perubahan bintang dalam 7 hari terakhir
  • vosk-api@alphacep

    API pengenalan suara offline untuk Android, iOS, Raspberry Pi, dan server dengan Python, Java, C#, dan Node.

    15.101+17Perubahan bintang dalam 7 hari terakhir
  • moonshine@moonshine-ai

    Speech-to-text, pengenalan maksud, dan text-to-speech dengan latensi sangat rendah untuk membangun agen dan antarmuka suara

    10.997+33Perubahan bintang dalam 7 hari terakhir
  • Vision-Agents@GetStream

    Open Vision Agents oleh Stream. Bangun agen suara dan visi dengan cepat menggunakan model atau penyedia video apa pun. Menggunakan jaringan edge Stream untuk latensi ultra-rendah.

    8.113+9Perubahan bintang dalam 7 hari terakhir
  • stt@jianchang512

    Alat pengenalan suara ke teks, alat konversi audio/video ke subtitle yang berjalan secara lokal (offline), mendukung format output json, srt, dan teks biasa.

    4.780+9Perubahan bintang dalam 7 hari terakhir
  • whishper@pluja

    Transkripsikan audio apa pun menjadi teks, terjemahkan, dan edit subtitle 100% secara lokal dengan antarmuka web. Didukung oleh model whisper!

    3.068+2Perubahan bintang dalam 7 hari terakhir
  • STT@coqui-ai

    🐸STT - Toolkit deep learning untuk Speech-to-Text. Melatih dan menerapkan model STT tidak pernah semudah ini.

    2.606+1Perubahan bintang dalam 7 hari terakhir
  • 🎙 Pengenalan ucapan menggunakan kerangka kerja deep learning tensorflow, jaringan saraf sequence-to-sequence

    2.173+0Perubahan bintang dalam 7 hari terakhir
  • ElatoAI@akdeb

    Mainan AI Suara Real-time dengan 100+ Model di Arduino ESP32 dengan Secure Websockets dan Edge Functions untuk perangkat dan pendamping AI

    1.938+5Perubahan bintang dalam 7 hari terakhir
  • Kenalan dengan Ava, WhatsApp Agent

    1.675+2Perubahan bintang dalam 7 hari terakhir
  • dsnote@mkiol

    Aplikasi Linux Speech Note. Mencatat, membaca, dan menerjemahkan dengan Speech to Text, Text to Speech, dan terjemahan mesin secara luring.

    1.622+8Perubahan bintang dalam 7 hari terakhir
  • dicio-android@DicioTeam

    Aplikasi asisten Dicio untuk Android

    1.463+3Perubahan bintang dalam 7 hari terakhir
  • Speech-AI-Forge@lenML

    🍦 Speech-AI-Forge adalah proyek yang dikembangkan di sekitar model generasi TTS, mengimplementasikan API Server dan WebUI berbasis Gradio.

    1.418+0Perubahan bintang dalam 7 hari terakhir
  • SoniTranslate@R3gm

    Terjemahan Tersinkronisasi untuk Video. Sulih suara video

    1.413+2Perubahan bintang dalam 7 hari terakhir
  • 💎 Daftar korpus ucapan yang dapat diakses untuk ASR, TTS, dan Teknologi Ucapan lainnya

    1.399+0Perubahan bintang dalam 7 hari terakhir
  • Platform manajemen tingkat perusahaan Java untuk Xiaozhi ESP32, menyediakan solusi ujung depan-belakang dan sisi server terpadu untuk pemantauan perangkat, penyesuaian suara, peralihan peran, dan manajemen catatan dialog

    1.337+1Perubahan bintang dalam 7 hari terakhir
  • gp.nvim@Robitx

    Plugin AI Neovim Gp.nvim (GPT prompt): Sesi ChatGPT & operasi teks/kode yang dapat diinstruksikan & Ucapan ke teks [OpenAI, Ollama, Anthropic, ..]

    1.320+0Perubahan bintang dalam 7 hari terakhir
  • my-translator@phuc-nt

    Terjemahan ucapan waktu nyata — macOS & Windows, TTS gratis, tanpa server, hanya menggunakan kunci API Anda

    1.278+2Perubahan bintang dalam 7 hari terakhir
  • sokuji@kizuna-ai-lab

    Terjemahan suara dua arah secara real-time untuk rapat bilingual — mendeteksi bahasa yang diucapkan secara otomatis dan menerjemahkan ke dua arah, berbasis cloud atau sepenuhnya luring di perangkat. Desktop (Windows · macOS · Linux) + ekstensi browser (Chrome · Edge) untuk Zoom, Meet, Teams & aplikasi apa pun.

    1.186+40Perubahan bintang dalam 7 hari terakhir
  • nobodywho@nobodywho-ooo

    NobodyWho adalah mesin inferensi yang memungkinkan Anda menjalankan LLM secara lokal dan efisien di perangkat apa pun.

    1.094+13Perubahan bintang dalam 7 hari terakhir
  • voxt@hehehai

    🎙️ Asisten produktivitas suara cerdas yang mengubah ucapan menjadi teks bersih, tindakan yang berguna, dan pengetahuan terstruktur. Membantu pengguna menangkap ide, berkomunikasi secara alami, mengotomatiskan tugas repetitif, dan tetap produktif di berbagai aplikasi dan alur kerja.

    806+3Perubahan bintang dalam 7 hari terakhir
  • lobe-tts@lobehub

    🎤 Lobe TTS - Pustaka TTS/STT yang berkualitas tinggi & andal untuk Server dan Browser

    805+1Perubahan bintang dalam 7 hari terakhir
  • Speech to Text to Speech. Lagu sedang diputar. Mengirim teks sebagai pesan OSC ke VRChat untuk ditampilkan di avatar. (STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+3Perubahan bintang dalam 7 hari terakhir
  • mlx-audio-swift@Blaizzy

    SDK Swift modular untuk pemrosesan audio dengan MLX di Apple Silicon

    772+6Perubahan bintang dalam 7 hari terakhir
  • Menjalankan model speech-to-text (whisper.cpp) di Unity3d pada mesin lokal Anda.

    751+1Perubahan bintang dalam 7 hari terakhir
  • mlx-omni-server@madroidmaq

    MLX Omni Server adalah server inferensi lokal yang didukung oleh framework MLX Apple, yang dirancang khusus untuk chip Apple Silicon (seri M). Ini mengimplementasikan endpoint API yang kompatibel dengan OpenAI, memungkinkan integrasi yang mulus dengan klien SDK OpenAI yang ada sekaligus memanfaatkan kekuatan inferensi ML lokal.

    741+1Perubahan bintang dalam 7 hari terakhir
  • cheetah@Picovoice

    Mesin ucapan-ke-teks streaming on-device yang didukung oleh deep learning

    671+0Perubahan bintang dalam 7 hari terakhir
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) untuk Node dengan deteksi kata kunci offline.

    638+0Perubahan bintang dalam 7 hari terakhir
  • Komponen React untuk membuat koreksi transkripsi audio dan video otomatis menjadi lebih mudah dan cepat. Oleh BBC News Labs. - Sedang dikerjakan

    620-1Perubahan bintang dalam 7 hari terakhir
  • CrispASR@CrispStrobe

    Pusat runtime C++ ggml untuk model ASR dan TTS multibahasa: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2, dll., ditambah penyelarasan paksa universal, dan lainnya

    609+21Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik