Chuyển tới nội dung chính
buildradar
Sign in
Chủ đề · stt

stt

Các kho mã nguồn mở đang theo dõi được gắn thẻ stt, sắp xếp theo số sao.

Kho mã
32
Tổng số sao
109.255
Số sao trung bình
3.414
Tỷ trọng
0,01%

Những chủ đề thường xuất hiện cùng stt trên cùng một kho mã.

Mới nổi gần đây

Các kho mã tạo trong 90 ngày qua và được gắn thẻ stt.

  • floe-guard@Floe-Labs

    Công cụ đo lường chi phí và kiểm soát ngân sách cho các tác nhân giọng nói AI. Đo lường STT + TTS + LLM + điện thoại cho mỗi cuộc gọi (Pipecat, LiveKit — Python & TypeScript). Tự động dừng trước khi vượt quá giới hạn. Chạy cục bộ, không cần tài khoản, không thu thập dữ liệu. Được xây dựng bởi Floe — kiểm soát chi phí cho Voice AI.

    434
  • khoj@khoj-ai

    Bộ não thứ hai AI của bạn. Có thể tự lưu trữ (self-host). Nhận câu trả lời từ web hoặc tài liệu của bạn. Xây dựng agent tùy chỉnh, lên lịch tự động hóa, thực hiện nghiên cứu sâu. Biến bất kỳ LLM trực tuyến hoặc cục bộ nào thành AI tự trị cá nhân của bạn (gpt, claude, gemini, llama, qwen, mistral). Bắt đầu - miễn phí.

    37.010+223Thay đổi số sao trong 7 ngày qua
  • vosk-api@alphacep

    API nhận diện giọng nói ngoại tuyến cho Android, iOS, Raspberry Pi và máy chủ với Python, Java, C# và Node

    15.101+17Thay đổi số sao trong 7 ngày qua
  • moonshine@moonshine-ai

    Chuyển đổi giọng nói thành văn bản, nhận dạng ý định và chuyển đổi văn bản thành giọng nói với độ trễ rất thấp, dùng để xây dựng các agent và giao diện giọng nói

    10.997+33Thay đổi số sao trong 7 ngày qua
  • Vision-Agents@GetStream

    Open Vision Agents bởi Stream. Xây dựng các tác nhân giọng nói và tầm nhìn nhanh chóng với bất kỳ mô hình hoặc nhà cung cấp video nào. Sử dụng mạng biên của Stream để đạt độ trễ cực thấp.

    8.113+9Thay đổi số sao trong 7 ngày qua
  • stt@jianchang512

    Công cụ nhận diện giọng nói thành văn bản / Công cụ chuyển đổi âm thanh và video cục bộ chạy ngoại tuyến thành phụ kiện, hỗ trợ xuất định dạng json, phụ đề srt và văn bản thuần túy

    4.780+9Thay đổi số sao trong 7 ngày qua
  • whishper@pluja

    Chuyển đổi mọi âm thanh thành văn bản, dịch và chỉnh sửa phụ đề hoàn toàn ngoại tuyến với giao diện web UI. Được hỗ trợ bởi các mô hình whisper!

    3.068+2Thay đổi số sao trong 7 ngày qua
  • STT@coqui-ai

    🐸STT - Bộ công cụ học sâu cho Speech-to-Text. Việc huấn luyện và triển khai các mô hình STT chưa bao giờ dễ dàng đến thế.

    2.606+1Thay đổi số sao trong 7 ngày qua
  • 🎙 Nhận dạng giọng nói sử dụng framework học sâu tensorflow, mạng thần kinh chuỗi-sang-chuỗi (sequence-to-sequence)

    2.173+0Thay đổi số sao trong 7 ngày qua
  • ElatoAI@akdeb

    Đồ chơi AI giọng nói thời gian thực với hơn 100 mô hình trên Arduino ESP32 sử dụng Secure Websockets và Edge Functions dành cho các thiết bị và bạn đồng hành AI.

    1.938+5Thay đổi số sao trong 7 ngày qua
  • Gặp gỡ Ava, Tác nhân WhatsApp

    1.675+2Thay đổi số sao trong 7 ngày qua
  • dsnote@mkiol

    Ứng dụng Speech Note trên Linux. Ghi chú, đọc và dịch với tính năng Chuyển giọng nói thành văn bản, Chuyển văn bản thành giọng nói và Dịch máy ngoại tuyến.

    1.622+8Thay đổi số sao trong 7 ngày qua
  • dicio-android@DicioTeam

    Ứng dụng trợ lý Dicio cho Android

    1.463+3Thay đổi số sao trong 7 ngày qua
  • Speech-AI-Forge@lenML

    🍦 Speech-AI-Forge là một dự án phát triển xung quanh mô hình tạo TTS, tích hợp API Server và WebUI dựa trên Gradio.

    1.418+0Thay đổi số sao trong 7 ngày qua
  • SoniTranslate@R3gm

    Dịch đồng bộ cho video. Lồng tiếng video

    1.413+2Thay đổi số sao trong 7 ngày qua
  • 💎 Danh sách các kho ngữ liệu giọng nói có thể truy cập cho ASR, TTS và các Công nghệ Giọng nói khác

    1.399+0Thay đổi số sao trong 7 ngày qua
  • Nền tảng quản lý cấp doanh nghiệp bằng Java cho Xiaozhi ESP32, cung cấp giải pháp tích hợp front-end, back-end và server cho giám sát thiết bị, tùy chỉnh âm sắc, chuyển đổi vai trò và quản lý nhật ký trò chuyện

    1.337+1Thay đổi số sao trong 7 ngày qua
  • gp.nvim@Robitx

    Plugin Neovim Gp.nvim (GPT prompt) AI: Phiên ChatGPT & Thao tác văn bản/mã có thể hướng dẫn & Chuyển giọng nói thành văn bản [OpenAI, Ollama, Anthropic, ..]

    1.320+0Thay đổi số sao trong 7 ngày qua
  • my-translator@phuc-nt

    Dịch giọng nói thời gian thực — macOS & Windows, TTS miễn phí, không cần máy chủ, chỉ dùng khóa API của bạn

    1.278+2Thay đổi số sao trong 7 ngày qua
  • sokuji@kizuna-ai-lab

    Dịch giọng nói hai chiều thời gian thực cho các cuộc họp song ngữ — tự động phát hiện ngôn ngữ nói và dịch theo cả hai hướng, qua đám mây hoặc hoàn toàn ngoại tuyến trên thiết bị. Hỗ trợ Desktop (Windows · macOS · Linux) và tiện ích mở rộng trình duyệt (Chrome · Edge) cho Zoom, Meet, Teams và mọi ứng dụng.

    1.186+40Thay đổi số sao trong 7 ngày qua
  • nobodywho@nobodywho-ooo

    NobodyWho là một công cụ suy luận cho phép bạn chạy LLMs cục bộ và hiệu quả trên mọi thiết bị.

    1.094+13Thay đổi số sao trong 7 ngày qua
  • voxt@hehehai

    Trợ lý giọng nói thông minh chuyển đổi lời nói thành văn bản rõ ràng, các hành động hữu ích và kiến thức có cấu trúc. Giúp người dùng ghi lại ý tưởng, giao tiếp tự nhiên, tự động hóa các tác vụ lặp lại và duy trì năng suất trên các ứng dụng và quy trình làm việc khác nhau.

    806+3Thay đổi số sao trong 7 ngày qua
  • lobe-tts@lobehub

    Lobe TTS - Thư viện TTS/STT chất lượng cao và đáng tin cậy cho máy chủ và trình duyệt.

    805+1Thay đổi số sao trong 7 ngày qua
  • Chuyển đổi giọng nói thành văn bản rồi thành giọng nói (Speech to Text to Speech). Gửi văn bản dưới dạng thông điệp OSC tới VRChat để hiển thị trên avatar.

    803+3Thay đổi số sao trong 7 ngày qua
  • mlx-audio-swift@Blaizzy

    SDK Swift dạng mô-đun để xử lý âm thanh với MLX trên Apple Silicon

    772+6Thay đổi số sao trong 7 ngày qua
  • Chạy mô hình chuyển đổi giọng nói thành văn bản (whisper.cpp) trong Unity3d trên máy cục bộ của bạn.

    751+1Thay đổi số sao trong 7 ngày qua
  • mlx-omni-server@madroidmaq

    MLX Omni Server là một máy chủ suy luận cục bộ được vận hành bởi framework MLX của Apple, được thiết kế đặc biệt cho các chip Apple Silicon (dòng M). Nó triển khai các điểm cuối API tương thích với OpenAI, cho phép tích hợp liền mạch với các ứng dụng khách SDK OpenAI hiện có trong khi tận dụng sức mạnh của suy luận ML cục bộ.

    741+1Thay đổi số sao trong 7 ngày qua
  • cheetah@Picovoice

    Công cụ chuyển đổi giọng nói thành văn bản trực tuyến trên thiết bị dựa trên học sâu

    671+0Thay đổi số sao trong 7 ngày qua
  • sonus@evancohen

    :speech_balloon: /so.nus/ STT (speech to text) cho Node với tính năng phát hiện từ khóa ngoại tuyến

    638+0Thay đổi số sao trong 7 ngày qua
  • Một thành phần React giúp việc chỉnh sửa các bản ghi âm và video tự động trở nên dễ dàng và nhanh chóng hơn. Bởi BBC News Labs. - Đang trong quá trình phát triển

    620-1Thay đổi số sao trong 7 ngày qua
  • CrispASR@CrispStrobe

    C++ ggml runtime hub cho các mô hình ASR và TTS đa ngôn ngữ: Cohere Transcribe, Parakeet TDT, Voxtral, Canary 1B v2, cùng với tính năng căn chỉnh bắt buộc phổ quát và nhiều hơn nữa

    609+21Thay đổi số sao trong 7 ngày qua
← Quay lại danh sách chủ đề