跳到主要内容
buildradar
Sign in
主题 · stt

stt

标记 stt 主题、收录中的开源项目,按星标数排序。

项目数
33
总星标数
109,255
平均星标数
3,311
占比
0.01%

常跟 stt 一起出现在同一个项目上的主题。

近期新秀

近 90 天内创建、标记 stt 主题的项目。

  • floe-guard@Floe-Labs

    AI 语音代理的支出计量与预算网关。开箱即用,可针对每次通话计量 STT、TTS、LLM 与电话费用(支持 Pipecat、LiveKit — Python 与 TypeScript)。在费用超出上限前强制停止下一次对话。本地执行、无需账号、无遥测。由 Floe 打造 — 语音 AI 的成本控制方案。

    434
  • khoj@khoj-ai

    你的 AI 第二大脑。可自行托管。从网络或文档获取答案。构建自定义代理、调度自动化、进行深度研究。将任何线上或本地 LLM 转为个人自主 AI(gpt、claude、gemini、llama、qwen、mistral)。立即开始 - 免费。

    37,010+223近 7 天星标变化
  • vosk-api@alphacep

    支持 Android、iOS、Raspberry Pi 与服务器的离线语音识别 API,提供 Python、Java、C# 与 Node 接口

    15,101+17近 7 天星标变化
  • moonshine@moonshine-ai

    Very low latency speech to text, intent recognition, and text to speech, for building voice agents and interfaces

    10,997+33近 7 天星标变化
  • Vision-Agents@GetStream

    Stream 的 Open Vision Agents。使用任意模型或视频提供者快速构建语音与视觉代理,利用 Stream 边缘网络实现超低延迟

    8,113+9近 7 天星标变化
  • stt@jianchang512

    语音识别转文字工具 / 一个离线运行的本地音视频转字幕工具,输出 json、srt 字幕、纯文字格式

    4,780+9近 7 天星标变化
  • whishper@pluja

    通过网页 UI 100% 在本地将任何音频转录为文字、翻译并编辑字幕。由 whisper 模型驱动!

    3,068+2近 7 天星标变化
  • STT@coqui-ai

    🐸STT - 用于语音转文字的深度学习工具包。训练与部署 STT 模型从未如此简单。

    2,606+1近 7 天星标变化
  • 使用 tensorflow 深度学习框架与 sequence-to-sequence 神经网络的语音识别

    2,173+0近 7 天星标变化
  • ElatoAI@akdeb

    基于 Arduino ESP32 的实时语音 AI 玩具,拥有 100 多个模型,具备安全 Websockets 与 Edge Functions,适用于 AI 伴侣与设备

    1,938+5近 7 天星标变化
  • 认识 WhatsApp 代理程序 Ava

    1,675+2近 7 天星标变化
  • dsnote@mkiol

    Speech Note Linux 应用程序。具备离线语音转文字、文字转语音以及机器翻译的笔记、阅读与翻译功能。

    1,622+8近 7 天星标变化
  • dicio-android@DicioTeam

    适用于 Android 的 Dicio 助理应用程序

    1,463+3近 7 天星标变化
  • Speech-AI-Forge@lenML

    🍦 Speech-AI-Forge 是一个围绕 TTS 生成模型开发的项目,实现了 API 服务器与基于 Gradio 的 WebUI。

    1,418+0近 7 天星标变化
  • SoniTranslate@R3gm

    视频同步翻译与视频配音

    1,413+2近 7 天星标变化
  • 💎 适用于 ASR、TTS 及其他语音技术的无障碍语音语料库列表

    1,399+0近 7 天星标变化
  • 小智ESP32的Java企业级管理平台,提供设备监控、音色定制、角色切换和对话记录管理的前后端及服务端一体化解决方案

    1,337+1近 7 天星标变化
  • gp.nvim@Robitx

    Gp.nvim (GPT prompt) Neovim AI 插件:ChatGPT 对话与可指令化的文字/代码操作与语音转文字 [OpenAI, Ollama, Anthropic, ..]

    1,320+0近 7 天星标变化
  • my-translator@phuc-nt

    实时语音翻译 — 支持 macOS 与 Windows,免费 TTS,无需服务器,仅需您的 API 密钥

    1,278+2近 7 天星标变化
  • sokuji@kizuna-ai-lab

    双语会议的实时双向语音翻译 — 自动检测说话语言并进行双向翻译,支持云端或完全离线设备端。支持桌面版(Windows、macOS、Linux)以及适用于 Zoom、Meet、Teams 与任何应用程序的浏览器扩展程序(Chrome、Edge)。

    1,186+40近 7 天星标变化
  • nobodywho@nobodywho-ooo

    NobodyWho 是一款推理引擎,让你能在任何设备上高效地在本地运行 LLM。

    1,094+13近 7 天星标变化
  • voxt@hehehai

    🎙️ 一款智能语音生产力助手,可将语音转化为干净的文字、有用的动作和结构化知识。它协助用户捕捉灵感、自然沟通、自动化重复性任务,并在各种应用程序与工作流程中保持高生产力。

    807+6近 7 天星标变化
  • lobe-tts@lobehub

    🎤 Lobe TTS - 适用于服务器与的高质量且可靠的 TTS/STT 库

    805+1近 7 天星标变化
  • 语音转文字再转语音。歌曲正在播放中。将文本作为 OSC 消息发送至 VRChat 以显示在虚拟化身上。(STTTS) (Speech to TTS) (VRC STT System) (VTuber TTS)

    803+4近 7 天星标变化
  • mlx-audio-swift@Blaizzy

    一个用于在 Apple Silicon 上通过 MLX 进行音频处理的模块化 Swift SDK。

    772+6近 7 天星标变化
  • 在本地机器的 Unity3d 中运行语音转文字模型 (whisper.cpp)。

    751+1近 7 天星标变化
  • mlx-omni-server@madroidmaq

    MLX Omni Server 是一个由 Apple 的 MLX 框架驱动的本地推理服务器,专为 Apple Silicon (M 系列) 芯片设计。它实现了兼容 OpenAI 的 API 端点,能够与现有的 OpenAI SDK 客户端无缝集成,同时发挥本地 ML 推理的性能。

    741+1近 7 天星标变化
  • cheetah@Picovoice

    由深度学习驱动的设备端流式语音转文字引擎

    671+0近 7 天星标变化
  • sonus@evancohen

    :speech_balloon: /so.nus/ 适用于 Node 的 STT (语音转文字),具备离线热词检测功能

    638+0近 7 天星标变化
  • 一个让音视频自动转录校对更轻松快速的 React 组件。由 BBC News Labs 开发。- 进行中

    621+0近 7 天星标变化
  • CrispASR@CrispStrobe

    用于多语言 ASR 与 TTS 模型的 C++ ggml 运行时中心:包含 Cohere Transcribe、Parakeet TDT、Voxtral、Canary 1B v2 等,并支持通用强制对齐等功能。

    611+22近 7 天星标变化
← 返回主题列表