メインコンテンツへスキップ
buildradar
Sign in
トピック · speech-recognition

speech-recognition

speech-recognition がタグ付けされた追跡中のオープンソースリポジトリを、スター数順に表示します。

156 件のリポジトリ
  • whisper-jax@sanchit-gandhi

    TPU上で最大70倍の高速化を実現する、OpenAIのWhisperモデルのJAX実装

    4,679-1直近 7 日のスター増減
  • pocketsphinx@cmusphinx

    小型の音声認識器。

    4,337+2直近 7 日のスター増減
  • distil-whisper@huggingface

    音声認識のためのWhisperの蒸留バリアント。6倍高速化、50%小型化、単語誤り率1%以内。

    4,114+2直近 7 日のスター増減
  • OpenAI Whisper ASR Web サービス API

    3,328+2直近 7 日のスター増減
  • Python の導入を避けたい人のための Whisper および Faster-Whisper のスタンドアロン実行ファイル

    3,171+2直近 7 日のスター増減
  • willow@HeyWillow

    Amazon Echo や Google Home の競合となる、オープンソースかつローカルでセルフホスト可能な音声アシスタントの代替

    3,101+1直近 7 日のスター増減
  • whishper@pluja

    Web UIを使って、あらゆる音声を100%ローカルでテキスト化、翻訳、字幕編集ができるツール。whisperモデルを採用!

    3,068+2直近 7 日のスター増減
  • lingvo@tensorflow

    Lingvo

    2,864+0直近 7 日のスター増減
  • whisper-timestamped@linto-ai

    単語レベルのタイムスタンプと信頼度を備えた多言語自動音声認識

    2,842+1直近 7 日のスター増減
  • STT@coqui-ai

    🐸STT - 音声認識(Speech-to-Text)のためのディープラーニングツールキット。STT モデルのトレーニングとデプロイがかつてないほど簡単になりました。

    2,606+1直近 7 日のスター増減
  • qwen-audio-agent@QwenAudio

    エージェントの対話、作業、存在感を維持するリアルタイム音声ランタイム。AI エージェント向けのリアルタイム音声ランタイム

    2,362+72直近 7 日のスター増減
  • 🎙 tensorflowディープラーニングフレームワークと、sequence-to-sequenceニューラルネットワークを使用した音声認識

    2,173+0直近 7 日のスター増減
  • parlor@fikrikarim

    GPT-Live と同様の機能を備えた、デバイス上のリアルタイムマルチモーダル AI

    2,048+7直近 7 日のスター増減
  • FireRedASR@FireRedTeam

    中国語、方言、英語をサポートするオープンソースの産業グレード ASR モデル。パブリックな中国語 ASR ベンチマークで新たな SOTA を達成し、優れた歌声の歌詞認識能力も提供します。

    1,975+2直近 7 日のスター増減
  • masr@nobody132

    中国語音声認識;Mandarin Automatic Speech Recognition;

    1,968+0直近 7 日のスター増減
  • julius@julius-speech

    オープンソースの大語彙連続音声認識エンジン

    1,935+1直近 7 日のスター増減
  • 話者分離(Speaker Diarization)に関する優れた論文、ライブラリ、データセット、その他のリソースのキュレーションリスト。

    1,894+1直近 7 日のスター増減
  • alan-sdk-ios@alan-ai

    アプリのためのセルフコーディングシステム — iOS 向け Alan AI SDK

    1,878-3直近 7 日のスター増減
  • アプリのためのセルフコーディングシステム — Android用 Alan AI SDK

    1,807-1直近 7 日のスター増減
  • whisper-turbo@FL33TW00D

    クロスプラットフォーム、GPU加速対応のWhisper 🏎️

    1,794+0直近 7 日のスター増減
  • sherpa-ncnn@k2-fsa

    インターネット接続なしで次世代Kaldiとncnnを使用したリアルタイム音声認識および音声区間検出(VAD)。iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4Aなどをサポート

    1,777-1直近 7 日のスター増減
  • アプリ向けセルフコーディングシステム — Flutter 用 Alan AI SDK

    1,756-1直近 7 日のスター増減
  • alan-sdk-ionic@alan-ai

    アプリのためのセルフコーディングシステム — Ionic 向け Alan AI SDK

    1,649-1直近 7 日のスター増減
  • dsnote@mkiol

    Speech Note Linux アプリ。オフラインでの音声文字変換(Speech to Text)、音声合成(Text to Speech)、機械翻訳を使用したメモ作成、読み上げ、翻訳機能を提供します。

    1,622+8直近 7 日のスター増減
  • AIを使用したローカル音声認識および字幕生成のためのOBSプラグイン

    1,597+8直近 7 日のスター増減
  • amica@semperai

    Amicaは、音声合成と音声認識を備えた3Dキャラクターとの対話型コミュニケーションのためのオープンソースインターフェースです

    1,591-2直近 7 日のスター増減
  • ComfyUI の機能を拡張するカスタムノード

    1,525+1直近 7 日のスター増減
  • SALMONN@bytedance

    SALMONN ファミリー:高度なマルチモーダル LLM のスイート

    1,521+3直近 7 日のスター増減
  • Fun-ASR@QwenAudio

    中国語、方言、アクセント、多言語音声に対応した、オープンソースの LLM ベース ASR モデルファミリ。FunASR、vLLM、ストリーミング、llama.cpp ランタイムをサポート。

    1,512+10直近 7 日のスター増減
  • SpeechT5@microsoft

    音声言語処理のための統合モーダル音声・テキスト事前学習

    1,449+0直近 7 日のスター増減
← トピック一覧に戻る