Zum Hauptinhalt springen
buildradar
Sign in
Thema · speech-processing

speech-processing

Erfasste Open-Source-Repos mit dem Tag speech-processing, sortiert nach Sternen.

Repos
20
Sterne gesamt
71.137
Sterne im Schnitt
3.557
Anteil
0,00%

Themen, die häufig gemeinsam mit speech-processing am selben Repo auftauchen.

Neue Aufsteiger

Repos, die in den letzten 90 Tagen erstellt und mit speech-processing getaggt wurden.

In den letzten 90 Tagen kam kein neues Repo mit diesem Thema dazu.

  • speechbrain@speechbrain

    Ein PyTorch-basiertes Speech-Toolkit

    11.792+22Sterne-Änderung der letzten 7 Tage
  • pyannote-audio@pyannote

    Neuronale Bausteine für Speaker Diarization: Spracherkennungsaktivität, Sprecherwechselerkennung, Erkennung überlappender Sprache, Sprecher-Embedding

    10.484+38Sterne-Änderung der letzten 7 Tage
  • silero-vad@snakers4

    Silero VAD: vortrainierter Spracherkennungsdetektor (Voice Activity Detector) auf Unternehmensebene

    10.083+52Sterne-Änderung der letzten 7 Tage
  • maths-cs-ai-compendium@HenryNdubuaku

    Werde zu einem herausragenden KI/ML-Forscher bzw. -Ingenieur mit diesem unkonventionellen Lehrbuch, das Mathematik, Computing und ML mit Intuition vermittelt.

    7.379+33Sterne-Änderung der letzten 7 Tage
  • Leseliste für Forschungsthemen im Bereich multimodales maschinelles Lernen.

    6.925+0Sterne-Änderung der letzten 7 Tage
  • torchscale@microsoft

    Grundlagen-Architektur für (M)LLMs

    3.138+1Sterne-Änderung der letzten 7 Tage
  • whisper-timestamped@linto-ai

    Mehrsprachige automatische Spracherkennung mit wortgenauen Zeitstempeln und Konfidenzwerten

    2.841+2Sterne-Änderung der letzten 7 Tage
  • resemble-enhance@resemble-ai

    KI-gestützte Rauschunterdrückung und Verbesserung von Sprache

    2.401+6Sterne-Änderung der letzten 7 Tage
  • ten-vad@TEN-framework

    Sprachaktivitätserkennung (VAD): Latenzarm, leistungsstark und leichtgewichtig

    2.250+4Sterne-Änderung der letzten 7 Tage
  • IMS-Toucan@DigitalPhonetics

    Steuerbare und schnelle Text-to-Speech-Technologie für über 7000 Sprachen!

    2.208+0Sterne-Änderung der letzten 7 Tage
  • Eine kuratierte Liste von großartigen Arbeiten, Bibliotheken, Datensätzen und anderen Ressourcen zur Sprecherdiarisierung.

    1.893+2Sterne-Änderung der letzten 7 Tage
  • 💎 Eine Liste barrierefreier Sprachkorpora für ASR, TTS und andere Sprachtechnologien

    1.399+0Sterne-Änderung der letzten 7 Tage
  • voicefixer@haoheliu

    Allgemeine Sprachwiederherstellung

    1.376+3Sterne-Änderung der letzten 7 Tage
  • CrisperWhisper@nyrahealth

    Steuerbare Transkription. Wortgetreu (jede Füllwörter, Pausen, Stottern, Vokallaute) oder beabsichtigt (was der Sprecher sagen wollte, optimiert für Lesbarkeit) mit Zeitstempeln auf Wortebene.

    1.362+21Sterne-Änderung der letzten 7 Tage
  • StreamSpeech@ictnlp

    StreamSpeech ist ein All-in-One-Modell für nahtlose Offline- und Simultanspracherkennung, -sprachübersetzung und -sprachsynthese.

    1.288+2Sterne-Änderung der letzten 7 Tage
  • audino@midas-research

    Open-Source-Audio-Annotationstool für Menschen

    1.146+0Sterne-Änderung der letzten 7 Tage
  • SLAM-LLM@X-LANCE

    Ein Framework für Sprach-, Audio-, Musik- und Textverarbeitung mit Large Language Models

    1.056+0Sterne-Änderung der letzten 7 Tage
  • Hier finden Sie die gewünschten Sprachalgorithmen.

    878+1Sterne-Änderung der letzten 7 Tage
  • MultiBench@pliang279

    [NeurIPS 2021] Multiskalen-Benchmarks für multimodales Repräsentationslernen

    636+0Sterne-Änderung der letzten 7 Tage
  • Ressourcen, Labore, Unternehmen und Praktika im Bereich Sprachtechnologie; Empfehlungen und Eigenbewerbungen sind willkommen.

    609+0Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen