मालिक · kyutai-labs
kyutai-labs
kyutai-labs की ट्रैक की गई ओपन सोर्स रिपॉजिटरी, स्टार के हिसाब से क्रमबद्ध।
5 रिपॉजिटरी
- #1
Moshi एक स्पीच-टेक्स्ट फाउंडेशन मॉडल और फुल-डुपलेक्स स्पoken डायलॉग फ्रेमवर्क है। यह Mimi, एक अत्याधुनिक स्ट्रीमिंग न्यूरल ऑडियो कोडेक का उपयोग करता है।
★ 11,002+0पिछले 7 दिनों में स्टार का बदलाव - #2
एक TTS जो आपके CPU (और जेब) में फिट बैठता है
★ 9,335+0पिछले 7 दिनों में स्टार का बदलाव - #3
Kyutai's Speech-To-Text and Text-To-Speech models based on the Delayed Streams Modeling framework.
★ 3,021+0पिछले 7 दिनों में स्टार का बदलाव - #4
Hibiki स्ट्रीमिंग स्पीच ट्रांसलेशन (जिसे समवर्ती अनुवाद भी कहा जाता है) के लिए एक मॉडल है। ऑफ़लाइन अनुवाद के विपरीत—जहां अनुवाद शुरू करने के लिए स्रोत कथन के अंत की प्रतीक्षा की जाती है—Hibiki वास्तविक समय में, भाग-दर-भाग सही अनुवाद उत्पन्न करने के लिए पर्याप्त संदर्भ एकत्र करने के लिए अपने प्रवाह को अनुकूलित करता है।
★ 1,512+0पिछले 7 दिनों में स्टार का बदलाव - #5★ 1,508+0पिछले 7 दिनों में स्टार का बदलाव