Tencent/WeDLM
@TencentWeDLM: Model bahasa difusi tercepat dengan causal attention standar dan kompatibilitas KV cache bawaan, memberikan peningkatan kecepatan nyata dibandingkan baseline yang dioptimalkan vLLM.
Bintang
654
Fork
47
Bahasa
Python
Lisensi
NOASSERTION
Push terakhir
6 bulan yang lalu
Intel terkait (0)
Belum ada intel terkait
Repositori ini belum muncul di sumber mana pun yang dilacak radar. Kolektor berjalan sesuai jadwal — periksa kembali setelah mencakup repositori ini.