Saltar al contenido principal
buildradar
Sign in

NVIDIA/TensorRT-LLM

@NVIDIA

TensorRT LLM ofrece a los usuarios una API de Python fácil de usar para definir Modelos de Lenguaje Grande (LLMs) y admite optimizaciones de vanguardia para realizar inferencias de manera eficiente en GPUs NVIDIA. TensorRT LLM también contiene componentes para crear entornos de ejecución en Python y C++ que organizan la ejecución de inferencias de alto rendimiento.

Estrellas
14.536
Bifurcaciones
2716
Lenguaje
Python
Licencia
NOASSERTION
Último push
hace 4 días
Pythoncudapytorchllm-servingmoeblackwell

Aún no hay intel relacionado

Este repo no ha aparecido en ninguna de las fuentes que rastrea el radar. El recopilador funciona con un horario — vuelve cuando lo haya cubierto.