TécnicoEjecución local de modelos
Latencia hasta el primer token local
Local time to first tokenTTFT
También: Local time to first token, TTFT
Latencia hasta el primer token local es tiempo desde la solicitud hasta el primer token.
Definición técnica
En sistemas de inteligencia artificial, latencia hasta el primer token local se utiliza como tiempo desde la solicitud hasta el primer token; su implementación debe evaluarse según compatibilidad, rendimiento, consumo de recursos y requisitos operativos.