Particionado de servicio de modelos
Model serving sharding
También: Model serving sharding
Distribución de un modelo o carga entre varios recursos.
Definición técnica
Particionado de servicio de modelos se define como distribución de un modelo o carga entre varios recursos. En una aplicación de IA debe instrumentarse o aplicarse con criterios explícitos, límites operativos, trazabilidad y validación sobre cargas representativas.