Búsqueda por haces
Beam search
Estrategia que conserva varias secuencias candidatas y selecciona la mejor al final.
Ver definición completa →Cargando diccionario…
Bloque temático
Fases, estrategias y sistemas que convierten entradas en predicciones o respuestas de un modelo entrenado.
Beam search
Estrategia que conserva varias secuencias candidatas y selecciona la mejor al final.
Ver definición completa →Greedy decoding
Estrategia que elige en cada paso el token con mayor puntuación.
Ver definición completa →Key-value cache
Memoria que conserva claves y valores de atención ya calculados durante la generación.
Ver definición completa →Decoding
Proceso que convierte las puntuaciones del modelo en una salida concreta.
Ver definición completa →Speculative decoding
Técnica que propone varios tokens con un modelo rápido y los verifica con el modelo objetivo.
Ver definición completa →Next-token distribution
Conjunto de probabilidades que el modelo asigna a las posibles unidades que podrían continuar una secuencia.
Ver definición completa →Generation
Producción de contenido nuevo, como texto, imagen, audio o código, a partir de una entrada.
Ver definición completa →Autoregressive generation
Generación secuencial en la que cada nuevo token depende de los anteriores.
Ver definición completa →Text generation
Producción automática de texto nuevo a partir de una entrada, contexto o distribución aprendida.
Ver definición completa →Inference
Uso de un modelo ya construido o entrenado para producir un resultado ante una entrada.
Ver definición completa →Online inference
Inferencia ejecutada al recibir una solicitud que espera una respuesta inmediata o cercana.
Ver definición completa →Batch inference
Ejecución conjunta de varias entradas o solicitudes en un lote.
Ver definición completa →Offline inference
Inferencia ejecutada sobre trabajo acumulado sin que una persona espere cada resultado.
Ver definición completa →Logit
Puntuación sin normalizar que un modelo asigna a una opción antes de convertirla en probabilidad.
Ver definición completa →Autoregressive model
Modelo que genera cada parte de una secuencia usando las partes anteriores como contexto.
Ver definición completa →Generative sampling
Proceso de obtener una salida concreta de la distribución aprendida por un modelo generativo.
Ver definición completa →Prediction
Resultado estimado por un modelo para una entrada concreta.
Ver definición completa →Next-token prediction
Tarea de estimar qué unidad del vocabulario es más probable después del contexto actual.
Ver definición completa →Prefill
Fase inicial que procesa los tokens de entrada antes de generar el primero de salida.
Ver definición completa →Forward propagation
Cálculo que lleva una entrada por las capas de la red hasta producir una salida.
Ver definición completa →Output
Resultado que produce un sistema después de procesar una entrada.
Ver definición completa →Deterministic output
Salida obtenida de forma repetible para la misma entrada, modelo y configuración.
Ver definición completa →Stochastic output
Salida que puede variar porque el proceso selecciona tokens mediante azar controlado.
Ver definición completa →Inference server
Software que carga modelos y atiende solicitudes para ejecutar inferencia.
Ver definición completa →Token streaming
Entrega incremental de tokens o fragmentos mientras la respuesta todavía se genera.
Ver definición completa →Time to first token
Tiempo entre iniciar una solicitud y recibir el primer token generado.
Ver definición completa →Output token
Token generado por el modelo como parte de su respuesta.
Ver definición completa →Special token
Token reservado para marcar estructura, control o estados que no corresponden a texto ordinario.
Ver definición completa →Tokens per second
Cantidad de tokens de salida generados por unidad de tiempo.
Ver definición completa →Diagnóstico de procesos
Software interno a medida
Automatización de tareas repetitivas
Integración de sistemas y APIs
IA aplicada solo cuando aporta valor
© 2026 Camilo Boo. Automatización de procesos y software interno.