Codificación por pares de bytes
Byte pair encoding
Método que construye subtokens fusionando repetidamente pares frecuentes de unidades.
Ver definición completa →Cargando diccionario…
Bloque temático
Unidades, límites y mecanismos que determinan qué información puede procesar y conservar una aplicación basada en modelos.
Byte pair encoding
Método que construye subtokens fusionando repetidamente pares frecuentes de unidades.
Ver definición completa →Context compression
Reducción de la representación contextual intentando conservar la información más útil.
Ver definición completa →Token counting
Proceso de calcular cuántos tokens ocupará o ha ocupado una entrada, salida o solicitud completa.
Ver definición completa →Input context
Información que se incorpora antes de generar una salida y que puede condicionar al modelo.
Ver definición completa →Output context
Espacio y secuencia generada que forman la salida del modelo dentro de una operación.
Ver definición completa →Effective context
Parte del contexto disponible que el modelo utiliza de manera suficientemente fiable para la tarea.
Ver definición completa →Persistent context
Información que una aplicación conserva y vuelve a incorporar en solicitudes posteriores.
Ver definición completa →Context overflow
Situación en la que entrada y salida reservada superan la capacidad de contexto admitida.
Ver definición completa →Detokenization
Proceso que convierte una secuencia de tokens o identificadores en una representación legible.
Ver definición completa →Token identifier
Número que referencia de forma única una entrada del vocabulario de un tokenizador.
Ver definición completa →Context length
Número de tokens que ocupa el contexto disponible o utilizado en una operación.
Ver definición completa →Short-term memory
Información reciente mantenida disponible para la tarea o conversación actual.
Ver definición completa →Long-term memory
Información persistida fuera del contexto inmediato para recuperarla en interacciones futuras.
Ver definición completa →Conversation memory
Mecanismo que conserva información de turnos anteriores para sostener continuidad en un diálogo.
Ver definición completa →Lost in the middle
Degradación por la que un modelo usa peor información relevante situada en la zona intermedia de un contexto largo.
Ver definición completa →Token budget
Cantidad de tokens que se asigna a las distintas partes de una operación con un modelo.
Ver definición completa →Memory retrieval
Proceso de seleccionar recuerdos almacenados y devolverlos al contexto de una tarea.
Ver definición completa →SentencePiece
Sistema de tokenización de subpalabras que puede entrenarse directamente sobre texto sin presegmentarlo en palabras.
Ver definición completa →Subtoken
Token que representa una parte de una palabra u otra unidad mayor.
Ver definición completa →Token
Unidad discreta que un tokenizador entrega al modelo para representar una parte de la entrada o de la salida.
Ver definición completa →Cached token
Token de entrada cuyo procesamiento previo puede reutilizarse al repetirse un prefijo compatible.
Ver definición completa →Input token
Token perteneciente a la información enviada al modelo antes de generar la respuesta.
Ver definición completa →Output token
Token generado por el modelo como parte de su respuesta.
Ver definición completa →Special token
Token reservado para marcar estructura, control o estados que no corresponden a texto ordinario.
Ver definición completa →Tokenization
Proceso que transforma texto u otra entrada serializada en una secuencia de tokens.
Ver definición completa →Tokenizer
Componente que divide texto en unidades y las convierte en identificadores para el modelo.
Ver definición completa →Context truncation
Eliminación de parte del contexto para que la solicitud respete un límite de capacidad.
Ver definición completa →Context window
Capacidad máxima de información tokenizada que un modelo puede considerar en una operación.
Ver definición completa →Vocabulary
Conjunto finito de unidades que un modelo o tokenizador puede representar directamente.
Ver definición completa →WordPiece
Método de tokenización por subpalabras que selecciona fragmentos para cubrir palabras con un vocabulario limitado.
Ver definición completa →Diagnóstico de procesos
Software interno a medida
Automatización de tareas repetitivas
Integración de sistemas y APIs
IA aplicada solo cuando aporta valor
© 2026 Camilo Boo. Automatización de procesos y software interno.