Definición:
Una ventana de contexto es la capacidad máxima de información que un modelo de inteligencia artificial puede manejar en una interacción para generar una respuesta. Habitualmente se expresa en tokens e incluye el contenido recibido y la generación, según los límites del modelo.
Determina cuánto material puede utilizar el modelo en ese momento, no cuánto conocimiento adquirió durante su entrenamiento ni qué información conserva una aplicación entre conversaciones.
Índice de contenidos
Qué información ocupa la ventana de contexto
El contexto no se limita al último mensaje escrito por el usuario. Una petición puede reunir distintos elementos que comparten la capacidad disponible:
- Instrucciones del sistema y de la aplicación: definen el comportamiento y las condiciones de la tarea.
- Conversación anterior: mensajes y respuestas que se incluyen para mantener la continuidad.
- Documentos y otros contenidos: texto, imágenes u otros formatos compatibles que se aportan al modelo.
- Información de herramientas: resultados de búsquedas, consultas o acciones realizadas durante el trabajo.
- Contenido generado: la respuesta y, en algunos modelos, los tokens empleados en el razonamiento.
Los tokens de IA son las unidades con las que se representa y contabiliza esa información. No equivalen siempre a palabras, por lo que el número de páginas de un documento no permite calcular con precisión cuánto contexto ocupará.
Además, que un archivo esté adjunto a una aplicación no significa que se envíe íntegro al modelo: el sistema puede seleccionar fragmentos o extraer solo parte de su contenido.
Diferencia entre contexto y límite de respuesta
La ventana de contexto y la longitud máxima de salida son límites relacionados, pero distintos. Un modelo puede admitir una entrada extensa y permitir una respuesta mucho más corta.
En los modelos que comparten un presupuesto entre entrada y salida, los documentos, las instrucciones y el historial dejan menos espacio disponible para generar. Por eso no basta con comprobar que un archivo cabe: también hay que contemplar la respuesta que se necesita.
La gestión de la ventana de contexto incluye estas diferencias de contabilización. Los límites concretos deben consultarse para el modelo y el servicio utilizados, sin trasladarlos automáticamente de una herramienta a otra.
Qué ocurre cuando se alcanza el límite
Si una petición supera la capacidad admitida, el servicio puede rechazarla. Algunas aplicaciones gestionan el crecimiento de la conversación antes de llegar a ese punto mediante recortes, resúmenes o selección de información.
La compactación del contexto consiste en sustituir parte del material acumulado por una representación más breve, normalmente un resumen que conserva las instrucciones y los datos considerados relevantes.
Esto permite continuar una tarea, pero no conserva necesariamente todos los detalles. Una precisión que estaba en el texto original puede quedar fuera del resumen.
Por tanto, una conversación puede seguir visible en la interfaz sin que todos sus mensajes estén disponibles íntegramente para cada nueva respuesta.
Ventana de contexto y memoria del asistente
El contexto es la información disponible para la respuesta actual; la memoria es un mecanismo para conservar y recuperar información entre interacciones.
Una aplicación puede guardar preferencias, notas o documentos fuera del modelo y recuperarlos cuando resulten pertinentes. Al incorporarse a una petición, esa información pasa a formar parte de su contexto.
Guardar una conversación tampoco equivale a entrenar de nuevo el modelo. El historial almacenado, los sistemas de memoria y los conocimientos adquiridos durante el entrenamiento cumplen funciones diferentes.
Esta distinción explica por qué un asistente puede recuperar una preferencia de una conversación antigua y, al mismo tiempo, no disponer de todos los detalles de un intercambio reciente.
Qué aporta una ventana de contexto más amplia
La ampliación de las ventanas de contexto ha facilitado el trabajo con documentos extensos, conversaciones largas y conjuntos de archivos. En los modelos basados en transformadores, esa evolución está vinculada a mejoras de arquitectura, entrenamiento e infraestructura.
Una mayor capacidad permite aportar más información sin dividirla tanto, pero que el contenido quepa no garantiza que el modelo lo utilice correctamente. Puede omitir detalles, confundir referencias o tener dificultades para relacionar datos alejados dentro de un documento.
La selección sigue siendo importante. Incluir material repetido, desactualizado o contradictorio puede dificultar la tarea aunque quede espacio disponible.
Los sistemas de recuperación de información permiten buscar fragmentos pertinentes en una colección externa e incorporarlos a la petición. No amplían la ventana del modelo: ayudan a decidir qué información entra en ella.
