Ventana de contexto (context window) — cantidad máxima de tokens que un modelo de lenguaje (LLM) puede procesar en una sola petición. Cuanto mayor es la ventana de contexto, más información puede manejar el modelo de una vez (conversaciones largas, documentos extensos). Sin embargo, ampliar la ventana no es lo mismo que dar memoria: la precisión de recuperación del modelo suele ser menor para información situada en medio de la ventana. Modelos actuales tienen desde 4.000 hasta 1 millón de tokens de ventana de contexto.