EL CONTEXTO EN UNA INTELIGENCIA ARTIFICIAL: POR QUÉ ES FUNDAMENTAL Y CÓMO FUNCIONA

El contexto en una inteligencia artificial es toda la información que el modelo tiene disponible en un momento dado para interpretar una petición y generar una respuesta. Incluye:
  • El mensaje o prompt actual del usuario.
  • El historial de la conversación.
  • Instrucciones del sistema, el “system prompt” que define el rol, el tono y las reglas de la IA.
  • Datos adicionales que se le inyectan, como documentos, resultados de búsquedas, variables de estado, etc..
  • Conocimiento paramétrico del propio modelo (lo que aprendió durante el entrenamiento), aunque este es estático y no se actualiza en tiempo real.
Cuanto más preciso, completo y bien estructurado sea ese contexto, mejor será la calidad de la respuesta.

El “context window” o ventana de contexto

Los modelos modernos tienen una limitación técnica importante: la ventana de contexto. Es la cantidad máxima de tokens que el modelo puede “ver” simultáneamente.
  • Modelos antiguos manejaban unos pocos miles de tokens.
  • Los actuales alcanzan decenas o cientos de miles de tokens, e incluso más en versiones avanzadas.
  • Todo lo que exceda esa ventana se pierde o debe resumirse/comprimirse.
Esto explica por qué, en conversaciones muy largas, la IA a veces “olvida” detalles del principio: simplemente ya no caben dentro de su ventana de atención.

Cómo utiliza el contexto una IA

Atención (Attention mechanism)

Los transformers, arquitectura base de la mayoría de LLM, calculan relaciones entre todos los tokens del contexto. Así deciden qué partes son más relevantes para predecir la siguiente palabra.

In-context learning

La IA puede aprender tareas nuevas solo con ejemplos dentro del prompt, sin reentrenarse. Esto es posible gracias a un contexto bien diseñado.

Memoria a corto plazo vs. conocimiento a largo plazo

El contexto actúa como memoria de trabajo. El conocimiento general del modelo es la memoria a largo plazo, pero es menos flexible y puede estar desactualizado.

Desafíos y limitaciones actuales

  • Pérdida de información: En contextos muy largos, el modelo puede sufrir “dilución de atención”, algunos detalles importantes se diluyen.
  • Contaminación o confusión: Si el historial contiene información contradictoria o irrelevante, la IA puede mezclarla.
  • Costo computacional: Procesar contextos largos consume más memoria y tiempo y dinero.
  • Alucinaciones: Cuando el contexto es insuficiente o ambiguo, el modelo tiende a inventar información plausible.

Técnicas para mejorar el uso del contexto

Los desarrolladores y usuarios avanzados emplean varias estrategias:
  • Resumen progresivo del historial.
  • Retrieval-Augmented Generation (RAG): buscar información externa y añadirla al contexto solo cuando es necesaria.
  • Instrucciones claras y estructuradas (few-shot prompting, chain-of-thought).
  • Separación de roles (system / user / assistant).
  • Compresión de contexto y técnicas de memoria externa.

Por qué el contexto importa tanto

Una IA sin buen contexto es como una persona extremadamente culta a la que se le habla sin decirle de qué se está hablando ni qué necesitas exactamente. Puede responder algo, pero rara vez será lo más útil. El verdadero poder de los sistemas actuales no reside solo en el tamaño del modelo, sino en la calidad con la que se gestiona y se presenta el contexto. A medida que las ventanas de contexto crecen y las técnicas de memoria mejoran, las IAs se vuelven más coherentes a lo largo del tiempo, más personalizadas y más capaces de mantener proyectos complejos.

Ejemplo de contexto

Si se que le escribe a una IA lo siguiente:“¿Cuánto cuesta?”, sin ningún contexto, la IA no sabe de qué estás hablando. Puede responder cualquier cosa: el precio de una pizza, de un coche, de una entrada de cine, es demasiado ambiguo. Ahora mirando el mismo mensaje, pero con contexto:Contexto completo que recibe la IA:
  • Instrucciones del sistema (system prompt): “Eres un asistente de una tienda online de electrónica. Responde de forma clara, amable y solo sobre productos de la tienda.”
  • Historial de la conversación:
    • Usuario: “Hola, estoy buscando un auricular inalámbrico con cancelación de ruido.”
    • IA: “Claro, te recomiendo el modelo SoundMax Pro. Tiene cancelación de ruido activa y 30 horas de batería.”
    • Usuario: “¿Cuánto cuesta?”
  • Mensaje actual del usuario: “¿Cuánto cuesta?”
Con todo este contexto, la IA entiende perfectamente que se refiere al precio del SoundMax Pro y puede responder algo como: “El SoundMax Pro cuesta 129,99 €. ¿Quieres que te diga si hay alguna oferta actual o si tienes más dudas?”.