
Por qué el chat
“se le olvida” lo que hablaron
Llevas media hora escribiéndole a la IA y de repente ya no se acuerda de un dato que le diste al principio. No es que falle — es que se le acabó la memoria de esa conversación. Así funciona la “ventana de contexto”.
Le escribes a la IA una cotización larga, mensaje por mensaje: cuántas piezas, para qué cliente, cuánto presupuesto tiene, si lleva factura. A la mitad le pides que arme la propuesta con todo lo que le fuiste dando — y responde como si el primer dato nunca hubiera existido. No es un error del sistema ni falta de atención de la IA.
Es un límite técnico con nombre propio: la ventana de contexto. Cada modelo tiene un tope fijo de cuánto texto puede tener “a la vista” al mismo tiempo, y cuando una conversación lo rebasa, lo más antiguo deja de estar disponible para que la IA lo use — aunque tú sigas viéndolo arriba, en la pantalla.
Saber esto cambia cómo trabajas con la IA todos los días: cuándo conviene resumir antes de seguir, cuándo empezar de cero y por qué repetir el mismo dato dos veces en un chat largo no es paranoia — es la forma correcta de asegurarte de que no se pierda.
¿Qué es, exactamente?
Cada vez que le escribes algo a una IA, ella no solo lee tu último mensaje: vuelve a leer toda la conversación desde el inicio, cada vez. Pero solo puede cargar hasta cierta cantidad de texto de golpe — esa cantidad es la ventana de contexto. Se mide en “tokens”, unidades de texto un poco más chicas que una palabra, y cada modelo trae la suya de fábrica.
Mientras la conversación quepa dentro de esa ventana, todo lo que has escrito sigue “presente” para la IA. En cuanto la rebasa, lo más viejo se empieza a quedar fuera para dejarle lugar a lo nuevo — literalmente deja de estar disponible, aunque el mensaje siga ahí arriba, en tu pantalla.
Así se ve en una conversación real
Imagina que le vas cotizando a la IA el pedido de un cliente, un mensaje a la vez. Empiezas con “son 3 mesas y 12 sillas para su restaurante”, y unas líneas después le dices “el presupuesto máximo que me dio es de $45,000”. La conversación sigue: mantelería a juego, entrega en Naucalpan, factura con IVA desglosado, cuatro sillas más para la barra.
Si esa conversación crece lo suficiente, el primer dato —el presupuesto de $45,000— es justo el que se sale primero de la ventana, porque es el más antiguo. Le pides entonces que arme la propuesta con todo, y la IA la arma bien con lo que sí tiene a la vista, pero sin ese tope: no es que lo ignore a propósito, es que ya no lo tiene enfrente.
No todas las ventanas son del mismo tamaño
Los modelos más recientes de Claude, de Anthropic, ya manejan una ventana de hasta 1 millón de tokens — según su documentación oficial, eso equivale a cientos de miles de palabras en una sola conversación. Otros modelos trabajan con ventanas más chicas, pensadas para respuestas rápidas del día a día.
Ni más grande es siempre mejor ni más chico es siempre peor: para un chat de WhatsApp con un cliente, una ventana modesta sobra. Para subir el historial completo de tu negocio y hacerle preguntas, ahí sí importa que sea grande.
¿Qué tanto se te quedó?
Tres afirmaciones. Di si son verdaderas o falsas.
La IA "se le olvida" el inicio de una conversación muy larga porque se distrae, igual que una persona.
Entre más grande sea la ventana de contexto de un modelo, más conversación puede recordar sin perder el inicio.
Empezar un chat nuevo cuando uno se vuelve muy largo es una mala práctica.
Cuándo no te sirve preocuparte por esto
Si tus conversaciones con la IA son cortas —una pregunta, una respuesta, un chat que cierras en cinco minutos— la ventana de contexto casi nunca entra en juego: nunca llegas a llenarla. Tampoco tiene sentido perseguir el modelo con la ventana más grande posible si lo que haces es trabajo puntual del día a día; ese tamaño extra normalmente cuesta más y no lo vas a usar. El límite importa de verdad cuando la conversación crece —una cotización larga, un proyecto que se arma a lo largo de varios mensajes, un documento extenso que vas revisando poco a poco.
Qué hacer el lunes
- 1
Nota cuándo empieza a fallar (2 min). Si un chat ya lleva rato y las respuestas empiezan a sentirse menos precisas o repiten preguntas que ya contestaste, esa es la señal de que se está acercando al límite.
- 2
Pídele un resumen antes de seguir (3 min). Que la misma IA resuma en un párrafo lo importante de la conversación, y pega ese resumen al inicio de un chat nuevo en vez de seguir empujando el viejo.
- 3
Sube el documento en vez de repetirlo (5 min). Adjuntar un PDF o Excel una sola vez ocupa memoria de forma más eficiente que ir repitiendo los mismos datos en cada mensaje. Y si es información que usas seguido, guárdala en un espacio con memoria fija — Claude, ChatGPT y Gemini ya tienen “Proyectos”, GPTs o Gems para eso.
Si quieres ir más a fondo
¿Quieres esto operando en tu empresa?
En Nuvnext diseñamos, construimos y operamos agentes de IA dentro de empresas.
¿Alguna vez la IA se te 'olvidó' algo que le dijiste al inicio de un chat largo?
Comunidad Nuvnext
nuvnext.com/comunidadPublicado el 3 de agosto de 2026·Datos verificados al 24 de agosto de 2026