Yeonghyeon ·

¿Qué es la memoria de la IA?

La memoria de la IA significa dos cosas a la vez: lo que un asistente ve dentro de una conversación y lo que conserva entre conversaciones dentro de su propio servicio. Aquí está qué cubre cada una y qué no cubre ninguna.

La respuesta corta

La memoria de la IA es todo aquello a lo que un asistente puede recurrir más allá del mensaje que acabas de enviar. En la práctica son dos cosas distintas: la ventana de contexto (context window), que es lo que ve dentro de la conversación que tienes abierta, y la memoria integrada (built-in memory), que es lo que conserva entre conversaciones dentro de su propio servicio.

Las dos se acaban en puntos distintos, y por eso la pregunta "¿se acuerda o no?" recibe las dos respuestas. Una está limitada por el tamaño de una conversación. La otra, por el borde de un servicio.

Los dos tipos de memoria de la IA

La memoria de la IA se divide en la ventana de contexto —lo que cabe dentro de una conversación— y la memoria integrada —lo que se mantiene entre conversaciones dentro de un mismo servicio—.

La ventana de contexto es cuánto puede mirar un asistente mientras escribe una sola respuesta. Todo lo que usa para esa respuesta tiene que caber ahí: tus mensajes, los suyos, lo que hayas pegado. Cuando la conversación crece por encima de eso, lo más antiguo es lo primero que sale de la vista. Por eso el principio de una conversación larga se vuelve borroso mientras los últimos intercambios siguen nítidos —cómo se nota eso en el día a día tiene su propio artículo—.

La memoria integrada es lo que un asistente conserva entre conversaciones, dentro de su propio servicio. La memoria de ChatGPT funciona así: recoge cosas de tus chats y las lleva consigo. Los Proyectos de Claude siguen otro camino: el material vive en un proyecto y los chats que empiezas ahí pueden usarlo. Las dos son funciones bien hechas, y las dos han ido ampliándose.

Así que "se le ha olvidado" suele significar una de dos cosas. O la conversación se pasó de la ventana, o eso que tenías en mente nunca llegó a guardarse.

Qué no cubre la memoria de la IA

Ninguna de las dos cruza de un servicio a otro. Lo que guarda ChatGPT, Claude no lo ve, y al revés igual. Cada uno se construyó para sus propios usuarios, y no hay motivo para que uno vaya a leer el almacén de un competidor. Llevar el contexto entre dos asistentes choca con esto lo primero.

Hay un segundo borde, y es más fácil de pasar por alto. No decides tú todo lo que se guarda. La memoria integrada recoge lo que le parece que vale la pena conservar. Es cómodo. Y tampoco es lo mismo que marcar algo tú y saber que dentro de seis meses seguirá ahí.

Ninguna de las dos cosas es un fallo: salen de dónde está trazado el límite de cada servicio. Lo que también quiere decir que no hay función que ninguno de los dos pueda lanzar para cerrar ese hueco: un almacén que abarca dos servicios no puede vivir dentro de ninguno.

La parte que guardas tú

A lo que tiene que vivir fuera de los asistentes se le suele llamar knowledge layer (capa de conocimiento).

Una knowledge layer es un almacén que está fuera de cualquier asistente concreto y guarda lo que tú has decidido guardar, de modo que cualquier asistente que conectes pueda recuperarlo después. Los asistentes van y vienen; la capa se queda. Y ahí dentro no hay nada más que lo que hayas puesto.

Dos cosas evitan que un almacén así se convierta en trabajo de archivo.

La recuperación semántica (semantic retrieval) encuentra las cosas por significado y no por las palabras exactas. Pregunta por la decisión de precios que tomaste la primavera pasada y vuelve lo más cercano, aunque estuviera guardado con un título que nunca habrías adivinado. Para que eso funcione, lo que cuenta es qué guardas y en qué forma.

MCP (Model Context Protocol) es un estándar abierto para conectar asistentes con herramientas y almacenes externos. Si un almacén habla MCP, cualquier asistente compatible con el estándar llega hasta él, y eso es lo que impide que una knowledge layer acabe siendo de un solo asistente.

Tres cosas que no es:

Cuándo basta con la memoria integrada

Si usas un solo asistente y no cuentas con cambiar, la memoria integrada te vale. Llega más lejos que antes, no cuesta nada de más y no hay nada que conectar.

Los motivos para guardar algo fuera aparecen aquí:

Si es tu caso, las dos cosas que de verdad diferencian las opciones son lo primero que conviene mirar.

FAQ

¿Qué es una ventana de contexto?

La cantidad que un asistente puede mirar mientras escribe una sola respuesta. Todo lo que use para esa respuesta tiene que caber ahí, y cuando la conversación la supera lo más antiguo sale primero.

¿Qué diferencia hay entre la ventana de contexto y la memoria integrada?

La ventana de contexto está limitada por una conversación; la memoria integrada se mantiene entre conversaciones, pero solo dentro de un servicio. Una se acaba porque el chat se alargó, la otra porque cambiaste de asistente.

¿Qué es la recuperación semántica (semantic retrieval)?

Encontrar información por significado y no por las palabras exactas. Pregunta por la decisión de precios que tomaste la primavera pasada y vuelve lo más cercano, aunque estuviera guardado con un título que nunca habrías adivinado.

¿Qué es MCP?

Model Context Protocol, un estándar abierto para conectar asistentes con herramientas y almacenes externos. Si un almacén habla MCP, cualquier asistente compatible con el estándar llega hasta él.

Contextick es uno de esos almacenes. Lo conectas al asistente que ya usas, dices "recuerda esto" y más adelante, cuando venga a cuento, ese asistente lo trae de vuelta — aquí está cómo conectarlo.

← Todos los artículos