Buscar documentación...

Empieza a escribir para buscar documentación

Guía del chat

Memoria y contexto

Mantener coherentes las historias largas más allá de la ventana de contexto.

Con la memoria activada, el fragmento más antiguo de un chat largo se pliega en un resumen continuo y sale del prompt. El uso de tokens se mantiene estable a medida que crece la historia.

El resumen se ejecuta en segundo plano sobre modelos gratuitos rápidos, así que puedes seguir chateando. El resumen actual viaja en un bloque de sistema.

El chat reciente se convierte en embeddings y se compara con los mensajes antiguos y los candidatos de lore. Las coincidencias más cercanas se inyectan como contexto de fondo, así que los detalles antiguos reaparecen cuando vienen al caso.

Se activa por conversación. Un pequeño clasificador decide si tu mensaje necesita datos actualizados. Solo entonces se ejecuta una búsqueda real y se suma al contexto.

El motor y el tamaño de contexto se configuran en el panel de ajustes. La búsqueda web está disponible en cuentas de pago.

La memoria y la búsqueda web son interruptores por conversación en el cajón de ajustes. Los presets llevan los valores por defecto para los chats nuevos. El ajuste de modelo de utilidad elige qué modelo hace el trabajo en segundo plano.