Gedächtnis & Kontext
Lange Geschichten über das Kontextfenster hinaus kohärent halten.
Bei aktiviertem Gedächtnis wandert der älteste Abschnitt eines langen Chats in eine laufende Zusammenfassung und verlässt den Prompt. Der Token-Verbrauch bleibt flach, während die Geschichte wächst.
Die Zusammenfassung läuft im Hintergrund auf schnellen kostenlosen Modellen, das Chatten geht also weiter. Die aktuelle Zusammenfassung reist in einem System-Block mit.
Der jüngste Chat wird eingebettet und mit älteren Nachrichten und Lore-Kandidaten verglichen. Die nächstliegenden Treffer werden als Hintergrund eingefügt, alte Details tauchen also wieder auf, wenn sie relevant sind.
Je Unterhaltung zuschaltbar. Ein kleiner Klassifikator entscheidet, ob die Nachricht frische Fakten braucht. Erst dann läuft eine echte Suche und geht in den Kontext ein.
Suchmaschine und Kontextgröße sind im Einstellungs-Drawer konfigurierbar. Die Websuche steht bezahlten Konten zur Verfügung.
Gedächtnis und Websuche sind Schalter je Unterhaltung in der Einstellungsleiste. Presets tragen Standardwerte für neue Chats. Die Einstellung für das Hilfsmodell legt fest, welches Modell die Hintergrundarbeit erledigt.