Memoria e contesto
Tenere coerenti le storie lunghe oltre la finestra di contesto.
Con la memoria attiva, il blocco più vecchio di una chat lunga viene ripiegato in un riassunto progressivo ed esce dal prompt. L'uso di token resta costante mentre la storia cresce.
Il riassunto gira su modelli gratuiti veloci in background, così puoi continuare a chattare. Il riassunto corrente viaggia in un blocco di sistema.
La chat recente viene trasformata in embedding e confrontata con i messaggi più vecchi e i lore candidati. Le corrispondenze più vicine vengono iniettate come sfondo, così i vecchi dettagli riemergono quando servono.
Attivazione facoltativa per singola conversazione. Un piccolo classificatore decide se il tuo messaggio richiede fatti aggiornati. Solo allora parte una vera ricerca che entra nel contesto.
Motore e dimensione del contesto si configurano nel pannello impostazioni. La ricerca web è disponibile per gli account a pagamento.
Memoria e ricerca web sono interruttori per singola conversazione nel pannello impostazioni. I preset portano i valori predefiniti per le nuove chat. L'impostazione del modello di utilità sceglie quale modello svolge il lavoro in background.