Cerca documentazione...

Inizia a digitare per cercare nella documentazione

Guida alla chat

Fornitori personalizzati

Chatta tramite il tuo endpoint e la tua chiave.

Aggiungi qualsiasi endpoint compatibile OpenAI con nome, URL base e chiave API. Il fornitore e la sua chiave restano solo nel tuo database locale.

I modelli personalizzati compaiono nel selettore dei modelli accanto a quelli del catalogo. Una conversazione può passare liberamente dagli uni agli altri.

Modulo del provider personalizzato con nome, URL dell'endpoint, chiave API, formato e l'elenco dei modelli

Carica automaticamente l'elenco modelli del provider oppure aggiungi gli id a mano. Ogni modello è di tipo testo o immagine. I modelli di tipo immagine alimentano il generatore di immagini, non il menu della chat.

Ogni voce di modello porta le proprie impostazioni, compreso il tokenizer usato per il budget.

Il conteggio dei token guida il taglio della cronologia e i budget dei lorebook, quindi il tokenizer giusto conta nelle chat lunghe. Ogni modello personalizzato sceglie tra 13 preimpostazioni:

auto cl100k o200k claude glm5 glm4 deepseek deepseek-v4 llama3 gemma qwen mistral cohere

Oppure punta a qualsiasi tokenizer HuggingFace tramite slug o URL:

text
hf:openai-community/gpt2
hf:https://huggingface.co/Qwen/Qwen2.5-7B/resolve/main/tokenizer.json

I tokenizer HuggingFace si scaricano una volta e restano in cache locale. Il conteggio non blocca mai un invio: se un tokenizer non si carica, conta al suo posto un ripiego approssimativo.

I modelli del catalogo possono passare da un gruppo di fatturazione che viene applicato alle nuove chat. I modelli dei provider personalizzati saltano il routing, quindi il gruppo non ha effetto su di loro.

Le richieste ai fornitori personalizzati vanno dritte dal tuo browser al tuo endpoint. I server di UnoRouter non vedono mai la richiesta, la risposta o la chiave del fornitore.