Eigene Anbieter
Chatte über deinen eigenen Endpunkt und Schlüssel.
Füge jeden OpenAI-kompatiblen Endpunkt mit Name, Basis-URL und API-Schlüssel hinzu. Anbieter und Schlüssel liegen ausschließlich in deiner lokalen Datenbank.
Eigene Modelle erscheinen in der Modellauswahl neben den Katalogmodellen. Eine Unterhaltung kann frei zwischen ihnen wechseln.

Die Modellliste des Providers automatisch laden oder Modell-IDs von Hand ergänzen. Jedes Modell ist als Text oder Bild typisiert. Als Bild typisierte Modelle speisen den Bildgenerator, nicht die Chat-Auswahl.
Modelleinträge tragen ihre eigenen Einstellungen, einschließlich des Tokenizers für die Budgetierung.
Die Token-Zählung steuert Verlaufskürzung und Lorebook-Budgets, der richtige Tokenizer zählt also bei langen Chats. Jedes eigene Modell wählt aus 13 Voreinstellungen:
auto cl100k o200k claude glm5 glm4 deepseek deepseek-v4 llama3 gemma qwen mistral cohere
Oder verweise per Slug oder URL auf einen beliebigen HuggingFace-Tokenizer:
hf:openai-community/gpt2
hf:https://huggingface.co/Qwen/Qwen2.5-7B/resolve/main/tokenizer.jsonHuggingFace-Tokenizer werden einmal geladen und lokal gecacht. Die Zählung blockiert nie ein Senden: Lädt ein Tokenizer nicht, zählt stattdessen ein näherungsweiser Fallback.
Katalogmodelle können über eine Abrechnungsgruppe geleitet werden, die neue Chats vorbelegt. Modelle eigener Provider umgehen das Routing, die Gruppe wirkt sich also nicht auf sie aus.
Anfragen an eigene Anbieter gehen direkt aus deinem Browser an deinen Endpunkt. Die Server von UnoRouter sehen weder Anfrage noch Antwort noch deinen Anbieterschlüssel.