D

DeepSeek: deepseek-r1-distill-llama-70b:free

deepseek-r1-distill-llama-70b:free
131.1K contexte131.1K sortieRaisonnement
Publié Jan 23, 2025Limite des connaissances Jul 2024Mis à jour Sep 14, 2026

DeepSeek R1 Distill Llama 70B is a distilled large language model based on Llama-3.3-70B-Instruct, using outputs from DeepSeek R1. The model combines advanced distillation techniques to achieve high performance across multiple benchmarks, including: AIME 2024 pass@1: 70.0 MATH-500 pass@1: 94.5 CodeForces Rating: 1633 The model leverages fine-tuning from DeepSeek R1's outputs, enabling competitive performance comparable to larger frontier models.

Mode chatTokenizer Llama3Quantification bf16deepseek-ai/DeepSeek-R1-Distill-Llama-70B

Tarification

Prix en entrée
$0.00/ 1 M jetons
Prix en sortie
$0.00/ 1 M jetons
Fenêtre de contexte 131.1K jetonsPoints d'accès compatibles openaiÉditeur DeepSeek

Disponibilité

Performance

Chargement des performances...

Utilisation et classement

Chargement de l'utilisation...

Paramètres supportés

Tous les fournisseurs = pris en charge par tous les upstreams servant ce modèle. Certains fournisseurs = dépend de l'upstream qui traite la requête. Par défaut = la valeur envoyée quand vous ne définissez rien.

ParamètreFournisseursPar défaut
frequency_penaltyTous les fournisseurs-
include_reasoningTous les fournisseurs-
max_tokensTous les fournisseurs-
presence_penaltyTous les fournisseurs-
reasoningTous les fournisseurs-
repetition_penaltyTous les fournisseurs-
seedTous les fournisseurs-
stopTous les fournisseurs-
temperatureTous les fournisseurs-
top_kTous les fournisseurs-
top_pTous les fournisseurs-

Questions fréquentes

Modèles similaires