D

DeepSeek: deepseek-r1-distill-llama-70b:free

deepseek-r1-distill-llama-70b:free
131.1K contexto131.1K salidaRazonamiento
Lanzado Jan 23, 2025Corte de conocimiento Jul 2024Actualizado Sep 14, 2026

DeepSeek R1 Distill Llama 70B is a distilled large language model based on Llama-3.3-70B-Instruct, using outputs from DeepSeek R1. The model combines advanced distillation techniques to achieve high performance across multiple benchmarks, including: AIME 2024 pass@1: 70.0 MATH-500 pass@1: 94.5 CodeForces Rating: 1633 The model leverages fine-tuning from DeepSeek R1's outputs, enabling competitive performance comparable to larger frontier models.

Modo chatTokenizador Llama3Cuantización bf16deepseek-ai/DeepSeek-R1-Distill-Llama-70B

Precios

Precio de entrada
$0.00/ 1 M tokens
Precio de salida
$0.00/ 1 M tokens
Ventana de contexto 131.1K tokensEndpoints compatibles openaiProveedor DeepSeek

Tiempo de actividad

Rendimiento

Cargando datos de rendimiento...

Uso y clasificación

Cargando uso...

Parámetros compatibles

Todos los proveedores = compatible en todos los upstreams que sirven este modelo. Algunos proveedores = depende del upstream que atienda la solicitud. Predeterminado = el valor enviado cuando no lo configuras.

ParámetroProveedoresPredeterminado
frequency_penaltyTodos los proveedores-
include_reasoningTodos los proveedores-
max_tokensTodos los proveedores-
presence_penaltyTodos los proveedores-
reasoningTodos los proveedores-
repetition_penaltyTodos los proveedores-
seedTodos los proveedores-
stopTodos los proveedores-
temperatureTodos los proveedores-
top_kTodos los proveedores-
top_pTodos los proveedores-

Preguntas frecuentes

Modelos similares