D

DeepSeek: deepseek-r1-distill-llama-70b:free

deepseek-r1-distill-llama-70b:free
131.1K bağlam131.1K çıktıAkıl yürütme
Yayınlandı Jan 23, 2025Bilgi kesme tarihi Jul 2024Güncellendi Sep 14, 2026

DeepSeek R1 Distill Llama 70B is a distilled large language model based on Llama-3.3-70B-Instruct, using outputs from DeepSeek R1. The model combines advanced distillation techniques to achieve high performance across multiple benchmarks, including: AIME 2024 pass@1: 70.0 MATH-500 pass@1: 94.5 CodeForces Rating: 1633 The model leverages fine-tuning from DeepSeek R1's outputs, enabling competitive performance comparable to larger frontier models.

Mod chatTokenizer Llama3Kuantizasyon bf16deepseek-ai/DeepSeek-R1-Distill-Llama-70B

Fiyatlandırma

Girdi fiyatı
$0.00/ 1 M jeton
Çıktı fiyatı
$0.00/ 1 M jeton
Context penceresi 131.1K tokenUyumlu endpointler openaiSağlayıcı DeepSeek

Çalışma süresi

Performans

Performans verileri yükleniyor...

Kullanım ve Sıralama

Kullanım yükleniyor...

Desteklenen parametreler

Tüm sağlayıcılar = bu modeli sunan her upstream destekler. Bazı sağlayıcılar = isteği işleyen upstream'e bağlıdır. Varsayılan = ayarlamadığınızda gönderilen değer.

ParametreSağlayıcılarVarsayılan
frequency_penaltyTüm sağlayıcılar-
include_reasoningTüm sağlayıcılar-
max_tokensTüm sağlayıcılar-
presence_penaltyTüm sağlayıcılar-
reasoningTüm sağlayıcılar-
repetition_penaltyTüm sağlayıcılar-
seedTüm sağlayıcılar-
stopTüm sağlayıcılar-
temperatureTüm sağlayıcılar-
top_kTüm sağlayıcılar-
top_pTüm sağlayıcılar-

Sık sorulan sorular

Benzer modeller