D

DeepSeek: deepseek-r1-distill-llama-70b:free

deepseek-r1-distill-llama-70b:free
131.1K संदर्भ131.1K आउटपुटतर्क
जारी किया गया Jan 23, 2025ज्ञान कटऑफ Jul 2024अपडेट किया गया Sep 14, 2026

DeepSeek R1 Distill Llama 70B is a distilled large language model based on Llama-3.3-70B-Instruct, using outputs from DeepSeek R1. The model combines advanced distillation techniques to achieve high performance across multiple benchmarks, including: AIME 2024 pass@1: 70.0 MATH-500 pass@1: 94.5 CodeForces Rating: 1633 The model leverages fine-tuning from DeepSeek R1's outputs, enabling competitive performance comparable to larger frontier models.

मोड chatटोकनाइज़र Llama3क्वांटाइज़ेशन bf16deepseek-ai/DeepSeek-R1-Distill-Llama-70B

मूल्य निर्धारण

इनपुट मूल्य
$0.00/ 10 लाख टोकन
आउटपुट मूल्य
$0.00/ 10 लाख टोकन
कॉन्टेक्स्ट विंडो 131.1K टोकनसंगत एंडपॉइंट्स openaiवेंडर DeepSeek

अपटाइम

प्रदर्शन

प्रदर्शन डेटा लोड हो रहा है...

उपयोग और रैंकिंग

उपयोग लोड हो रहा है...

समर्थित पैरामीटर

सभी प्रोवाइडर = इस मॉडल को सर्व करने वाला हर अपस्ट्रीम इसे सपोर्ट करता है। कुछ प्रोवाइडर = अनुरोध संभालने वाले अपस्ट्रीम पर निर्भर करता है। डिफ़ॉल्ट = कुछ सेट न करने पर भेजा जाने वाला मान।

पैरामीटरप्रोवाइडरडिफ़ॉल्ट
frequency_penaltyसभी प्रोवाइडर-
include_reasoningसभी प्रोवाइडर-
max_tokensसभी प्रोवाइडर-
presence_penaltyसभी प्रोवाइडर-
reasoningसभी प्रोवाइडर-
repetition_penaltyसभी प्रोवाइडर-
seedसभी प्रोवाइडर-
stopसभी प्रोवाइडर-
temperatureसभी प्रोवाइडर-
top_kसभी प्रोवाइडर-
top_pसभी प्रोवाइडर-

अक्सर पूछे जाने वाले प्रश्न

समान मॉडल