DeepSeek-R1: चीन ने लॉन्च किया गजब का एआई टूल, टेंशन में आ गई चैटजीपीटी वाली कंपनी

प्रदीप पाण्डेय
टेक डेस्क, अमर उजाला, नई दिल्लीप्रदीप पाण्डेय
Tue, 28 Jan 2025 11:14 AM IST
सार

DeepSeek-R1 के दो मॉडल हैं। एक मॉडल DeepSeek-R1-Zero है जो पूरी तरह रिइन्फोर्समेंट लर्निंग (RL) के माध्यम से प्रशिक्षित है, जिसमें कोई सुपरवाइज्ड फाइन-ट्यूनिंग शामिल नहीं है।

विज्ञापन
DeepSeek unveils DeepSeek R1 a reasoning model that beats OpenAI o1
DeepSeek-R1 - फोटो : DeepSeek

    विस्तार

    चाइनीज कंपनी DeepSeek ने हाल ही में अपने DeepSeek-V3 लॉन्च करने के बाद अब DeepSeek-R1 नाम से एक नया पावरफुल लॉन्ग लैंग्वेज मॉडल (LLM) पेश किया है। यह नया मॉडल Mixture-of-Experts आर्किटेक्चर पर आधारित है और गणित, कोडिंग और सामान्य ज्ञान जैसे कार्यों में OpenAI के मॉडल o1 को कड़ी टक्कर दे रहा है। खास बात यह है कि DeepSeek-R1, OpenAI-o1 की तुलना में 90-95% अधिक किफायती है।

    DeepSeek-R1 एक अत्याधुनिक रीजनिंग मॉडल है जिसे AI सिस्टम की समस्या समाधान और विश्लेषणात्मक क्षमताओं को बढ़ाने के लिए डिजाइन किया गया है। इसके दो मॉडल हैं। एक मॉडल DeepSeek-R1-Zero है जो पूरी तरह रिइन्फोर्समेंट लर्निंग (RL) के माध्यम से प्रशिक्षित है, जिसमें कोई सुपरवाइज्ड फाइन-ट्यूनिंग शामिल नहीं है। दूसरा मॉडल DeepSeek-R1 है। यह मॉडल R1-Zero की नींव पर बनाया गया है और इसमें ठंडी शुरुआत (cold-start) के लिए क्यूरेटेड डेटा और मल्टी-स्टेज RL को शामिल किया गया है, जिससे इसकी रीजनिंग क्षमताओं और पढ़ने की क्षमता में सुधार हुआ है।

    विज्ञापन
    • गणित (AIME 2024):मॉडल ने 79.8% (Pass@1) स्कोर किया, जो OpenAI के o1 के बराबर है।
    • MATH-500:इस गणितीय मानक पर मॉडल ने 93% सटीकता हासिल की, जो इसे सर्वश्रेष्ठ बनाता है।
    • कोडिंग (Codeforces):यह मॉडल 96.3वें परसेंटाइल पर रैंक करता है, जो इसकी विशेषज्ञ-स्तरीय कोडिंग क्षमताओं को दर्शाता है।
    • सामान्य ज्ञान:MMLU पर मॉडल ने 90.8% और GPQA Diamond पर 71.5% सटीकता प्राप्त की।
    • लेखन और प्रश्न-उत्तर (AlpacaEval 2.0):इस पर मॉडल ने 87.6% जीत दर (win rate) हासिल की।
    और पढ़ें...
    Login or Signup
    अपना शहर चुनें