DeepSeek ने हाल ही में एक नया शोध-पत्र प्रकाशित किया है, जिसमें रिइन्फोर्समेंट लर्निंग के एक नए तरीके को पेश किया गया है, जिसे "सेल्फ-प्रिंसिपल्ड क्रिटिक ट्यूनिंग" कहा गया है। इस तकनीक के जरिए एआई को मानवीय प्राथमिकताओं के अनुसार बेहतर तरीके से काम करने के लिए प्रशिक्षित किया जाता है, और इसमें सटीक जवाब देने पर एआई को पुरस्कार मिलता है। इस नए मॉडल को DeepSeek-GRM नाम दिया गया है, जो कम संसाधनों में भी अधिक प्रभावी है। कंपनी ने यह भी बताया कि यह मॉडल ओपन सोर्स होगा, जिससे अन्य डेवलपर्स भी इसका फायदा उठा सकेंगे।
Author: JAN TV Editorial Team
DISCLAIMER: इस वेबसाइट पर दी गई जानकारी केवल सामान्य एवं शैक्षणिक उद्देश्यों के लिए है। हमने जानकारी को सटीक रखने का प्रयास किया है, लेकिन इसकी पूर्णता या विश्वसनीयता की गारंटी नहीं दी जाती। तृतीय-पक्ष वेबसाइटों या स्रोतों की सामग्री पर हमारा नियंत्रण नहीं है। इस जानकारी के आधार पर लिया गया कोई भी निर्णय आपके अपने विवेक और जोखिम पर होगा।