LingVo.club
📖+30 XP
🎧+20 XP
+35 XP
बड़े भाषा मॉडल और सरल गुणा में असफलता (स्तर B1) — brown wooden blocks on white surface

बड़े भाषा मॉडल और सरल गुणा में असफलताCEFR B1

29 दिस॰ 2025

स्तर B1 – मध्य स्तर
4 मिनट
184 शब्द

University of Chicago के नेतृत्व में एक टीम ने यह शोध किया, जिसमें MIT, Harvard University, University of Waterloo और Google DeepMind के सहयोगी भी शामिल थे। अध्ययन ने यह देखा कि मौजूदा प्रशिक्षण तरीके मॉडल की लंबी-दूरी निर्भरताएँ संभालने की क्षमता पर कैसे असर डालते हैं। शोध का फोकस दो चार-अंकीय संख्याओं के गुणा जैसे बहु-चरण गणनात्मक कार्य पर था।

टीम ने मानक फाइन-ट्यूनिंग की तुलना ICoT से की। मानक तरीके में दो से 12 परतों वाले मॉडल चार-अंकीय गुणा पर 1% से भी कम सटीकता दिखाते रहे, जबकि ICoT से प्रशिक्षित मॉडल 100% सटीकता पर पहुँचे। शोधकर्ताओं ने पाया कि ICoT मॉडल आंतरिक अवस्थाओं में मध्यवर्ती मान एन्कोड करते हैं और उनसे चलती राशियाँ (running sums) डिकोड कर पाते हैं।

शोध में यह भी दिखा कि शुरुआती परतें अंक-जुड़ियों के गुणनफल निकाल कर संग्रहीत करती हैं और बाद की परतें उन मानों को पुनः प्राप्त कर अंतिम उत्तर का निर्माण करती हैं। टीम ने एक प्रशिक्षण उद्देश्य जोड़ा जो हर चरण पर चलती राशियों को ट्रैक करना सिखाता; इससे छोटे मॉडलों की सटीकता बहुत बेहतर हुई।

कठिन शब्द

  • नेतृत्वकिसी समूह या परियोजना का निर्देशन या मार्गदर्शन
  • प्रशिक्षणमशीन या मॉडल को जानकारी देने की प्रक्रिया
    प्रशिक्षित
  • निर्भरताएक चीज़ का दूसरी चीज़ पर आश्रित होना
    निर्भरताएँ
  • बहु-चरणकई अलग-अलग चरणों में होने वाला कार्य
  • फाइन-ट्यूनिंगपूर्व प्रशिक्षित मॉडल का अतिरिक्त सुधार या समायोजन
  • सटीकतानतीजे या उत्तर के सही होने की मात्रा
  • एन्कोडजानकारी को किसी अन्य रूप में बदलना और रखना
  • चलती राशियाँहर कदम पर जोड़े गए संख्याओं का क्रमिक जोड़

युक्ति: जब आप किसी भी भाषा में कहानी पढ़ें या ऑडियो सुनें, तो लेख में हाइलाइट किए गए शब्दों पर होवर/फ़ोकस/टैप करें और तुरंत छोटी-सी परिभाषा देखें।

चर्चा के प्रश्न

  • आपको क्यों लगता है कि मॉडलों को मध्यवर्ती मान सीखाना उपयोगी होता है?
  • क्या आप कभी गणित में बहु-चरण समस्याएँ हल करते समय बीच के कदम लिखते हैं? उस तरीके का एक छोटा उदाहरण दें।
  • अगर यह प्रशिक्षण उद्देश्य स्कूल की पढ़ाई में लगाया जाए, तो छात्रों को कौन सा सीधा लाभ दिखेगा?

संबंधित लेख

tofersen से SOD1-ALS की प्रगति धीमी हुई (स्तर B1)
26 दिस॰ 2025

tofersen से SOD1-ALS की प्रगति धीमी हुई

दीर्घकालिक अध्ययन में पाया गया कि tofersen नामक दवा SOD1-जनित ALS की प्रगति को धीमा कर सकती है और कुछ मरीजों में स्थिरीकरण या सुधार भी ला सकती है। अध्ययन में सुरक्षा और दुष्प्रभावों का भी मूल्यांकन किया गया।

AI और ग्लोबल नॉर्थ-ग्लोबल साउथ की असमान पहुँच (स्तर B1)
7 नव॰ 2025

AI और ग्लोबल नॉर्थ-ग्लोबल साउथ की असमान पहुँच

कृत्रिम बुद्धिमत्ता बड़े आर्थिक बदलाव का वादा करती है, पर लाभ समान रूप से नहीं बंटेंगे। लेख में अफ्रीका और अन्य ग्लोबल साउथ देशों की चिंताएं, डेटा और चिप नीति जैसी असमानताओं पर ध्यान दिया गया है।

स्कूलों में बढ़ती कृत्रिम बुद्धिमत्ता (स्तर B1)
18 मई 2026

स्कूलों में बढ़ती कृत्रिम बुद्धिमत्ता

अमेरिकी स्कूलों में कृत्रिम बुद्धिमत्ता के नए उपकरण और प्रशिक्षण बढ़ रहे हैं। एक शोध में शिक्षकों की मिली-जुली प्रतिक्रियाएँ मिलीं और सावधान कार्यान्वयन तथा आगे के अध्ययन की ज़रूरत बताई गई।

लैटिन अमेरिका में स्थानीय AI से लिंग असमानता और हिंसा का पता (स्तर B1)
18 नव॰ 2025

लैटिन अमेरिका में स्थानीय AI से लिंग असमानता और हिंसा का पता

लैटिन अमेरिका की समूह स्थानीय और खुले AI सिस्टम बना रहे हैं ताकि लिंग असमानता और हिंसा को समझा और घटाया जा सके। कुछ टूल अदालतों में 2021 के बाद इस्तेमाल हो रहे हैं और उनमें 10,000 से अधिक निर्णय हैं।

कंप्यूटर खेलों से ट्रॉमैटिक मस्तिष्क चोट में सुधार (स्तर B1)
24 फ़र॰ 2026

कंप्यूटर खेलों से ट्रॉमैटिक मस्तिष्क चोट में सुधार

शोध में पाया गया कि ट्रॉमैटिक मस्तिष्क चोट वाले लोगों ने कंप्यूटर-आधारित संज्ञानात्मक खेल पूरा करने पर मस्तिष्क की संरचना और सोचने की क्षमता में सुधार दिखाया। अध्ययन ने न्यूरोप्लास्टिसिटी और ध्यान, स्मृति व प्रोसेसिंग स्पीड में बेहतर नतीजे देखे।