LingVo.club
📖+30 XP
🎧+20 XP
+35 XP
बड़े भाषा मॉडल और सरल गुणा में असफलता (स्तर B1) — brown wooden blocks on white surface

बड़े भाषा मॉडल और सरल गुणा में असफलताCEFR B1

29 दिस॰ 2025

स्तर B1 – मध्य स्तर
4 मिनट
184 शब्द

University of Chicago के नेतृत्व में एक टीम ने यह शोध किया, जिसमें MIT, Harvard University, University of Waterloo और Google DeepMind के सहयोगी भी शामिल थे। अध्ययन ने यह देखा कि मौजूदा प्रशिक्षण तरीके मॉडल की लंबी-दूरी निर्भरताएँ संभालने की क्षमता पर कैसे असर डालते हैं। शोध का फोकस दो चार-अंकीय संख्याओं के गुणा जैसे बहु-चरण गणनात्मक कार्य पर था।

टीम ने मानक फाइन-ट्यूनिंग की तुलना ICoT से की। मानक तरीके में दो से 12 परतों वाले मॉडल चार-अंकीय गुणा पर 1% से भी कम सटीकता दिखाते रहे, जबकि ICoT से प्रशिक्षित मॉडल 100% सटीकता पर पहुँचे। शोधकर्ताओं ने पाया कि ICoT मॉडल आंतरिक अवस्थाओं में मध्यवर्ती मान एन्कोड करते हैं और उनसे चलती राशियाँ (running sums) डिकोड कर पाते हैं।

शोध में यह भी दिखा कि शुरुआती परतें अंक-जुड़ियों के गुणनफल निकाल कर संग्रहीत करती हैं और बाद की परतें उन मानों को पुनः प्राप्त कर अंतिम उत्तर का निर्माण करती हैं। टीम ने एक प्रशिक्षण उद्देश्य जोड़ा जो हर चरण पर चलती राशियों को ट्रैक करना सिखाता; इससे छोटे मॉडलों की सटीकता बहुत बेहतर हुई।

कठिन शब्द

  • नेतृत्वकिसी समूह या परियोजना का निर्देशन या मार्गदर्शन
  • प्रशिक्षणमशीन या मॉडल को जानकारी देने की प्रक्रिया
    प्रशिक्षित
  • निर्भरताएक चीज़ का दूसरी चीज़ पर आश्रित होना
    निर्भरताएँ
  • बहु-चरणकई अलग-अलग चरणों में होने वाला कार्य
  • फाइन-ट्यूनिंगपूर्व प्रशिक्षित मॉडल का अतिरिक्त सुधार या समायोजन
  • सटीकतानतीजे या उत्तर के सही होने की मात्रा
  • एन्कोडजानकारी को किसी अन्य रूप में बदलना और रखना
  • चलती राशियाँहर कदम पर जोड़े गए संख्याओं का क्रमिक जोड़

युक्ति: जब आप किसी भी भाषा में कहानी पढ़ें या ऑडियो सुनें, तो लेख में हाइलाइट किए गए शब्दों पर होवर/फ़ोकस/टैप करें और तुरंत छोटी-सी परिभाषा देखें।

चर्चा के प्रश्न

  • आपको क्यों लगता है कि मॉडलों को मध्यवर्ती मान सीखाना उपयोगी होता है?
  • क्या आप कभी गणित में बहु-चरण समस्याएँ हल करते समय बीच के कदम लिखते हैं? उस तरीके का एक छोटा उदाहरण दें।
  • अगर यह प्रशिक्षण उद्देश्य स्कूल की पढ़ाई में लगाया जाए, तो छात्रों को कौन सा सीधा लाभ दिखेगा?

संबंधित लेख

अध्ययन: AI चैटबॉट लोगों की राजनीतिक राय बदल सकते हैं (स्तर B1)
10 मार्च 2026

अध्ययन: AI चैटबॉट लोगों की राजनीतिक राय बदल सकते हैं

एक नया अध्ययन दिखाता है कि AI संचालित चैटबॉट के छोटे, तथ्यात्मक सारांश भी लोगों के सामाजिक और राजनीतिक विचारों को बदल सकते हैं। शोध में GPT-4o सारांश, Wikipedia और_FRAMEED_ सारांशों की तुलना की गई।

tofersen से SOD1-ALS की प्रगति धीमी हुई (स्तर B1)
26 दिस॰ 2025

tofersen से SOD1-ALS की प्रगति धीमी हुई

दीर्घकालिक अध्ययन में पाया गया कि tofersen नामक दवा SOD1-जनित ALS की प्रगति को धीमा कर सकती है और कुछ मरीजों में स्थिरीकरण या सुधार भी ला सकती है। अध्ययन में सुरक्षा और दुष्प्रभावों का भी मूल्यांकन किया गया।

VillainNet: स्वायत्त वाहनों में नया सुरक्षा खतरा (स्तर B1)
20 फ़र॰ 2026

VillainNet: स्वायत्त वाहनों में नया सुरक्षा खतरा

Georgia Tech के शोधकर्ताओं ने VillainNet नाम का एक बैकडोर खोजा जो सुपर नेटवर्क में छिपकर स्वायत्त वाहनों के नियंत्रण को ले सकता है। शोध सुरक्षित उपाय और नए बचाव की जरूरत बताते हैं।

कोलम्बिया: एआई और ड्रोन बदल रहे संघर्ष (स्तर B1)
25 अप्रैल 2026

कोलम्बिया: एआई और ड्रोन बदल रहे संघर्ष

कोलम्बिया में नई तकनीकें निगरानी, संचार और ऑपरेशन बदल रही हैं। ड्रोन और डिजिटल हथकंडे हिंसा और गलत सूचना को तेज कर रहे हैं, और सरकार ने इससे निपटने के लिए कदम उठाए हैं।

ऑटिज़्म बताने पर AI सलाह कैसे बदलती है (स्तर B1)
20 अप्रैल 2026

ऑटिज़्म बताने पर AI सलाह कैसे बदलती है

नए अध्ययन में पाया गया कि जब उपयोगकर्ता अपने ऑटिज़्म का खुलासा करते हैं तो बड़े भाषा मॉडल की सामाजिक सलाह बदल सकती है। शोध में मॉडलों के उत्तर और ऑटिस्टिक उपयोगकर्ताओं की प्रतिक्रियाएँ दोनों देखी गईं।