AI1 min readmedium
एक बड़ा भाषा मॉडल किस पर प्रशिक्षित होता है?
What is a large language model trained on?
Chhota jawab
पुस्तकों, वेबसाइटों और लेखों से सैकड़ों अरब शब्द।
Hundreds of billions of words from books, websites, and articles.
Poora jawab
आधुनिक LLM को विशाल टेक्स्ट कॉर्पोरा पर प्रशिक्षित किया जाता है — अक्सर 1-10 ट्रिलियन टोकन — जिसमें पुस्तकें, विकिपीडिया, समाचार, कोड और वेब पेज शामिल हैं। वे तथ्य नहीं, पैटर्न सीखते हैं।
In English
Modern LLMs are trained on massive text corpora — often 1-10 trillion tokens — including books, Wikipedia, news, code, and web pages. They learn patterns, not facts.
Ek aur baat
GPT-3 को प्रशिक्षित करने में अनुमानित $4-12 मिलियन केवल कंप्यूट खर्च आया।
Ispar sirf ek source ka naam hai — “OpenAI research” — link nahi. Link ke saath verify kiye gaye facts yahan hain.