Sahi jankari, gahraai se. 💡

AI1 min readmedium

एक बड़ा भाषा मॉडल किस पर प्रशिक्षित होता है?

What is a large language model trained on?

Chhota jawab

पुस्तकों, वेबसाइटों और लेखों से सैकड़ों अरब शब्द।

Hundreds of billions of words from books, websites, and articles.

Poora jawab

आधुनिक LLM को विशाल टेक्स्ट कॉर्पोरा पर प्रशिक्षित किया जाता है — अक्सर 1-10 ट्रिलियन टोकन — जिसमें पुस्तकें, विकिपीडिया, समाचार, कोड और वेब पेज शामिल हैं। वे तथ्य नहीं, पैटर्न सीखते हैं।

In English

Modern LLMs are trained on massive text corpora — often 1-10 trillion tokens — including books, Wikipedia, news, code, and web pages. They learn patterns, not facts.

Ek aur baat

GPT-3 को प्रशिक्षित करने में अनुमानित $4-12 मिलियन केवल कंप्यूट खर्च आया।

Ispar sirf ek source ka naam hai — “OpenAI research” — link nahi. Link ke saath verify kiye gaye facts yahan hain.