BharatGen शासन और नवाचार के भविष्य की दिशा तय करेगा: केंद्रीय मंत्री

विज्ञान एवं प्रौद्योगिकी के राज्य मंत्री (स्वतंत्र प्रभार) जितेंद्र सिंह ने सोमवार को “BharatGen” को भारत का पहला सर्वभौमिक (sovereign), बहुभाषी और मल्टीमॉडल AI-आधारित Large Language Model (LLM) बताते हुए कहा कि यह मॉडल भारत में शासन, नवाचार और डिजिटल भविष्य को नई दिशा देगा।

आईआईटी बॉम्बे के दौरे के दौरान मंत्री ने कहा कि BharatGen भारत का पहला राष्ट्रीय प्रयास है, जिसका उद्देश्य एक ऐसा भाषा मॉडल बनाना है जो देश की भाषाई, सांस्कृतिक और सामाजिक विविधता को सचमुच दर्शाता हो।

22 से अधिक भारतीय भाषाओं को समर्थन देने के लिए बनाया गया BharatGen तीन प्रमुख मॉडैलिटी—टेक्स्ट, वॉयस (Speech) और डॉक्यूमेंट विज़न—को एक साथ जोड़ता है, जिससे यह भारतीय नागरिकों के प्राकृतिक संवाद के अनुरूप समझने और जानकारी उत्पन्न करने में सक्षम है।

मंत्री सिंह ने BharatGen की तकनीकी क्षमता, पैमाने और महत्वाकांक्षा की सराहना करते हुए कहा कि यह परियोजना भारत की तकनीकी आत्मनिर्भरता की दिशा में एक महत्वपूर्ण कदम है।

उन्होंने कहा,

“BharatGen सिर्फ एक तकनीकी प्रोजेक्ट नहीं, बल्कि 1.4 अरब भारतीयों की आकांक्षाओं, भाषाओं और अनुभवों को AI में शामिल करने का राष्ट्रीय प्रयास है।”

मंत्री ने यह भी कहा कि BharatGen जैसी पहलें प्रधानमंत्री नरेंद्र मोदी के उस विज़न को आगे बढ़ाती हैं, जिसके तहत विज्ञान और प्रौद्योगिकी के माध्यम से हर नागरिक को सशक्त बनाना है—ऐसी डिजिटल प्रणालियाँ बनाकर जो समावेशी, भरोसेमंद और स्थानीय जरूरतों पर आधारित हों।

BharatGen को विज्ञान एवं प्रौद्योगिकी मंत्रालय के NM-ICPS (National Mission on Interdisciplinary Cyber-Physical Systems) के तहत समर्थन प्राप्त है। इसके लिए ₹235 करोड़ IIT बॉम्बे स्थित टेक्नोलॉजी इनोवेशन हब के माध्यम से दिए जा रहे हैं।

इस परियोजना में IIT बॉम्बे के नेतृत्व में IIT मद्रास, IIT कानपुर, IIIT हैदराबाद, IIT मंडी, IIT हैदराबाद, IIM इंदौर, IIT खड़गपुर और IIIT दिल्ली जैसे प्रमुख संस्थान शामिल हैं।

परियोजना का प्रमुख घटक है Bharat Data Sagar, जो भारत के डिजिटल ज्ञान संसाधनों पर देश की पूर्ण स्वामित्व और नियंत्रण सुनिश्चित करने के लिए बनाया जा रहा है—यह देश के सबसे बड़े डेटा उपक्रमों में से एक है।

दौरे के दौरान मंत्री ने BharatGen द्वारा जारी किए गए मॉडल भी देखे:

  • Param-1: 2.9 बिलियन पैरामीटर का टेक्स्ट मॉडल, 7.5 ट्रिलियन टोकन पर प्रशिक्षित, जिसमें एक-तिहाई भारतीय सामग्री है।

  • Shrutam: 30 मिलियन पैरामीटर वाला Automatic Speech Recognition मॉडल।

  • Sooktam: 150 मिलियन पैरामीटर का Text-to-Speech मॉडल, 9 भारतीय भाषाओं में उपलब्ध।

  • Patram: भारत का पहला Document-Vision मॉडल, 7 बिलियन पैरामीटर्स, 2.5 बिलियन टोकन पर प्रशिक्षित—भारतीय दस्तावेज़ प्रारूपों को समझने के लिए बनाया गया।

मंत्री ने कहा कि ये सभी मॉडल मिलकर भारत के लिए एक पूर्ण AI स्टैक तैयार करते हैं—टेक्स्ट, वॉयस और विज़न—जो शासन, शिक्षा, स्वास्थ्य, कृषि, उद्योग और डिजिटल समावेशन जैसे क्षेत्रों में व्यापक समर्थन देंगे।