Opens in a new tab
Join Anantam IAS Channel on Telegram

सर्वम एआई: इंडिया एआई मिशन, संप्रभु मॉडल, बुलबुल और सारस

सर्वम एआई आसान भाषा में: भारतीय भाषाओं के मॉडल बनाने वाली बेंगलुरु की कंपनी, इंडिया एआई मिशन में इसका चयन, इसके मॉडल और संप्रभु AI पर बहस।

Illustration for the Sarvam AI note on Anantam IAS

सर्वम एआई बेंगलुरु का एक स्टार्टअप है, जो भारतीय भाषाओं के लिए बड़े भाषा मॉडल बनाता है। अप्रैल 2025 में इसे इंडिया एआई मिशन के तहत भारत का संप्रभु भाषा मॉडल बनाने की मंजूरी मिली। फरवरी और मार्च 2026 में इसने भारत में शुरू से प्रशिक्षित दो मॉडल जारी किए, सर्वम 30B और सर्वम 105B। बड़े मॉडल पर इसने इंडस नाम का एक असिस्टेंट भी खोला। भारत की AI नीति पर नजर रखने वाले किसी भी व्यक्ति के लिए सर्वम सबसे साफ उदाहरण है कि “संप्रभु AI” का असल में मतलब क्या है।

ज्यादातर पाठकों के मन में इसके बारे में दो गलत धारणाएं होती हैं। पहली यह कि सर्वम कोई सरकारी संस्था है। असल में यह एक निजी कंपनी है (इसका कानूनी नाम एक्सोनवाइज प्राइवेट लिमिटेड है), जिसे एक प्रतिस्पर्धी योजना के तहत सरकारी कंप्यूट और पैसा मिलता है। दूसरी धारणा यह कि “संप्रभु” का मतलब है कि अब भारत किसी पर निर्भर नहीं है। यह नोट बताता है कि सरकार ने असल में क्या चुना, कंपनी ने क्या जारी किया है, और संप्रभुता के दावे की ईमानदार सीमाएं कहां हैं।

सर्वम एआई क्या है?

सर्वम एआई एक निजी भारतीय कंपनी है, जो फाउंडेशन मॉडल बनाती है। फाउंडेशन मॉडल वे बड़े, सामान्य काम वाले AI मॉडल हैं, जिनके ऊपर दूसरे एप्लिकेशन बनाए जाते हैं। इसका फोकस भारतीय भाषाओं और आवाज पर है। यह इंडिया एआई मिशन के फाउंडेशन मॉडल वाले हिस्से के तहत चुनी गई 12 टीमों में से एक है।

तथ्यब्योरा
यह क्या हैनिजी AI कंपनी; कानूनी इकाई एक्सोनवाइज प्राइवेट लिमिटेड
मुख्यालयइंदिरानगर, बेंगलुरु, कर्नाटक
सह-संस्थापकविवेक राघवन और प्रत्युष कुमार
पहला प्लेटफॉर्म लॉन्च13 अगस्त 2024, ओपन-सोर्स सर्वम 2B मॉडल के साथ
सरकारी चयनअप्रैल 2025, इंडिया एआई मिशन के तहत भारत का संप्रभु LLM तंत्र बनाने के लिए
सरकारी मदद₹246.72 करोड़ की वित्तीय और कंप्यूट सहायता (PIB, फरवरी 2026)
मुख्य मॉडलसर्वम 30B और सर्वम 105B, 6 मार्च 2026 को ओपन-सोर्स किए गए
आवाज और दस्तावेज वाले मॉडलबुलबुल (टेक्स्ट से आवाज), सारस (आवाज से टेक्स्ट), सर्वम विजन (दस्तावेज)
आम लोगों के लिए उत्पादइंडस असिस्टेंट, 20 फरवरी 2026 से सीमित बीटा

₹246.72 करोड़ वाला आंकड़ा याद रखने लायक है। इसे मिशन के कुल ₹10,371.92 करोड़ के खर्च के सामने रखिए, तो सर्वम का हिस्सा पूरे कार्यक्रम का 2 प्रतिशत से थोड़ा ज्यादा बैठता है। इससे पता चलता है कि मिशन अपना दांव कई जगह बांट रहा है।

इंडिया एआई मिशन ने सर्वम को क्यों चुना?

छोटा जवाब यह है कि मिशन चाहता था कि भारतीय कंपनियां बेस मॉडल शुरू से प्रशिक्षित करें, और सर्वम यह काम छोटे पैमाने पर पहले ही कर चुका था। यह बात क्यों मायने रखती थी, यह समझने के लिए पहले मिशन का ढांचा समझना होगा।

केंद्रीय कैबिनेट ने मार्च 2024 में इंडिया एआई मिशन को मंजूरी दी। इसके लिए पांच साल में ₹10,371.92 करोड़ का खर्च तय हुआ, और इसे MeitY अपने इंडिया एआई डिवीजन के जरिए चलाता है। दिसंबर 2025 के PIB व्याख्या-पत्र में इसके सात स्तंभ गिनाए गए हैं:

  • कंप्यूट: GPU का एक साझा भंडार। GPU (ग्राफिक्स प्रोसेसिंग यूनिट) वे चिप हैं, जो AI प्रशिक्षण के लिए जरूरी समानांतर गणना करती हैं। इनकी संख्या 38,000 पार कर गई, और ये करीब ₹65 प्रति घंटा की रियायती दर पर मिलते हैं।
  • एप्लिकेशन डेवलपमेंट: स्वास्थ्य, खेती, जलवायु और शासन में भारत की खास समस्याओं के लिए AI औजार।
  • एआईकोश: डेटासेट और मॉडल के लिए एक राष्ट्रीय प्लेटफॉर्म।
  • फाउंडेशन मॉडल: भारतीय डेटा और भाषाओं पर बने भारत के अपने बड़े मॉडल।
  • फ्यूचरस्किल्स: AI प्रतिभा के लिए फेलोशिप और प्रशिक्षण।
  • स्टार्टअप फाइनेंसिंग: AI स्टार्टअप को पैसे की मदद।
  • सुरक्षित और भरोसेमंद AI: जिम्मेदार इस्तेमाल के लिए औजार और ढांचे।

फाउंडेशन मॉडल वाले स्तंभ के लिए 500 से ज्यादा प्रस्ताव आए। दो चरणों में मिशन ने 12 टीमें चुनीं: सर्वम एआई, सॉकेट एआई, ज्ञानी एआई, गैन एआई, अवतार एआई, IIT बॉम्बे का कंसोर्टियम भारतजेन, जेनटेक, जेन लूप, इंटेलीहेल्थ, शोध एआई, फ्रैक्टल एनालिटिक्स और टेक महिंद्रा मेकर्स लैब। सर्वम को मंजूरी अप्रैल 2025 में मिली।

चयन से पहले सर्वम ने क्या बनाया था

जब तक सर्वम ने आवेदन किया, उसके पास काम का रिकॉर्ड था। अगस्त 2024 के लॉन्च में उसने सर्वम 2B पेश किया। कंपनी ने इसे किसी भारतीय कंपनी का भारतीय कंप्यूट पर शुरू से प्रशिक्षित पहला LLM बताया। इसमें 10 भारतीय भाषाओं में करीब 4 ट्रिलियन टोकन इस्तेमाल हुए थे। टोकन टेक्स्ट का एक टुकड़ा होता है, मोटे तौर पर एक शब्द या शब्द का एक हिस्सा। इसलिए “4 ट्रिलियन टोकन” इस बात की माप है कि प्रशिक्षण के दौरान मॉडल ने कितना पढ़ा।

चयन का पूरा राज “शुरू से” (from scratch) वाले इसी शब्द में है। बहुत-सी भारतीय टीमों ने किसी विदेशी ओपन मॉडल को लेकर उसे हिंदी या तमिल टेक्स्ट पर फाइन-ट्यून किया था। बहुत कम टीमों ने बेस मॉडल खुद बनाया था, और मिशन इसी क्षमता के लिए पैसा दे रहा था।

सर्वम ने कौन-से मॉडल जारी किए हैं?

सर्वम का काम दो परिवारों में बंटता है। एक, टेक्स्ट मॉडल जो तर्क करते हैं और बातचीत करते हैं। दूसरा, आवाज और दस्तावेज वाले मॉडल, जो टेक्स्ट मॉडलों को उन लोगों के काम का बनाते हैं जो अंग्रेजी में टाइप नहीं करते। इन्हें अलग-अलग समझिए। “सर्वम के मॉडल” पर प्रश्न आम तौर पर पहले परिवार के बारे में होते हैं, जबकि सरकारी विज्ञप्तियां दूसरे परिवार पर ज्यादा बात करती हैं।

टेक्स्ट मॉडल

सबसे बड़ी घोषणा 6 मार्च 2026 को हुई, जब सर्वम ने सर्वम 30B और सर्वम 105B को ओपन-सोर्स किया। ये संख्याएं पैरामीटर की हैं, यानी मॉडल के अंदर के वे मान जिन्हें प्रशिक्षण में बदला जाता है। आम तौर पर ज्यादा पैरामीटर का मतलब ज्यादा क्षमता होता है। दोनों तर्क करने वाले मॉडल हैं, जिन्हें इंडिया एआई मिशन के तहत मिले कंप्यूट पर भारत में प्रशिक्षित किया गया। दोनों मिक्सचर-ऑफ-एक्सपर्ट्स (Mixture-of-Experts) डिजाइन इस्तेमाल करते हैं।

मिक्सचर-ऑफ-एक्सपर्ट्स जितना सुनाई देता है, उससे आसान है। एक अस्पताल सोचिए, जिसमें 128 विशेषज्ञ हैं, लेकिन हर मरीज सिर्फ उन्हीं कुछ डॉक्टरों से मिलता है जो उसकी शिकायत से जुड़े हैं। मॉडल में 128 विशेषज्ञ उप-नेटवर्क हैं, और हर टोकन के लिए उनमें से सिर्फ कुछ ही चालू होते हैं। अस्पताल वाली तस्वीर खर्च का तर्क समझाने के लिए अच्छी है, लेकिन एक जगह टूट जाती है। ये “विशेषज्ञ” हृदय रोग जैसे साफ-सुथरे विषय नहीं संभालते। वे काम का वही बंटवारा सीख लेते हैं, जो प्रशिक्षण में मदद करे। इस डिजाइन से फायदा यह है कि कुल पैरामीटर बहुत ज्यादा होते हैं, लेकिन हर शब्द पर पूरा कंप्यूट खर्च नहीं करना पड़ता।

कंपनी ने जो ब्योरा छापा, वह याद रखने लायक है:

  • सर्वम 30B को रियल-टाइम इस्तेमाल के लिए तैयार किया गया है, और यह सर्वम के बातचीत वाले एजेंट प्लेटफॉर्म को चलाता है। इसकी प्री-ट्रेनिंग करीब 16 ट्रिलियन टोकन पर हुई।
  • सर्वम 105B बड़ा, तर्क करने वाला मॉडल है। इसकी प्री-ट्रेनिंग करीब 12 ट्रिलियन टोकन पर हुई, और यह इंडस असिस्टेंट को चलाता है।
  • वेट्स खुले हैं: कोई भी इन्हें एआईकोश और हगिंग फेस से डाउनलोड करके अपने कंप्यूटर पर चला सकता है।

आवाज और दस्तावेज वाले मॉडल

फरवरी 2026 का PIB व्याख्या-पत्र इन्हीं से शुरू होता है, और सार्वजनिक सेवाओं के लिए ये ज्यादा मायने रखते हैं:

  • बुलबुल 11 भारतीय भाषाओं में 39 आवाजों के साथ टेक्स्ट को आवाज में बदलता है।
  • सारस सभी 22 अनुसूचित भाषाओं में आवाज को टेक्स्ट में बदलता है। इसमें 8 kHz वाला टेलीफोन ऑडियो और मिली-जुली भाषा वाली बोली (जैसे हिंग्लिश का कोई वाक्य) भी शामिल है।
  • सर्वम विजन 22 से ज्यादा भारतीय भाषाओं में दस्तावेज पढ़ता है, जिनमें मिली-जुली लिपियां और हाथ की लिखावट भी शामिल हैं।

टेलीफोन ऑडियो का अलग से जिक्र क्यों? क्योंकि जब कोई किसान साधारण फोन से हेल्पलाइन पर कॉल करता है, तो ठीक यही कम गुणवत्ता वाला 8 kHz सिग्नल बनता है। जो मॉडल सिर्फ साफ स्टूडियो ऑडियो पर प्रशिक्षित हो, वह इस पर फेल हो जाता है।

सर्वम का काम कहां इस्तेमाल हो रहा है?

सर्वम के पक्ष में सरकार का तर्क सार्वजनिक सेवाओं में इसके इस्तेमाल पर टिका है, और फरवरी 2026 की PIB विज्ञप्ति तीन परियोजनाओं के नाम लेती है।

  • UIDAI: UIDAI के अपने ऑन-प्रिमाइस सिस्टम के अंदर चलने वाला एक कस्टम जनरेटिव AI ढांचा। यह आधार सेवाओं में आवाज से बातचीत, धोखाधड़ी की चेतावनी और 10 भारतीय भाषाओं में मदद देता है।
  • ओडिशा: राज्य सरकार और सर्वम मिलकर 50 MW का संप्रभु AI क्षमता हब बना रहे हैं। इसके इस्तेमाल खनन, औद्योगिक सुरक्षा और ओड़िया भाषा में कौशल प्रशिक्षण में होंगे।
  • तमिलनाडु: राज्य सरकार और IIT मद्रास डिजिटल संगम विकसित कर रहे हैं। इसे संप्रभु AI रिसर्च पार्क बताया गया है, जिसका केंद्र 20 MW का डेटा सेंटर होगा।

UIDAI वाला ब्योरा सबसे ज्यादा बताता है। आधार का डेटा किसी विदेशी क्लाउड API पर नहीं भेजा जा सकता। इसलिए सिर्फ वही मॉडल फिट बैठता है, जो सरकार के नियंत्रण वाले हार्डवेयर पर चले। यह एक शर्त संप्रभु AI के तर्क को किसी भी नारे से बेहतर समझा देती है।

आम लोगों के लिए सर्वम का चेहरा इंडस है। इसे 20 फरवरी 2026 को AI इम्पैक्ट समिट वाले हफ्ते में सीमित बीटा में खोला गया। सर्वम खुद कहता है कि इंडस के पीछे का 105B मॉडल दुनिया के चैट ऐप्स चलाने वाले मॉडलों से काफी छोटा है। किसी कंपनी का अपने ही उत्पाद के बारे में ऐसा खुलकर मानना असामान्य है।

क्या सर्वम एआई सच में संप्रभु है? बहस

सर्वम उस अर्थ में संप्रभु है जो सार्वजनिक डेटा के लिए सबसे ज्यादा मायने रखता है। लेकिन उस अर्थ में संप्रभु नहीं है, जिससे हर विदेशी निर्भरता खत्म हो जाए। दोनों हिस्से सामने रखने जरूरी हैं।

इसे संप्रभु कहने के पक्ष में चार मजबूत बातें हैं:

  • प्रशिक्षण भारत में, भारतीय कंप्यूट पर हुआ, और डेटा पाइपलाइन कंपनी ने खुद बनाईं।
  • भाषाओं का दायरा उन 22 अनुसूचित भाषाओं को निशाना बनाता है, जिन्हें दुनिया के मॉडल असमान तरीके से संभालते हैं।
  • तैनाती सरकार के नियंत्रण वाले हार्डवेयर पर हो सकती है, जैसा UIDAI परियोजना दिखाती है।
  • खुले वेट्स का मतलब है कि कोई विदेशी कंपनी मॉडल को बंद नहीं कर सकती या उसकी कीमत नहीं बदल सकती।

सर्वम खुद यहां सावधानी से बात करता है। मई 2025 के अपने बयान में उसने लक्ष्य को बाकी दुनिया से अलग होने के बजाय रणनीतिक स्वायत्तता बताया। उसने वादा किया कि मिशन के तहत प्रशिक्षित मॉडल उदार लाइसेंस के साथ ओपन-सोर्स किए जाएंगे।

सीमाएं भी उतनी ही असली हैं। राष्ट्रीय कंप्यूट भंडार के GPU आयातित चिप हैं, और इसीलिए AI की कहानी भारत सेमीकंडक्टर मिशन से जुड़ी है। दूसरी सीमा पैमाने की है: सर्वम के अपने बयान के मुताबिक उसका सबसे बड़ा मॉडल उन अग्रणी सिस्टमों से छोटा है, जिनसे उसकी तुलना होती है। तीसरी चिंता यह है कि सरकारी पैसा और रियायती कंप्यूट एक निजी कंपनी को जा रहा है। ओपन-सोर्स करने की शर्त ही वह मुख्य शर्त है, जो इसका फायदा जनता के पास रखती है।

एक घटना दिखाती है कि “संप्रभु” शब्द को सावधानी से क्यों बरतना चाहिए। मई 2025 में सर्वम ने सर्वम-M जारी किया। यह तर्क करने वाला मॉडल था, जिसे मिस्ट्रल स्मॉल की पोस्ट-ट्रेनिंग करके बनाया गया था। मिस्ट्रल स्मॉल 24 बिलियन पैरामीटर वाला एक फ्रांसीसी ओपन मॉडल है। यह एक जायज शोध रिलीज थी, लेकिन यह शुरू से बना भारतीय बेस मॉडल नहीं था। 2026 के 30B और 105B मॉडल ऐसे ही मॉडल हैं। जब किसी मॉडल को भारतीय कहा जाए, तो पहला सवाल यह पूछिए कि उसे शुरू से प्रशिक्षित किया गया या किसी और के बेस मॉडल से ढाला गया।

संतुलित नजरिया यह है कि भारत विदेशी मॉडलों को ढालने से आगे बढ़कर मझोले आकार के अपने मॉडल प्रशिक्षित करने तक पहुंच गया है, और यह असली प्रगति है। लेकिन हार्डवेयर और सबसे अग्रणी स्तर अभी पहुंच से बाहर हैं। न जीत का ढोल पीटने वाला रूप तथ्यों के सामने टिकता है, न सब कुछ खारिज करने वाला रूप।

आज सर्वम एआई

अक्टूबर 2026 तक सर्वम एआई इंडिया एआई मिशन में पैसा पाने वाला भागीदार है, जिसके ओपन-वेट मॉडल लोग इस्तेमाल कर रहे हैं। तारीखों के साथ पड़ाव इस तरह हैं:

  • अप्रैल 2025: संप्रभु LLM तंत्र बनाने की मंजूरी।
  • फरवरी 2026: नई दिल्ली में AI इम्पैक्ट समिट 2026 में सर्वम के मॉडल लॉन्च हुए। 13 मार्च 2026 के एक PIB जवाब के मुताबिक, इनके साथ भारतजेन, ज्ञानी और सॉकेट के मॉडल भी लॉन्च हुए।
  • 6 मार्च 2026: सर्वम 30B और 105B ओपन-सोर्स किए गए।

मार्च 2026 के उसी जवाब में बताया गया कि कंप्यूट भंडार 14 सेवा प्रदाताओं के जरिए 38,000 से ज्यादा GPU तक पहुंच गया है, और 20,000 और जोड़े जा रहे हैं। रुझान देखना हो तो इंडिया एआई मिशन की दिसंबर 2025 की स्थिति में पहले के आंकड़े हैं। सर्वम ने कहा है कि वह आगे और बड़े मॉडल प्रशिक्षित करना चाहता है, जिनमें कोडिंग और मल्टीमोडल बातचीत के लिए खास मॉडल भी होंगे। जब तक ये जारी न हों, इन्हें योजना ही मानिए।

परीक्षा के लिए सर्वम एआई कैसे पढ़ें

सर्वम GS पेपर III में विज्ञान और प्रौद्योगिकी, प्रौद्योगिकी के स्वदेशीकरण और IT के तहत आता है। डिजिटल सार्वजनिक सेवाओं के जरिए GS पेपर II में शासन से भी इसका संबंध है। बड़ा ढांचा भारत में आर्टिफिशियल इंटेलिजेंस और बड़े भाषा मॉडल कैसे काम करते हैं, यह है। इसलिए पहले उन्हें पढ़िए, और सर्वम को हल किए गए उदाहरण की तरह देखिए।

यह विषय AI नीति और उसके इस्तेमाल के जरिए पूछा जाता है, कंपनी की छोटी-मोटी जानकारी के जरिए नहीं। मुख्य परीक्षा 2026, GS पेपर III में पूछा गया: “एजेंटिक आर्टिफिशियल इंटेलिजेंस (AI) क्या है? इसकी कार्यप्रणाली समझाइए। उपयुक्त उदाहरणों के साथ इसके अनुप्रयोगों का वर्णन कीजिए। एजेंटिक AI प्रणालियों से जुड़े फायदों, जोखिमों और चुनौतियों की चर्चा कीजिए।” सर्वम का उदाहरण इसके अनुप्रयोग और जोखिम वाले हिस्सों में आसानी से फिट होता है।

मुख्य परीक्षा 2023, GS पेपर III में उम्मीदवारों से कहा गया: “आर्टिफिशियल इंटेलिजेंस (AI) की अवधारणा का परिचय दीजिए। AI नैदानिक निदान में कैसे मदद करता है? क्या आपको स्वास्थ्य सेवा में AI के इस्तेमाल से व्यक्ति की निजता के लिए कोई खतरा दिखता है?” यहां UIDAI का ऑन-प्रिमाइस मॉडल निजता को सुरक्षित रखने वाली तैनाती का तैयार उदाहरण है। प्रीलिम्स की तरफ, प्रीलिम्स प्रश्न बैंक के 1,403 प्रश्नों में से 192 विज्ञान और प्रौद्योगिकी के हैं, और AI से जुड़ी योजनाएं स्वाभाविक निशाना हैं।

दोहराने के लिए तथ्य:

  • इंडिया एआई मिशन: मार्च 2024 में मंजूरी, पांच साल में ₹10,371.92 करोड़, सात स्तंभ।
  • 500 से ज्यादा प्रस्तावों में से 12 फाउंडेशन मॉडल टीमें चुनी गईं; सर्वम को अप्रैल 2025 में मंजूरी।
  • सर्वम को मदद: ₹246.72 करोड़ की वित्तीय और कंप्यूट सहायता।
  • सर्वम 30B और 105B: मिक्सचर-ऑफ-एक्सपर्ट्स, 128 विशेषज्ञ, भारत में शुरू से प्रशिक्षित, 6 मार्च 2026 को ओपन-सोर्स।
  • बुलबुल टेक्स्ट से आवाज बनाता है; सारस आवाज से टेक्स्ट बनाता है (सभी 22 अनुसूचित भाषाएं)।
  • कंप्यूट भंडार: करीब ₹65 प्रति घंटा पर 38,000 से ज्यादा GPU।
  • इंडस 105B मॉडल पर चलने वाला आम लोगों का असिस्टेंट है।

आम उलझनें एक बार नाम लेने पर आसानी से सुलझ जाती हैं। सर्वम एक निजी कंपनी है। भारतजेन IIT बॉम्बे के नेतृत्व वाला, सरकारी पैसे से चलने वाला कंसोर्टियम है। भाषिणी MeitY का भाषा-अनुवाद प्लेटफॉर्म है, फाउंडेशन मॉडल बनाने वाला नहीं। और बुलबुल और सारस लगातार आपस में बदल दिए जाते हैं। याद रखिए: बुलबुल, गाने वाली चिड़िया, बोलती है; सारस सुनता है।

पहलकौन चलाता हैक्या करती है
सर्वम एआईनिजी कंपनी, बेंगलुरुफाउंडेशन मॉडल (30B, 105B), आवाज और दस्तावेज वाले मॉडल
भारतजेनIIT बॉम्बे के नेतृत्व वाला कंसोर्टियम, सरकारी पैसे सेइंडिया एआई मिशन के तहत भारतीय भाषाओं के मल्टीमोडल मॉडल
भाषिणीMeitYभारतीय भाषाओं के लिए अनुवाद और आवाज का प्लेटफॉर्म
एआईकोशइंडिया एआई मिशनडेटासेट और मॉडल रखने वाला सार्वजनिक प्लेटफॉर्म, जिसमें सर्वम के मॉडल भी हैं

आपकी तैयारी के लिए सर्वम रटने वाला तथ्य कम, अपना बनाने वाला तर्क ज्यादा है। अगर आप समझा सकें कि “शुरू से प्रशिक्षित” होना क्यों मायने रखता है, ऑन-प्रिमाइस मॉडल आधार के लिए क्यों ठीक है, और आयातित चिप वाली सीमा कहां चुभती है, तो आप संप्रभु AI पर लगभग किसी भी प्रश्न का जवाब एक आम पैराग्राफ के बजाय ठोस भारतीय उदाहरण के साथ दे सकेंगे।

सामान्य प्रश्न

सर्वम एआई क्या है?

सर्वम एआई बेंगलुरु की एक निजी कंपनी है, जो भारतीय भाषाओं के लिए बड़े भाषा मॉडल और आवाज वाले मॉडल बनाती है। इसकी कानूनी इकाई एक्सोनवाइज प्राइवेट लिमिटेड है, और इसके सह-संस्थापक विवेक राघवन और प्रत्युष कुमार हैं। यह इंडिया एआई मिशन के तहत फाउंडेशन मॉडल बना रही 12 टीमों में से एक है।

क्या सर्वम एआई सरकारी कंपनी है?

नहीं। सर्वम एआई एक निजी स्टार्टअप है। इसे इंडिया एआई मिशन, जो एक प्रतिस्पर्धी सरकारी योजना है, के तहत ₹246.72 करोड़ की वित्तीय और कंप्यूट सहायता मिलती है, और मिशन के तहत प्रशिक्षित मॉडलों को ओपन-सोर्स के रूप में जारी किया जाना है।

सर्वम एआई को इंडिया एआई मिशन के तहत कब चुना गया?

सर्वम एआई को अप्रैल 2025 में भारत का संप्रभु बड़ा भाषा मॉडल तंत्र बनाने की मंजूरी मिली। यह 500 से ज्यादा प्रस्तावों में से चुनी गई 12 फाउंडेशन मॉडल टीमों में से एक है।

सर्वम 30B और सर्वम 105B क्या हैं?

ये तर्क करने वाले मॉडल हैं, जिन्हें सर्वम ने भारत में शुरू से प्रशिक्षित किया और 6 मार्च 2026 को ओपन-सोर्स किया। दोनों 128 विशेषज्ञ उप-नेटवर्क वाला मिक्सचर-ऑफ-एक्सपर्ट्स डिजाइन इस्तेमाल करते हैं। 30B मॉडल रियल-टाइम बातचीत के लिए तैयार किया गया है, और 105B मॉडल इंडस असिस्टेंट को चलाता है।

बुलबुल और सारस में क्या अंतर है?

बुलबुल सर्वम का टेक्स्ट से आवाज बनाने वाला मॉडल है, जो 11 भारतीय भाषाओं में 39 आवाजों के साथ मिलता है। सारस इसका आवाज से टेक्स्ट बनाने वाला मॉडल है, जो सभी 22 अनुसूचित भाषाओं को कवर करता है, जिसमें टेलीफोन जैसी गुणवत्ता वाला ऑडियो और मिली-जुली भाषा वाली बोली भी शामिल है।

सर्वम एआई को संप्रभु AI मॉडल क्यों कहा जाता है?

इसके मुख्य मॉडल भारत में, भारतीय कंप्यूट पर, कंपनी की अपनी डेटा पाइपलाइन के साथ प्रशिक्षित हुए, और इनके वेट्स खुले हैं, इसलिए ये सरकार के नियंत्रण वाले हार्डवेयर पर चल सकते हैं। इस दावे की सीमाएं हैं, क्योंकि प्रशिक्षण में इस्तेमाल GPU आयातित हैं और ये मॉडल दुनिया के अग्रणी सिस्टमों से छोटे हैं।

सर्वम एआई का इंडस क्या है?

इंडस सर्वम का AI असिस्टेंट है, जिसे 20 फरवरी 2026 को सीमित बीटा में खोला गया। यह सर्वम 105B मॉडल पर चलता है, और इसका निशाना तर्क वाले काम और भारतीय संदर्भ में इस्तेमाल है।

सर्वम एआई भाषिणी से कैसे अलग है?

सर्वम एआई एक निजी कंपनी है, जो फाउंडेशन मॉडल प्रशिक्षित करती है। भाषिणी MeitY का एक प्लेटफॉर्म है, जो भारतीय भाषाओं में अनुवाद और आवाज के औजार देता है। दोनों साथ काम कर सकते हैं, लेकिन एक मॉडल बनाता है, जबकि दूसरा सरकारी सेवा की एक परत है।

अभ्यास प्रश्न

प्रीलिम्स MCQ

1. इंडिया एआई मिशन के बारे में निम्नलिखित कथनों पर विचार कीजिए: 1. केंद्रीय कैबिनेट ने इसे मार्च 2024 में ₹10,000 करोड़ से ज्यादा के खर्च के साथ मंजूरी दी। 2. इसके फाउंडेशन मॉडल स्तंभ ने भारत के सभी स्वदेशी मॉडल बनाने के लिए सिर्फ एक कंपनी, सर्वम एआई, को चुना। ऊपर दिए गए कथनों में से कौन-सा/से सही है/हैं?

  • (a) केवल 1
  • (b) केवल 2
  • (c) 1 और 2 दोनों
  • (d) न तो 1 और न ही 2

उत्तर: (a) खर्च ₹10,371.92 करोड़ है; फाउंडेशन मॉडल स्तंभ के तहत एक नहीं, 12 टीमें चुनी गईं।

2. सर्वम एआई के मॉडलों के बारे में निम्नलिखित कथनों पर विचार कीजिए: 1. सारस आवाज से टेक्स्ट बनाने वाला मॉडल है, जो सभी 22 अनुसूचित भाषाओं को कवर करता है। 2. बुलबुल हाथ से लिखे टेक्स्ट के लिए दस्तावेज समझने वाला मॉडल है। ऊपर दिए गए कथनों में से कौन-सा/से सही है/हैं?

  • (a) केवल 1
  • (b) केवल 2
  • (c) 1 और 2 दोनों
  • (d) न तो 1 और न ही 2

उत्तर: (a) बुलबुल टेक्स्ट से आवाज बनाने वाला मॉडल है; दस्तावेज समझने का काम सर्वम विजन करता है।

3. सर्वम 105B जैसे AI मॉडलों के संदर्भ में ‘मिक्सचर-ऑफ-एक्सपर्ट्स’ शब्द का मतलब है:

  • (a) इंसानी समीक्षकों का एक पैनल, जो मॉडल के हर जवाब की जांच करता है
  • (b) एक ढांचा, जिसमें हर टोकन के लिए कई उप-नेटवर्क में से सिर्फ कुछ ही चालू होते हैं
  • (c) कई कंपनियों के मॉडलों को मिलाकर एक उत्पाद बनाने का तरीका
  • (d) एक लाइसेंस नियम, जिसके तहत वेट्स जारी करने से पहले विशेषज्ञ की मंजूरी जरूरी है

उत्तर: (b) मिक्सचर-ऑफ-एक्सपर्ट्स हर टोकन को विशेषज्ञ उप-नेटवर्कों के एक छोटे हिस्से तक भेजता है, जिससे हर टोकन पर कंप्यूट कम रहता है।

4. निम्नलिखित में से किसे इंडिया एआई मिशन डेटासेट और AI मॉडलों के राष्ट्रीय प्लेटफॉर्म के रूप में चलाता है?

  • (a) भाषिणी
  • (b) एआईकोश
  • (c) ऐरावत
  • (d) आईगॉट कर्मयोगी

उत्तर: (b) एआईकोश इंडिया एआई का डेटासेट और मॉडल प्लेटफॉर्म है; सर्वम के 30B और 105B के वेट्स इस पर उपलब्ध हैं।

5. निम्नलिखित युग्मों पर विचार कीजिए: 1. भारतजेन: IIT बॉम्बे के नेतृत्व वाला कंसोर्टियम। 2. सर्वम एआई: बेंगलुरु की निजी कंपनी। 3. भाषिणी: सर्वम एआई का बनाया फाउंडेशन मॉडल। ऊपर दिए गए युग्मों में से कितने सही सुमेलित हैं?

  • (a) केवल एक
  • (b) केवल दो
  • (c) तीनों
  • (d) कोई नहीं

उत्तर: (b) भाषिणी MeitY का भाषा-अनुवाद प्लेटफॉर्म है, सर्वम का मॉडल नहीं।

मुख्य परीक्षा प्रश्न

  1. ‘संप्रभु’ फाउंडेशन मॉडल से आप क्या समझते हैं? सर्वम एआई के उदाहरण से परीक्षण कीजिए कि भारत की AI कोशिशों ने किस हद तक तकनीकी संप्रभुता हासिल की है। (15 अंक, 250 शब्द)
  2. एजेंटिक आर्टिफिशियल इंटेलिजेंस (AI) क्या है? इसकी कार्यप्रणाली समझाइए। उपयुक्त उदाहरणों के साथ इसके अनुप्रयोगों का वर्णन कीजिए। एजेंटिक AI प्रणालियों से जुड़े फायदों, जोखिमों और चुनौतियों की चर्चा कीजिए। (15 अंक, 250 शब्द) पिछले वर्ष का प्रश्न: मुख्य परीक्षा 2026, GS पेपर III।
  3. भारतीय AI स्टार्टअप के लिए प्रवेश की बाधाएं घटाने में इंडिया एआई मिशन के तहत साझा कंप्यूट ढांचे की भूमिका की चर्चा कीजिए। इसकी सीमाएं क्या हैं? (10 अंक, 150 शब्द)
  4. भारतीय भाषाओं के आवाज और दस्तावेज वाले मॉडल सार्वजनिक सेवाओं तक पहुंच बढ़ा सकते हैं। उदाहरणों के साथ परीक्षण कीजिए, और बताइए कि ऐसी तैनाती के लिए निजता के कौन-से सुरक्षा उपाय जरूरी हैं। (10 अंक, 150 शब्द)
  5. राष्ट्रीय AI मॉडल बनाने के लिए निजी कंपनियों को सरकारी पैसा और रियायती कंप्यूट दिया जा रहा है। भारत में डिजिटल सार्वजनिक वस्तुएं बनाने के इस तरीके का आलोचनात्मक मूल्यांकन कीजिए। (15 अंक, 250 शब्द)

Share this

PDF

Written by

Adhar Sharma Sir

Adhar Sharma covers Environment, Ecology and Anthropology at Anantam IAS. He writes the ecology and biodiversity notes, tracks wildlife and wetland policy as it moves, and turns Anthropology optional material into notes that work for GS I society questions too.

UPSC की तैयारी हिंदी माध्यम में — एक निशुल्क डेमो क्लास

न कोई सेल्स कॉल, न कोई ब्रोशर। सोमवार सुबह की असली GS क्लास देखिए — हमारे अनुभवी शिक्षकों के साथ।