चित्रण: tuput
मराठी
सर्वमने १५ जून २०२६ रोजी २३४ दशलक्ष डॉलर जमा केले आणि डाउनलोड करता येणारे वेट असलेली ३० अब्ज आणि १०५ अब्ज पॅरामीटरची मॉडेल प्रसिद्ध केली. ज्ञानी एआयने फेब्रुवारीत ५ अब्ज पॅरामीटरचे व्हॉइस प्रिव्ह्यू दाखवले, क्रुट्रिम मे महिन्यात मॉडेलकडून क्लाउड सेवांकडे वळले, आणि सोकेट एआय किंवा गॅन एआय यांचे कोणतेही सार्वजनिक फाउंडेशन मॉडेल tuput ला आढळले नाही.
सर्वम एआयने १५ जून २०२६ रोजी जाहीर केले की त्यांनी नियोजित ३०० दशलक्ष डॉलरच्या सिरीज बीपैकी २३४ दशलक्ष डॉलर पूर्ण केले आहेत, पोस्ट-मनी मूल्यांकनावर (नव्या पैशानंतर लगेचची कंपनीची किंमत) १.५ अब्ज डॉलर. एएनआयने ६ ऑगस्ट २०२६ रोजी दिलेल्या लोकसभेतील उत्तरात सर्वम आणि ज्ञानी एआय यांच्या प्रसिद्ध झालेल्या मॉडेलांची नावे आहेत, आणि इंडियाAI मिशनअंतर्गत फाउंडेशन मॉडेल (चॅटबॉटमागची मोठी एआय मॉडेल) बांधण्यासाठी २०२५ मध्ये निवडलेल्या इतर दोन स्टार्टअप, सोकेट एआय आणि गॅन एआय, यांचे एकही नाही.
मिशनचे अंदाजपत्रक, GPU संख्या आणि निधी मिळालेल्या बारा बांधणाऱ्यांची पूर्ण यादी tuput च्या इंडियाAI मिशनवरील लेखात आहे, आणि भाषा-विशिष्ट मॉडेलांची बाजू भारत आपल्या स्वतःच्या भाषांमध्ये एआय बांधत आहे मध्ये आहे. हा लेख कंपन्यांचा पाठपुरावा करतो: कोणी किती उभारले, प्रत्येकाने काय लोकांसमोर ठेवले आणि ते कोणी मोजले.
निवडलेले चार स्टार्टअप, शेजारी शेजारी
पीआयबीचे ३० मे २०२५ चे प्रसिद्धिपत्रक म्हणते की सर्वमची निवड २६ एप्रिल २०२५ रोजी १२० अब्ज पॅरामीटरचे ओपन-सोर्स मॉडेल बांधण्यासाठी झाली. पॅरामीटर म्हणजे मॉडेलच्या आतील समायोजित करता येणारे आकडे, आकाराचे ढोबळ मोजमाप. त्याच प्रसिद्धिपत्रकाने आणखी तीन स्टार्टअपची घोषणा केली, सोकेट एआय, ज्ञानी एआय आणि गॅन एआय. सरकारने १३ फेब्रुवारी २०२६ रोजी राज्यसभेत मांडलेल्या परिशिष्टात प्रत्येकाला मिळालेले सहाय्य दिले आहे.
| स्टार्टअप | नोंदवलेले सहाय्य (कोटी रुपये) | मे २०२५ मध्ये नाव दिलेले मॉडेल | ८ ऑक्टोबर २०२६ पर्यंत सार्वजनिक |
|---|---|---|---|
| सर्वम एआय | २४६.७२ | १२० अब्जाचे खुले मॉडेल | ६ मार्च २०२६ रोजी ३० अब्ज आणि १०५ अब्जाची मॉडेल |
| ज्ञानी एआय | १७७.२७ | १४ अब्जाचे व्हॉइस मॉडेल | फेब्रुवारी २०२६ मधील ५ अब्जाचे व्हॉइस-टू-व्हॉइस संशोधन प्रिव्ह्यू |
| सोकेट एआय | १७७.०८ | १२० अब्जाचे खुले मॉडेल | फाउंडेशन मॉडेल आढळले नाही; प्रीट्रेनिंग डेटासेट खुला आहे |
| गॅन एआय | ११०.०३ | टेक्स्ट-टू-स्पीचसाठी ७० अब्जाचे बहुभाषिक मॉडेल | काहीही आढळले नाही |
tuput च्या बेरजेनुसार चारांची एकूण रक्कम ७११.१० कोटी रुपये होते. सरकार म्हणते की संघ वापरत असलेल्या कॉम्प्युटचा प्रत्यक्ष खर्च ते भरते आणि डेटासेट व कर्मचाऱ्यांसाठी आणखी २५ टक्के बाजूला ठेवते. परिशिष्टात सर्वम किंवा ज्ञानी एआयसाठी कॉम्प्युट-व्यतिरिक्त कोणताही पैसा दिसत नाही.
सर्वम: जाहीर केलेला ३४९ दशलक्ष डॉलरचा निधी
सर्वमचा पहिला पैसा, सीड आणि सिरीज एमध्ये मिळून ४१ दशलक्ष डॉलर, डिसेंबर २०२३ मध्ये नोंदवला गेला. जून २०२६ मध्ये एचसीएलटेकने प्रमुख धोरणात्मक गुंतवणूकदार म्हणून १५० दशलक्ष डॉलर घातले, बेसेमर व्हेंचर पार्टनर्स सामील झाले, आणि खोसला व्हेंचर्स व पीक एक्सव्ही पार्टनर्स कायम राहिले. सर्वम म्हणते की हा निधी त्यांच्या पुढील मॉडेलवरील संशोधनासाठी जाईल, ज्याचे लक्ष्य एजंटिक, कोडिंग आणि सायबरसुरक्षा वापर आहे, तसेच कॉम्प्युट आणि ग्राहक कंपन्यांच्या आत ठेवलेल्या कामासाठी.
एन्ट्रॅकरने ३ ऑगस्ट २०२६ रोजी, रजिस्ट्रार ऑफ कंपनीजकडील एका दाखल कागदपत्रावरून, सुमारे ६९८ कोटी रुपयांच्या (७४ दशलक्ष डॉलर) विस्ताराची नोंद केली, ज्याचे नेतृत्व एनव्हिडियाने २३८ कोटी रुपयांनी (२५ दशलक्ष डॉलर) केले, आणि ग्लेड ब्रुक कॅपिटलने १९०.३ कोटी रुपयांनी (२० दशलक्ष डॉलर). एन्ट्रॅकर मूल्यांकन १.५१ अब्ज डॉलर सांगते आणि म्हणते की एनव्हिडियाकडे १.६६ टक्के आणि एचसीएलटेककडे ९.९५ टक्के हिस्सा असेल. विस्तारावर सर्वमचे कोणतेही विधान tuput ला आढळले नाही. २०२३ चा पैसा, जूनमधील पूर्तता आणि नोंदवलेला विस्तार मिळून ३४९ दशलक्ष डॉलर होतात.
सर्वमची स्वतःची वापराची आकडेवारी अशी आहे: दिवसाला १ कोटी एपीआय कॉल, महिन्याला ५ लाख तासांपेक्षा जास्त ऑडिओचे लिप्यंतर करणारी भाषण मॉडेल, आणि त्यांच्या संवादी व्यासपीठावर दिवसाला २० लाखांहून अधिक संवाद. टेकक्रंचने ती पुन्हा सांगितली आणि कोणतेही महसुलाचे आकडे जाहीर झाले नसल्याचे नोंदवले.
सर्वमने काय प्रसिद्ध केले, आणि गुण कोणी लावले
सर्वमच्या ६ मार्च २०२६ च्या पोस्टने ३० अब्ज आणि १०५ अब्ज पॅरामीटरच्या मॉडेलांची घोषणा केली. दोन्ही मिक्स्चर-ऑफ-एक्स्पर्ट्स रचनेची आहेत, म्हणजे प्रत्येक शब्दासाठी जाळ्याचा फक्त एक भाग चालतो. ३० अब्जाच्या मॉडेलमध्ये २.४ अब्ज सक्रिय पॅरामीटर आहेत, आणि १०५ अब्जाच्या मॉडेल कार्डनुसार १०.३ अब्ज. पोस्ट म्हणते की दोन्ही भारतात इंडियाAI कॉम्प्युटवर, अनुक्रमे १६ ट्रिलियन आणि १२ ट्रिलियन टोकनवर प्रशिक्षित झाली, आणि वेट्स सरकारचे मॉडेल व डेटासेट व्यासपीठ एआयकोश आणि हगिंग फेसवर अपाचे २.० परवान्याखाली आहेत. खुले वेट्स म्हणजे कोणीही प्रशिक्षित आकडे डाउनलोड करून चालवू शकतो. सर्वमची निवड ज्या मॉडेलसाठी झाली ते १२० अब्ज पॅरामीटरचे होते, आणि त्यांनी प्रसिद्ध केलेले १०५ अब्जाचे आहे.
मॉडेल कार्डवर सर्वम १०५ अब्जाच्या मॉडेलची तुलना GLM-4.5-Air, gpt-oss-120B आणि Qwen3-Next-80B शी करते. वेब-संशोधन चाचणी ब्राउझकॉम्पवर ते ४९.५ गुणांवर पुढे आहे, त्यातल्या दोघांच्या २१.३ आणि ३८.० च्या तुलनेत. सॉफ्टवेअर-दुरुस्ती चाचणी SWE-Bench Verified वर ते ४५.० वर मागे आहे, तर इतरांचे ५७.६, ५०.६ आणि ६०.९ आहेत. चाचण्या कोणी चालवल्या हे कार्ड सांगत नाही. भारतीय भाषांच्या बेंचमार्कचे मूल्यमापन जेमिनी ३ ने केले, असे ब्लॉग म्हणतो.
बाहेरच्या मोजणाऱ्या आर्टिफिशियल अॅनालिसिसने २ एप्रिल २०२६ रोजी १०५ अब्जाच्या मॉडेलला १८ चा इंटेलिजन्स इंडेक्स दिला, gpt-oss-120B च्या ३३ मागे, आणि दोन्ही मॉडेल नाकारण्यापेक्षा अंदाज जास्त बांधतात असे म्हटले. तो निकाल इंडियाAI लेखात आला आहे, आणि सर्वमचे भाषणाचे गुण आवाज आणि भाषांतर मॉडेलांच्या आढाव्यात आहेत.
ज्ञानी एआय: ५ अब्ज पॅरामीटरचे प्रिव्ह्यू आणि प्रसिद्ध न झालेला गुण
पीआयबीच्या मे २०२५ च्या प्रसिद्धिपत्रकात म्हटले होते की ज्ञानी एआय १४ अब्ज पॅरामीटरचे व्हॉइस मॉडेल बांधेल. फेब्रुवारी २०२६ मध्ये इंडिया एआय इम्पॅक्ट समिटमध्ये त्यांनी इन्या व्हॉइसओएस दाखवले, ५ अब्ज पॅरामीटरचे मॉडेल जे मध्ये मजकुराची पायरी न घेता भाषण घेते आणि भाषण देते. १९ फेब्रुवारीला वृत्त देणारे ओपन सोर्स फॉर यू त्याला नियोजित १४ अब्जाच्या मॉडेलच्या आधी येणारे संशोधन प्रिव्ह्यू म्हणते. लेख प्रीट्रेनिंगमध्ये १.४ कोटी तासांहून अधिक भाषण, १५ हून अधिक भारतीय भाषा, एका सेकंदापेक्षा कमी प्रतिसाद वेळ आणि २४ kHz ऑडिओ आउटपुट देतो. त्यात कोणताही बेंचमार्क, परवाना किंवा उपलब्धता दिलेली नाही, आणि ज्ञानी एआयचे मुख्य कार्यकारी अधिकारी भाषण-ते-मजकूर-मग-मजकूर-ते-भाषण या जुन्या साखळ्यांपेक्षा चांगल्या अचूकतेचा दावा करताना उद्धृत आहेत, कोणत्याही आकड्याविना. १४ अब्जाचे मॉडेल प्रसिद्ध झाल्याचे कोणतेही वृत्त tuput ला आढळले नाही.
ज्ञानी एआयचे वाचना (Vachana) भाषण-ते-मजकूर मॉडेल, जे इंक४२ नुसार १० लाख तासांहून अधिक आवाजाच्या डेटावर प्रशिक्षित आहे, हे वेगळे उत्पादन आहे. पैशाबद्दल, इंक४२ ने ३१ मार्च २०२६ रोजी आविष्कार कॅपिटलच्या नेतृत्वाखालील १० दशलक्ष डॉलरच्या (सुमारे ९४ कोटी रुपये) सिरीज बीची नोंद केली, ज्यात इन्फो एज व्हेंचर्सही आहे, आणि कंपनी २०० हून अधिक उद्योग ग्राहक असल्याचा दावा करते.
क्रुट्रिम: कार्यक्रमाबाहेर, आणि मॉडेलच्या शर्यतीबाहेर
पीआयबीच्या बारांच्या यादीत ओलाचे भाविश अगरवाल यांनी स्थापन केलेली एआय कंपनी क्रुट्रिम किंवा कोरोव्हर नाहीत. क्रुट्रिमने जानेवारी २०२४ मध्ये १ अब्ज डॉलर मूल्यांकनावर ५० दशलक्ष डॉलर उभारले. मीडियानामाने ६ फेब्रुवारी २०२५ रोजी वृत्त दिले की त्यांनी १२ अब्ज पॅरामीटरचे मॉडेल क्रुट्रिम-२ सुरू केले, आणि ओलाने एआय लॅबमध्ये २,००० कोटी रुपयांच्या (सुमारे २३० दशलक्ष डॉलर) गुंतवणुकीची घोषणा केली.
मॉडेल कार्ड म्हणते की क्रुट्रिम-२ मिस्ट्रलच्या NeMo रचनेवर बांधलेले आहे, १,२८,००० टोकनची संदर्भ खिडकी असलेले, अपाचेऐवजी क्रुट्रिम कम्युनिटी लायसन्सखाली. क्रुट्रिमने एलएम इव्हॅल्युएशन हार्नेस वापरून स्वतःच्या चाचण्या चालवल्या. सामान्य ज्ञानाची परीक्षा MMLU वर त्याने ०.६३ मिळवले, मिस्ट्रलच्या NeMo इन्स्ट्रक्टच्या ०.६८ विरुद्ध, आणि IndicSentiment वर ०.९५, ०.७० विरुद्ध.
५ मे २०२६ रोजी टेकक्रंचने वृत्त दिले की क्रुट्रिम मॉडेल विकासाकडून क्लाउड सेवांकडे वळत आहे. क्रुती असिस्टंट अॅप एप्रिलमध्ये अॅप स्टोअरमधून काढले गेले होते, २०२५ च्या अखेरच्या पुनर्रचनेत चिप डिझाइन थांबवले गेले, आणि स्थानिक माध्यमांनी २०० हून अधिक पदे कमी केल्याचे वृत्त दिले होते. क्रुट्रिमने आर्थिक वर्ष २०२६ चा सुमारे ३०० कोटी रुपयांचा महसूल आणि पहिला वार्षिक निव्वळ नफा नोंदवला. आर्थिक वर्ष २०२५ च्या महसुलापैकी सुमारे ९० टक्के समूहातील कंपन्यांकडून आला होता, असे आधीच्या वृत्तांनी म्हटले, आणि क्रुट्रिमने आर्थिक वर्ष २०२६ ची विभागणी जाहीर केली नाही. ग्रेहाउंड रिसर्चचे विश्लेषक संचित वीर गोगिया यांनी टेकक्रंचला सांगितले की “दाव्यानुसार पुराव्याचा दर्जा वाढायला हवा.”
कोरोव्हर: त्याच्या लेखकांनी स्वतः चालवलेला गुण
भारतजीपीटी बनवणारी कोरोव्हर.एआय पीआयबीच्या यादीतही नाही. गुगलने १६ डिसेंबर २०२५ रोजी सांगितले की ते कोरोव्हर आणि ज्ञानी एआयसह स्टार्टअपना प्रत्येकी ५०,००० डॉलर देत आहे, आणि ते भाषण व ई-शासन मॉडेलांसाठी गुगलची जेम्मा खुली मॉडेल वापरत आहेत.
२४ एप्रिल २०२६ रोजी कोरोव्हरने भारतजीपीटी मिनीचे निकाल प्रसिद्ध केले, जे ०.५ अब्ज पॅरामीटरचे मॉडेल आहे आणि जीपीयूशिवाय उपकरणावर चालते. ते मिनीसाठी ६४.६ आणि सर्वम ३०B साठी १.७ अशी कार्यक्षमता निर्देशांक नोंदवते. पान निर्देशांकाची व्याख्या सरासरी बेंचमार्क गुण भागिले पॅरामीटर संख्या अशी करते, म्हणजे लहान मॉडेलला रचनेनेच मोठा आकडा मिळतो. पोस्ट आपल्या बेंचमार्कला स्वतंत्र म्हणते, तर त्याची अस्वीकृती म्हणते की गुण लेखकांच्या स्वतःच्या मूल्यमापन फेऱ्यांचे आहेत.
गॅन एआय आणि सोकेट एआय: मंजूर पैसा, मॉडेल अजून यायची आहेत
गॅन एआयची स्थापना २०२१ मध्ये झाली आणि ती वैयक्तिक व्हिडिओ विकते. टेकस्टार्टअप्सने मे २०२३ मध्ये सर्ज आणि सिक्वोया कॅपिटल इंडियाच्या नेतृत्वाखालील ५.२५ दशलक्ष डॉलरच्या सीड फेरीची नोंद केली. मिशनचे सहाय्य ११०.०३ कोटी रुपये आहे, त्यापैकी ८८.०२ कोटी रुपये कॉम्प्युटसाठी, टेक्स्ट-टू-स्पीचकडे लक्ष असलेल्या ७० अब्ज पॅरामीटरच्या मॉडेलसाठी. गॅन एआय लोकसभेच्या उत्तरातील प्रसिद्ध मॉडेलांमध्ये नाही, आणि tuput ला कोणतेही प्रसिद्ध मॉडेल किंवा नंतरचे निधीचे वृत्त आढळले नाही.
सोकेट एआयकडे १७७.०८ कोटी रुपयांचे सहाय्य आहे, त्यापैकी १६२.४७ कोटी रुपये कॉम्प्युटसाठी. इंक४२ ने २२ जुलै २०२६ रोजी वृत्त दिले की रचना सिद्ध करण्यासाठीचे २४ अब्ज पॅरामीटरचे मॉडेल २०२६ च्या अखेरपर्यंत अपेक्षित आहे आणि ते आधी उद्योगातील भागीदारांच्या छोट्या गटाला जाईल. १२० अब्ज पॅरामीटरचे मॉडेल २०२७ मध्ये येईल, आणि दोन्ही ओपन-सोर्स करण्याचा हेतू आहे. सोकेटने भारतीय भाषांचा प्रीट्रेनिंग डेटासेट प्रसिद्ध केला आहे, महसूल जाहीर केलेला नाही, आणि न सांगितलेल्या रकमेचा पैसा उभारण्याच्या प्रयत्नात आहे. त्यांचे संस्थापक अभिषेक उपरवाल यांनी इंक४२ ला सांगितले, “आम्हाला आधी संशोधनाच्या आघाडीवर काहीतरी अप्रतिम काम करायचे आहे.” इंक४२ म्हणते की व्यावसायिक वापर २०२७ मध्ये हळूहळू सुरू व्हायला हवा.
स्रोत आणि पुढील वाचन
- PIB: India's common compute capacity crosses 34,000 GPUs; three more startups to build foundation models (30 May 2025)
- PIB: In less than 24 months, India AI Mission has set up a foundation for the AI ecosystem, with Annexure I of support to model builders (13 February 2026)
- ANI: Govt backs 20 indigenous AI foundation models; 237 projects get subsidised compute support (6 August 2026)
- Sarvam AI: Sarvam raises $300M Series B (15 June 2026)
- TechCrunch: Sarvam becomes India's newest AI unicorn with $234 million funding round led by HCLTech (15 June 2026)
- Entrackr: Sarvam AI board to approve $74 million funding from Nvidia, Glade Brook and others (3 August 2026)
- Sarvam AI: Open-sourcing Sarvam 30B and 105B (6 March 2026)
- Hugging Face: sarvamai/sarvam-105b model card
- Artificial Analysis: Sarvam 105B and Sarvam 30B, India enters the open-weights race (2 April 2026)
- Open Source For You: India unveils first 5B voice AI (19 February 2026)
- Inc42: Gnani.ai raises $10 Mn to build sovereign AI voice agents (31 March 2026)
- TechCrunch: India's first GenAI unicorn shifts to cloud services as AI model ambitions face reality (5 May 2026)
- MediaNama: Ola Krutrim launches AI lab and models, mixed reactions (6 February 2025)
- Hugging Face: krutrim-ai-labs/Krutrim-2-instruct model card
- Google: Powering India's AI progress (16 December 2025)
- CoRover: Small model, big impact, BharatGPT mini 0.5B and AI efficiency (24 April 2026)
- Inc42: Soket AI wants to turn the language gap in AI into India's edge (22 July 2026)
- TechStartups: Sequoia India-backed Gan.ai raises $5.25M in funding (23 May 2023)
हा लेख AI साधनांच्या मदतीने संशोधित आणि लिहिला गेला असून अचूकतेसाठी संपादित केला आहे. हा केवळ सर्वसाधारण माहिती आणि चर्चेसाठी आहे, व्यावसायिक सल्ला नाही. आमचे संपादकीय मानक आणि अस्वीकरण पाहा. चूक आढळली? आम्हाला कळवा.
आवडलं? पुढचा लेख मिळवा.
एका वेळी एक चांगला लेख, थेट तुमच्या इनबॉक्समध्ये. स्पॅम नाही, हवं तेव्हा थांबवा.