插图:tuput
中文
Sarvam在2026年6月15日完成2.34亿美元融资,并发布了可下载权重的300亿和1050亿参数模型。Gnani.ai在2月展示了一个50亿参数的语音预览版,Krutrim在5月从模型转向云服务,而tuput没有发现Soket AI或Gan.ai有任何公开的基础模型。
Sarvam AI在2026年6月15日宣布,计划中3亿美元的B轮融资已完成2.34亿美元,融资后估值(即新资金到位后公司的价值)为15亿美元。ANI在2026年8月6日报道了一份下议院的答复,其中列出了Sarvam和Gnani.ai的已发布模型,而另外两家2025年被选中、在印度AI使命下开发基础模型(即聊天机器人背后的大型AI模型)的初创公司Soket AI和Gan.ai,名单里一个也没有。
使命的预算、GPU数量和十二家获资助开发者的完整名单,见tuput关于印度AI使命的文章,为什么要做针对特定语言的模型,见印度正在用自己的语言构建AI。这一篇则跟着这些公司本身走:谁融到了多少钱,各家把什么拿到了公开场合,又是谁测的分。
四家被选中的初创公司,并排来看
印度新闻信息局2025年5月30日的新闻稿说,Sarvam在2025年4月26日被选中,开发一个开源的1200亿参数模型。参数是模型内部可调整的数字,大致衡量模型的规模。同一份新闻稿还宣布了另外三家初创公司:Soket AI、Gnani.ai和Gan.ai。政府2026年2月13日向联邦院提交的附件列出了各家得到的支持。
| 初创公司 | 所列支持额(亿卢比) | 2025年5月点名的模型 | 截至2026年10月8日已公开 |
|---|---|---|---|
| Sarvam AI | 24.672 | 1200亿参数开放模型 | 2026年3月6日发布300亿和1050亿参数模型 |
| Gnani.ai | 17.727 | 140亿参数语音模型 | 2026年2月的50亿参数语音到语音研究预览版 |
| Soket AI | 17.708 | 1200亿参数开放模型 | 未发现基础模型;有一个开放的预训练数据集 |
| Gan.ai | 11.003 | 用于文字转语音的700亿参数多语言模型 | 未发现任何东西 |
按tuput的加法,四家合计71.11亿卢比。政府称这笔钱覆盖团队所用算力的实际成本,另外再留出25%用于数据集和人员。附件显示,Sarvam和Gnani.ai没有算力以外的资金。
Sarvam:披露的融资共3.49亿美元
Sarvam的第一笔钱是种子轮和A轮合计4100万美元,2023年12月有过报道。2026年6月,HCLTech作为领投战略投资方投入1.5亿美元,贝塞默风险投资公司加入,Khosla Ventures和Peak XV Partners继续持有。Sarvam说,这些资金用于研发下一个模型,面向智能体、编程和网络安全用途,另外用于算力和在客户公司内部开展的工作。
Entrackr在2026年8月3日根据一份公司注册处的文件报道,有一笔约69.8亿卢比(7400万美元)的追加融资,由英伟达以23.8亿卢比(2500万美元)领投,Glade Brook Capital投入19.03亿卢比(2000万美元)。Entrackr把估值定为15.1亿美元,并说英伟达将持股1.66%,HCLTech持股9.95%。tuput没有找到Sarvam对这笔追加融资的说明。2023年的钱、6月的交割和这笔报道中的追加融资,加起来是3.49亿美元。
Sarvam自己公布的使用量是:每天1000万次API调用,语音模型每月转写超过50万小时的音频,其对话平台每天超过200万次交互。TechCrunch转述了这些数字,并指出没有披露收入数据。
Sarvam发布了什么,又是谁打的分
Sarvam在2026年3月6日的帖子里宣布了一个300亿和一个1050亿参数的模型。两个都是混合专家结构,意思是每处理一个词只有一部分网络在运行。300亿的模型使用24亿活跃参数,1050亿的模型卡则写的是103亿。帖子说,两个模型都是在印度境内用IndiaAI的算力训练的,分别用了16万亿和12万亿个词元,权重放在政府的模型和数据集平台AIKosh上,也放在Hugging Face上,采用Apache 2.0许可。开放权重意思是任何人都可以下载训练好的数字并自己运行。Sarvam当初被选中时要做的模型是1200亿参数,而它发布的这个是1050亿。
在模型卡上,Sarvam把1050亿的模型与GLM-4.5-Air、gpt-oss-120B和Qwen3-Next-80B做了比较。在网络研究测试BrowseComp上它领先,得分49.5,比其中两个的21.3和38.0高。在软件修复测试SWE-Bench Verified上它落后,得分45.0,另外几个是57.6、50.6和60.9。模型卡没有说是谁跑的测试。博客说,印度语言基准测试由Gemini 3评判。
外部测评机构Artificial Analysis在2026年4月2日给1050亿的模型打了智能指数18分,落后于33分的gpt-oss-120B,并说两个模型都更倾向于瞎猜而不是拒答。这一结果在印度AI使命那篇文章里有介绍,Sarvam的语音得分则见语音与翻译模型的综述。
Gnani.ai:一个50亿参数的预览版,没有公布的分数
印度新闻信息局2025年5月的新闻稿说,Gnani.ai将开发一个140亿参数的语音模型。2026年2月的印度AI影响力峰会上,它展示了Inya VoiceOS,一个50亿参数的模型,输入语音,输出语音,中间不经过文字这一步。《Open Source For You》在2月19日的报道称它是一个研究预览版,先于计划中的140亿模型。文章给出的数字是:预训练中超过1400万小时的语音、15种以上的印度语言、亚秒级响应时间和24 kHz的音频输出。它没有给出基准测试、许可或可获得性,Gnani.ai的首席执行官被引述称其准确度优于旧的“语音转文字再文字转语音”流程,但没有给出数字。tuput没有找到140亿模型发布的报道。
Inc42称,Gnani.ai的Vachana语音转文字模型用超过100万小时的语音数据训练而成,这是一个单独的产品。在资金方面,Inc42在2026年3月31日报道了一笔1000万美元(约9.4亿卢比)的B轮融资,由Aavishkaar Capital领投,Info Edge Ventures也参与,公司声称有200多家企业客户。
Krutrim:在使命之外,也退出了模型竞赛
印度新闻信息局的十二家名单里没有Krutrim,也没有CoRover。Krutrim是由Ola的巴维什·阿加瓦尔创办的AI公司,2024年1月以10亿美元估值融资5000万美元。MediaNama在2025年2月6日报道称,它发布了Krutrim-2,一个120亿参数的模型,Ola还宣布向一个AI实验室投资200亿卢比(约2.3亿美元)。
模型卡说,Krutrim-2建立在Mistral的NeMo架构上,上下文窗口为12.8万词元,采用Krutrim社区许可而不是Apache。Krutrim用LM Evaluation Harness自己跑了测试。在通用知识考试MMLU上得分0.63,Mistral的NeMo Instruct是0.68;在IndicSentiment上得分0.95,对方是0.70。
2026年5月5日,TechCrunch报道称,Krutrim正在从模型研发转向云服务。Kruti助手应用4月已从应用商店下架,芯片设计在2025年底的整顿中暂停,当地媒体报道裁掉了200多个岗位。Krutrim报告2026财年收入约30亿卢比,并首次实现全年净利润。据此前的报道,2025财年收入约90%来自集团内公司,Krutrim没有披露2026财年的构成。Greyhound Research的分析师桑奇特·维尔·戈吉亚对TechCrunch说,“证明的标准必须随着主张的提高而提高。”
CoRover:作者自己跑出来的分数
制作BharatGPT的CoRover.ai同样不在印度新闻信息局的名单上。谷歌在2025年12月16日说,它给包括CoRover和Gnani.ai在内的初创公司每家5万美元,它们正在用谷歌的Gemma开放模型开发语音和电子政务模型。
2026年4月24日,CoRover发布了BharatGPT mini的结果,这是一个5亿参数的模型,可以在没有GPU的设备上运行。它报告了一个效率指数,mini为64.6,Sarvam 300亿为1.7。该页面把这个指数定义为平均基准得分除以参数量,所以小模型按定义就会得到很高的数字。帖子称它的基准是独立的,而它的免责声明却说这些分数是作者自己的评测结果。
Gan.ai和Soket AI:钱已批,模型还在后面
Gan.ai成立于2021年,卖的是个性化视频。TechStartups在2023年5月报道了一轮525万美元的种子轮,由Surge和红杉资本印度基金领投。使命的支持额为11.003亿卢比,其中8.802亿卢比是算力,用于一个面向文字转语音的700亿参数模型。Gan.ai不在下议院答复所列的已发布名单里,tuput没有找到它已发布的模型或后续的融资报道。
Soket AI的支持额为17.708亿卢比,其中16.247亿卢比是算力。Inc42在2026年7月22日报道称,一个用来验证架构的240亿参数模型预计在2026年底前推出,将先提供给一小批企业合作伙伴。1200亿参数的模型将在2027年跟进,两个都打算开源。Soket已经发布了一个印度语言预训练数据集,没有披露收入,并在寻求融资,金额未披露。其创始人阿比谢克·乌珀瓦尔对Inc42说,“我们想先在研究前沿做一些了不起的工作。”Inc42说,商业部署应在2027年逐步开始。
资料来源与延伸阅读
- PIB: India's common compute capacity crosses 34,000 GPUs; three more startups to build foundation models (30 May 2025)
- PIB: In less than 24 months, India AI Mission has set up a foundation for the AI ecosystem, with Annexure I of support to model builders (13 February 2026)
- ANI: Govt backs 20 indigenous AI foundation models; 237 projects get subsidised compute support (6 August 2026)
- Sarvam AI: Sarvam raises $300M Series B (15 June 2026)
- TechCrunch: Sarvam becomes India's newest AI unicorn with $234 million funding round led by HCLTech (15 June 2026)
- Entrackr: Sarvam AI board to approve $74 million funding from Nvidia, Glade Brook and others (3 August 2026)
- Sarvam AI: Open-sourcing Sarvam 30B and 105B (6 March 2026)
- Hugging Face: sarvamai/sarvam-105b model card
- Artificial Analysis: Sarvam 105B and Sarvam 30B, India enters the open-weights race (2 April 2026)
- Open Source For You: India unveils first 5B voice AI (19 February 2026)
- Inc42: Gnani.ai raises $10 Mn to build sovereign AI voice agents (31 March 2026)
- TechCrunch: India's first GenAI unicorn shifts to cloud services as AI model ambitions face reality (5 May 2026)
- MediaNama: Ola Krutrim launches AI lab and models, mixed reactions (6 February 2025)
- Hugging Face: krutrim-ai-labs/Krutrim-2-instruct model card
- Google: Powering India's AI progress (16 December 2025)
- CoRover: Small model, big impact, BharatGPT mini 0.5B and AI efficiency (24 April 2026)
- Inc42: Soket AI wants to turn the language gap in AI into India's edge (22 July 2026)
- TechStartups: Sequoia India-backed Gan.ai raises $5.25M in funding (23 May 2023)
本文在 AI 工具协助下研究与撰写,并经编辑核实。仅供一般参考与讨论,不构成专业建议。请参阅我们的编辑准则与免责声明。发现错误?告诉我们。
喜欢这篇吗?下一篇也别错过。
每次一篇好文章,直接送到你的邮箱。绝无垃圾邮件,随时可退订。