中文
一项政府算力计划正以远低于市场价的价格,向印度初创公司出租近6万块GPU;一个翻译平台每天处理数以千万计的请求,涉及的语言连ChatGPT都常常应付不来;还有一家名叫Sarvam的初创公司,正争分夺秒打造这个国家自己的大模型。但并非每一个赌注都已经成功。
用博杰普里语、多格拉语或桑塔利语向大多数大语言模型提问,得到的答案通常只有两种。要么模型直接答不上来,要么它悄悄假装你问的是印地语,靠猜测来回答一种它从未被认真训练过的语言。
这个差距不是什么无关紧要的误差。印度宪法列出的语言就有22种,而按上一次人口普查的统计,还有一百多种语言各自拥有至少一万名使用者。这些语言几乎都没有出现在ChatGPT、Gemini或Claude背后的训练数据里,它们的训练素材绝大部分来自英语和少数几种全球通用语言。
印度政府认定这个差距值得自己出手去填补,如今已经拿出真金白银和真实的硬件,押注在三条不同的路径上。一条走得比所有人预期的都要顺利。一条尚未得到证实。还有一条已经不得不承认自己当初说得太满。
印度正在送出的那些算力
2024年3月,印度联邦内阁批准了IndiaAI使命计划,总投入达1037.192亿卢比,约合12.5亿美元,分五年拨付。其中大约44%,约合456.3亿卢比,只用来解决一个问题:让印度研究者和初创公司能用上GPU(也就是那种专门用来训练和运行AI模型的芯片),而不必支付硅谷那样的价格。
到2025年底,已有超过3.8万块GPU被纳入政府的AI算力门户,以大幅优惠的价格出租给获批的申请者。2026年2月,在新德里举行的印度AI影响力峰会上,信息技术部长阿什维尼·瓦伊什纳夫宣布将在此基础上再增加2万块,并提出到2026年底实现10万块公共GPU的目标。
这项计划总额1037.2亿卢比里剩下的部分,还资助着另外六块内容:一个名为AIKosh的共享数据集平台、一个初创企业融资板块、一个旨在把AI素养带入公共部门的技能培训项目、一项应用开发推进计划,以及一个安全与信任板块。实际上,这是在尝试搭建一个国家打造自己AI所需要的全套支撑体系,而不只是发放芯片。
已经奏效的部分:大规模的翻译
这套体系里最早诞生的一块,比算力计划还要早两年。Bhashini,即印度国家语言翻译使命,由总理于2022年7月启动,由电子和信息技术部负责运营。它在宪法列出的22种语言之间提供语音转文字、文字转语音和翻译服务,以免费API的形式对外开放,任何开发者或政府部门都可以接入使用。
一家行业追踪机构报告称,截至2026年初,Bhashini自上线以来累计处理的请求已经突破60亿次,平均每天约1500万次,响应时间都在一秒以内。印度国家银行的合作项目用它来提供多语言银行服务,它还被用于包括大壶节在内的大型公众集会上的实时翻译。
这是这场主权AI行动里毫不起眼、属于基础管道层面的那一部分,精神上更接近UPI,而不是聊天机器人。没有人说Bhashini会写诗。它做的是在印度各语言之间搬运文字和语音,而且规模真正称得上重要,并且在这场战略里更能上头条的那些部分在公众视野中上演时,它一直安安静静地做着这件事。
主权模型:一次真实的机会,尚未得到证实
这项计划里最引人注目的一块,是尝试打造一个专门为印度语言训练的基础大语言模型,而不是事后在某个美国模型上做微调。2025年,政府从67家申请者中选中了Sarvam AI来牵头这项工作,这是一家由维韦克·拉加万和普拉蒂什·库马尔于2023年创立的初创公司,并为其提供了4096块英伟达H100 GPU的使用权。
Sarvam早在2023年12月就已从Lightspeed、Khosla Ventures和Peak XV Partners那里筹到约4100万美元,是当时押注印度本土AI公司规模最大的早期投资之一。2026年2月,它发布了两个开放权重模型,分别是Sarvam-30B和规模更大的Sarvam-105B,并同时推出了面向印度语言转录和语音合成的语音模型。英伟达把这次合作当作它所说的“主权AI”的案例来宣传,将其描述为一个为14亿人用自己语言提供服务而打造的模型。
但这里有一个必须老实说的复杂之处。Sarvam发布过对比DeepSeek等模型的强劲跑分,但据《福布斯》2026年3月的报道,这些模型并没有出现在Hugging Face的Open LLM排行榜这类独立榜单上,而且大部分评测数据来自Sarvam自己设计并自己打分的基准测试,评判标准也是由这家公司自己制定的,而它的创始人恰恰也参与打造了这个领域已经在依赖的一些印度专属标准基准。这并不是造假的证据。它说明的是,这些说法还没有经过任何一个与结果没有利害关系的人核实,而考虑到Sarvam的模型已经在真实的金融服务产品里运行,这一点只会更重要,而不是更无关紧要。
警示故事:Krutrim
这个故事里第四个名字是Krutrim,由Ola创始人巴维什·阿加瓦尔创立,2024年初以5000万美元融资、10亿美元估值的身份亮相,上线短短几周内就成了印度第一家AI独角兽。它当初承诺要打造一个基于印度语言训练的大语言模型、一个名叫Kruti的对话助手,并最终推出自研AI芯片。
但一开始的反响并不好。用户几乎立刻就在测试版聊天机器人里发现了翻译错误和事实性错误,评测者也发现这家公司的云服务达不到开发者的预期。据TechCrunch报道,到2026年5月,Krutrim已经历经多轮裁员,累计裁掉超过200个岗位,把Kruti应用从各大应用商店下架,暂停了自研芯片的设计工作,并从打造基础模型转向了向企业客户出售AI云基础设施。公司表示这项新业务如今已经盈利,不过早前的报道发现,它上一财年大约90%的营收来自母公司Ola自己,而非外部客户。一位行业分析师直言不讳地总结了这次转向:主张越大,需要拿出的证据标准就该越高。
这一切究竟意味着什么
把这四块拼在一起看,浮现出的模式比那种大获成功的说法,或者那种冷嘲热讽的说法,都更有意思。那个最不起眼的基础设施押注,也就是便宜的GPU,加上一个没人质疑的翻译API,是目前唯一能证明自己确实在大规模发挥作用的部分。那个雄心勃勃的押注,也就是打造一个能与美国和中国的模型抗衡的本土基础模型,背后有真正的政府支持和真实的硬件投入,但它自身的说法仍在等待外部核实。而那个动作最快、说得最响亮的押注,却在两年之内就不得不收回自己的话。
这些都不能说明最初的目标是错的。一种被数千万人使用、却被所有主要AI实验室忽视的语言,是一个真实存在的缺口,填补它值得去做,无论最终是不是由某一家印度公司来拥有实现它的模型。印度目前真正建成的,还不是GPT-4的对手。它建成的是算力、数据管道和语言层,未来任何模型,不管是不是本土打造的,都得跑在这套底子上面。至少这一部分,不是一句空话。它现在每天已经在承载1500万次请求。
资料来源与延伸阅读
- PM India: Cabinet Approves Ambitious IndiaAI Mission to Strengthen the AI Innovation Ecosystem
- National e-Governance Division: India to Add 20,000 GPUs Beyond Existing 38,000
- DD News: Transforming India With AI, Rs 10,300 Crore Mission, 38,000 GPUs and a Vision for Inclusive Growth
- India Science, Technology & Innovation Portal: National Mission on Natural Language Translation (Bhashini)
- Tech Observer: BHASHINI Platform Crosses 600 Crore AI Requests, Adds Sarvam Models
- Department of Official Language: Languages Included in the Eighth Schedule of the Indian Constitution
- TechCrunch: India's Sarvam AI Raises $41 Million From Lightspeed, Khosla, Peak XV
- NVIDIA: Sarvam AI Brings Sovereign AI to 1.4 Billion People With NVIDIA
- Forbes: India Can Train a Sovereign Model but Still Cannot Prove It Works
- TechCrunch: Ola Founder's AI Startup Krutrim Is a Unicorn With a $50M Round
- TechCrunch: India's First GenAI Unicorn Shifts to Cloud Services as AI Model Ambitions Face Reality
本文在 AI 工具协助下研究与撰写,并经编辑核实。仅供一般参考与讨论,不构成专业建议。请参阅我们的编辑准则与免责声明。发现错误?告诉我们。
喜欢这篇吗?下一篇也别错过。
每次一篇好文章,直接送到你的邮箱。绝无垃圾邮件,随时可退订。