印度AI(1万亿参数)挑战中美

Sarvam 联合创始人 Pratyush Kumar 确认,公司正在印度本土打造一个超过1万亿参数的基础AI模型。这一举动旨在直接挑战 OpenAI 和 Anthropic 等行业头部实验室,并试图向外界证明,印度不仅能做AI应用,也能研发世界级的底层基础大模型。

该公司最近以15亿美元估值完成了2.34亿美元融资,据称这是印度初创企业历史上规模最大的B轮融资。本轮融资由HCLTech主导,承诺作为战略投资者投入1.5亿美元。

Sarvam联合创始人兼首席执行官Pratyush Kumar表示,这家班加罗尔初创公司在计算方面已投入约2000万美元,涵盖三款模型,其中包括其旗舰Sarvam-105B。

库马尔解释说,总成本可能高达数百万,但仍低于中国的DeepSeek等项目。“计算成本明显比DeepSeek低很多。实际上,整个计算量大约有2000万,或者略少一些。我们训练了三个模型,“他在NPCI播客中说。

Sarvam首席执行官声称,这个数字不是单次训练的成本,而是发布模型所涉及工作的累计支出。他解释道:“这不仅仅是一次跑动的代价。这需要大量的探索性工作。这需要大量数据创建工作,并且会分层叠加。但归根结底,这并不是数十亿美元。这是一个个位数百万美元的型号。”

Sarvam-105B 在语音通话和指令遵循等任务上,使用成本大幅低于竞品。据称,它的成本比 OpenAI 的 GPT-5.4 Mini 便宜 5.5 倍,比 Google 的 Gemini 3.5 Flash 便宜 11 倍

Sarvam的大部分训练依赖于计算,而计算能力无需直接付费。该公司是印度主权人工智能使命下的首家公司,政府同意提供4096块英伟达H100显卡的使用权,期限六个月,以换取该初创公司的股权。

公司还指出,其产品需求正在增长。Sarvam 表示,其平台目前每天处理超过 200 万次交互,每天处理约 1000 万次 API 请求,每月转录超过 50 万小时音频。

萨尔瓦姆在政府项目中使用的多语言语音代理从1700万农民收集了信息,而全国范围的保险宣传活动覆盖了4500万保单持有人。

Sarvam AI宣布,AI研究员德文德拉·辛格·查普洛特已以兼职顾问身份正式加入公司。查普洛特此前任职于埃隆·马斯克的xAI,同时也曾参与Mistral AI及米拉·穆拉提(Mira Murati)创办的Thinking Machines Lab的核心创始团队。

公司还正式推出Epoch Builder Edition平台,专为开发者、研究人员及企业提供针对印度应用场景的AI模型构建、微调与部署服务。

该平台主要功能包括:提供70亿及700亿参数两个版本,支持印地语、卡纳达语、泰米尔语、马拉地语、孟加拉语等10余种印度语言,並提供GPU算力基础设施,训练工具及精选数据集等

该公司专门针对印度的22种官方语言(包括由多种语言混合的“Hinglish”等)进行了从零开始的预训练。在英语非母语、人们更习惯语音而非打字交流的印度市场,这种深度定制的语音和多模态能力成为了他们极深的护城河。

除了公布万亿参数模型的规划,Sarvam 还在今天更新了其全栈多模态AI产品线,这表明他们并没有停留在“画饼”阶段,而是有具体的商业化大饼落地:

  1. Vision 2.0 & Vision Edge: 新一代视觉模型,大幅提升了对印度手写文本和复杂表格的 OCR(光学字符识别)提取能力,甚至已经开始被当地政府用于土地记录的数字化。

  2. Saras V4 & Bulbul V4: 最新的语音识别和文本到语音(TTS)模型,不仅能识别其他大模型无法处理的稀有印度语种(如梵语、曼尼普尔语),还能在生成的语音中加入笑声或语气重音,使对话更加自然。

  3. Sarvam Kaze 智能眼镜: 一款专为视障人士设计的AI穿戴设备,能通过摄像头实时识别环境(例如公交车路线、距离等)并通过多语种语音与用户交互。

印度语言

  1. 22种官方语言: 印度宪法第八附表列出了 22 种受承认的官方语言(如印地语、孟加拉语、泰卢固语、马拉地语、泰米尔语等)。

  2. 数千种方言: 根据印度人口普查的数据,如果把所有被作为母语填报的语言和方言加起来,数量超过了 19,500 种。即使经过语言学家的归类,也有几百种相对独立的语言和上千种方言。

  3. 混杂语态(Code-switching): 印度人日常交流极少使用单一的纯正语言,而是习惯将英语和本土方言无缝混合,比如最著名的 Hinglish(印地语+英语),以及 Tanglish(泰米尔语+英语)等。

更多游戏资讯请关注:电玩帮游戏资讯专区

电玩帮图文攻略 www.vgover.com