云霞资讯网

阿布扎比那边悄咪咪放了个开源大模型,专给印度十几亿人用的,权重直接甩到 Hugg

阿布扎比那边悄咪咪放了个开源大模型,专给印度十几亿人用的,权重直接甩到 Hugging Face 上了,谁都能白嫖。

它叫 NANDA87B,87 亿参数,主打印地语和英语混合场景。这事有意思在哪?G42 没去硬刚 GPT 那种通用霸权,而是盯着印度市场死磕区域语言。他们在 650 亿个印度语言 token 上训练,配了一套印度专属分词器,连文化语境都做了适配护栏——说白了就是让模型真懂本地人怎么说话,而不是拿翻译糊弄。训练还动用了 Condor Galaxy 超算,架构基于 Llama-3。

做印度市场产品、搞多语言 NLP、或者想 AI 出海的团队,这个值得存一下。相比动辄上万亿参数的巨无霸,8700 万参数的小模型反而更现实:部署便宜、推理快、能本地跑,对东南亚、中东这些多语种市场反而更对路。

说实话,中东这波 AI 野心真不小,不卷通用排名,专攻区域语言,这路子比硬碰硬聪明。你觉得区域语言模型会是小语种的真正出路,还是大模型版图里的一小块边角料?