中国科协| 智链研究院| 机构简介| 申请加入| 资料下载

创新力服务平台

INNOVATION CAPABILITY SERVICE PLATFORM

首页 > 资讯 > 前沿科技 > 正文

蚂蚁百灵发布AI新模型,推理成本仅为同类十分之一

4月22日,蚂蚁集团百灵大模型团队推出新款Instruct模型Ling-2.6-flash。该模型总参数量1040亿,激活参数量74亿,采用混合线性架构,是一种高度稀疏化的MoE设计。模型已通过API开放,输入每百万tokens定价0.1美元,输出0.3美元,首周提供免费试用。

此前一周,一个名为Elephant Alpha的匿名模型在OpenRouter平台上线,调用量迅速攀升,连续多日位列Trending榜首,日均tokens调用量达100亿级别,周增长超过5000%。百灵今日确认,Elephant Alpha正是Ling-2.6-flash的匿名测试版本。

在性能方面,Ling-2.6-flash在4卡H20环境下推理速度最快可达每秒340个tokens,稳定输出为每秒215个tokens。其Prefill吞吐量达到Nemotron-3-Super的2.2倍。

在Artificial Analysis的完整评测中,该模型仅消耗1500万tokens完成全部评测任务,而Nemotron-3-Super等同类模型需要1.1亿tokens以上,消耗约为后者的十分之一。

此外,模型针对Agent场景做了定向增强,在BFCL-V4、TAU2-bench、SWE-bench Verified等多项基准测试中达到同尺寸模型的最佳水平。

从行业对比来看,MoE架构已成为大模型的主流技术路线。DeepSeek-V3总参数6710亿,激活参数370亿;阿里通义千问Qwen3.5-35B-A3B总参数350亿,激活参数30亿;字节跳动豆包2.0 Pro总参数7440亿,激活参数约40至44亿。

各家都在围绕激活参数这一指标进行优化,试图在模型能力与推理成本之间寻找更优的平衡点。

一个值得关注的现实是,当模型厂商纷纷将激活参数和成本效率作为核心卖点时,用户在实际业务场景中究竟更看重单位token的成本,还是模型解决复杂任务的鲁棒性?这个问题的答案,可能比任何技术参数都更能决定下一代大模型的市场走向。


AI

最新资讯

智链研究赴粤京两地企业开展创新能力专题调研

为精准把脉建材、建造行业企业创新能力的真实水平,系统梳理基层科技人才培育、技术攻关机制及创新服务落地的痛点堵点,进一步推动企业创新组织建设工作,优化智链研究“产业加速+数字赋能+品牌

684
Kimi K3深度解读:当开源模型突破2.8万亿参数的天花板

2026年7月16日,在世界人工智能大会开幕前夕,月之暗面正式发布了Kimi K3大模型。这并非一次普通的版本迭代——2.8万亿总参数、全球首个开源3万亿级别模型、Frontend Code Arena登顶——每一个

604
2026“石油石化好技术”项目征集启动

日前,2026“石油石化好技术”项目征集工作正式启动。

332
中方科研团队研拟 63 项技术参考管制清单

自特朗普首届任期开启对华贸易摩擦以来,美国联合一众西方盟友持续加码对华高端技术封锁,在半导体、人工智能、量子计算、航空航天、超级计算机及军民两用技术等领域层层设限,试图阻滞中国高端

475
华为芯片发展的中国方案:韬定律

5月25日,在上海举行的国际电路与系统研讨会(ISCAS 2026)这一汇聚全球顶尖半导体学者的学术盛会上,华为公司董事、半导体业务部总裁何庭波发表题为《半导体新路径探索与实践》的主旨演讲,正

297
智链研究院助力九牧集团成立企业科协

2026年5月15日,九牧集团有限公司科学技术协会(以下简称“九牧科协”)成立暨第一次会员代表大会在厦门隆重召开。作为九牧科协筹备工作的深度参与方,智链信息技术研究院(以下简称“智链研究院”)

840

更新文章

48小时
|
阅读排行