← 新闻
动态

蚂蚁百灵发布 Ling-3.1-flash:560B 总参数 / 25B 激活,连续 17 小时写出编译器

蚂蚁百灵(InclusionAI)发布 Ling-3.1-flash:约 560B 总参数、25B 激活,混合线性注意力架构,1M 上下文(体验期 256K);官方演示连续 17 小时从零写出 Lua 到 x86-64 编译器(182 项测试过 178)。目前未开源,官方称转付费后计划开源。

来源: The BlockBeats

发布

2026 年 9 月 30 日,蚂蚁集团旗下 InclusionAI(蚂蚁百灵) 发布 Ling-3.1-flash。相比上一代 Ling-3.0-flash(124B 总参数 / 5.1B 激活),总规模扩大约 4.5 倍。

架构与规格

  • 总参数约 560B,每 token 激活约 25B(稀疏比约 1:22)
  • 延续混合线性注意力架构并提高线性层比例:7 层 KDA + 1 层 Gated MLA
  • 512 个路由专家,每 token 激活 8 个 + 1 个共享专家
  • 上下文上限 1M token(当前体验期开放 256K,转付费后开放 1M)

官方演示(自报数据)

  • 连续约 17 小时从零编写 Lua 到 x86-64 ELF 编译器:182 项测试通过 178 项(97.8%)
  • 约 20 小时将 C 图像库移植到 Rust:8.015 倍加速,30 项正确性检查全部通过
  • 基准:GDPVal-AA v2.1 达 1,673 Elo、FrontierSWE 75.16、HealthBench Professional 65.35

开源状态:尚未开源

  • 官方口径:两周免费体验结束转为付费服务后开放 1M 上下文,届时计划同步开源模型
  • 截至 10 月 1 日,Hugging Face 上没有权重仓库、许可证与模型卡,所有分数均为官方自报,无第三方独立评测
  • 参考上一代 Ling-3.0-flash 发布到开源约两周间隔,本次节奏预计类似

体验渠道

现已通过 Novita AI、Vercel AI Gateway 与蚂蚁自家 Ling Studio(ling.tbox.cn)开放两周免费体验,定位通用智能体、搜索、办公与软件研发,并覆盖医疗、金融、材料科学等专业场景。

若按计划开源,560B/25B 激活的稀疏比意味着 decode 显存压力集中在 25B 激活侧——对大显存单卡/多卡本地部署会是一个有意思的新选项。我们将持续关注其权重落地。