蚂蚁百灵发布 Ling-3.1-flash:约 560B 总参数、25B 激活,1M 上下文留待付费阶段

3次阅读
没有评论

共计 1185 个字符,预计需要花费 3 分钟才能阅读完成。

看点

IT 之家 9 月 30 日消息, 蚂蚁百灵今日发布 Ling-3.1-flash 模型, 拥有约 560B 总参数, 每个 Token 激活约 25B…

重点阅读

蚂蚁百灵发布 Ling-3.1-flash 模型: 约 560B 总参数、25B 激活参数

9 月 30 日, 蚂蚁百灵发布新模型 Ling-3.1-flash。它把总参数规模推到约 560B, 但每个 Token 只激活约 25B 参数, 同时给出 1M 的上下文能力上限, 整体指向“更长输入、更可控开销”的实用型路线。

📌 560B 总参数、25B 激活: 容量与成本的取舍

官方披露的数字中,最值得留意的是总参数与激活参数之间的落差 。约 560B 的总参数意味着模型容量储备充足, 而单次推理每 Token 仅激活约 25B 参数, 说明并非全部参数都会被调用。从这一结构看, 模型走的是稀疏激活思路, 目的通常是 在保留大模型能力的同时, 压低实际推理成本。

与之配套的是 1M 上下文窗口上限。更长的上下文可以容纳更完整的文档、代码库片段和任务历史, 对那些需要跨多轮、跨材料持续推理的使用方式尤其重要。

🔍 优化重心: 智能体、搜索、办公与研发

据官方说明,Ling-3.1-flash 在研发过程中围绕多个方向持续调优, 落点偏向可以直接投入使用的生产力场景:

  • 通用智能体任务
  • 搜索场景
  • 日常办公
  • 软件研发
  • 医疗、金融与材料科学研究等专业领域

这份清单传递出的信号比较清晰: 模型并不只追求通用问答的表现,而是把重点放在工具调用、长流程任务和专业资料处理上。这类能力能否稳定落地, 往往比单项评测分数更能决定实际使用体验。

💡 免费两周,256K 与 1M 分阶段开放

在服务节奏上,Ling-3.1-flash 将开放为期两周的免费体验。需要注意的是, 考虑到综合服务成本,免费期间的模型服务长度为 256K, 并非完整的 1M 上限。

免费体验期结束并转为付费服务后, 计划开放 1M 上下文; 届时团队也计划同步开源, 并继续更新模型性能。

换句话说,完整的长上下文能力与开源都会出现在付费阶段之后, 而不是随发布同步放出。对希望长期使用的团队来说, 这个时间节点值得提前纳入评估。

📊 几个值得关注的看点

  • 成本结构: 总参数与激活参数的巨大差距, 是否能在真实负载下体现出效率优势。
  • 长上下文实测:256K 免费额度与最终 1M 上限之间的能力差异, 会影响哪些任务先跑起来。
  • 开源节点: 开源与付费服务启动挂钩, 社区何时能拿到权重仍需观察。
  • 行业场景: 医疗、金融、材料科学等高门槛领域, 能否形成可复用的落地案例。

🚀 总结

Ling-3.1-flash 的发布重点不在参数堆叠, 而在于把规模、激活比例和上下文长度三者重新搭配:560B 总参数提供能力底座,25B 激活控制推理开销,1M 上下文则瞄准长材料与长任务。免费体验、付费开放 1M、随后开源的三段式安排, 也让它更像一次面向真实业务的试探。后续表现如何, 还要看长上下文能力的实际稳定性与开源后的社区反馈。

本文基于公开信息整理, 如有侵权请联系删除。
正文完
 0
评论(没有评论)
验证码