阶跃星辰推出Step 3.5 Flash 2603,新增低推理模式大幅降低token消耗

131次阅读
没有评论

共计 1258 个字符,预计需要花费 4 分钟才能阅读完成。

进展时间线

阶跃星辰上线 Step 3.5 Flash 新版本, 新增低推理模式

AI 模型正在变得更聪明,也更懂得“偷懒”。阶跃星辰最新发布的 Step 3.5 Flash 2603, 就引入了一个名为“低推理模式”的新功能, 旨在让 AI 在处理简单任务时不必过度“思考”, 从而显著提升效率、降低成本。

📌 模型升级: 不只是版本号的变化

Step 3.5 Flash 2603 是阶跃星辰 Step 3.5 Flash 系列的优化版本。官方强调, 新版本在延续原有高响应速度和低成本优势的基础上, 进行了多项针对性改进。

最核心的更新是新增了low think mode(低推理模式)。这一模式允许模型在处理复杂度不高的任务时, 自动降低推理深度, 从而减少计算资源的消耗。对于开发者或企业用户而言, 这意味着在相同预算下可以处理更多的请求。

🔍 性能实测:token 消耗最高降低 56%

根据阶跃星辰公布的测试数据,Step 3.5 Flash 2603 在性能与效率之间找到了新的平衡点:

  • 默认推理模式 (high) 下: 推理分数与之前版本基本持平, 但 token 消耗降低了 14%。
  • 切换到低推理模式后:token 消耗进一步大幅降低, 降幅达到 56%。

这意味着, 对于适合低推理模式的任务, 用户几乎可以用不到一半的成本获得可接受的输出结果。

💡 设计思路: 为何需要“低推理”模式?

阶跃星辰在官方说明中透露,这一功能的推出源于对用户实际使用场景的深入观察 。特别是在 Agent(智能体) 应用场景中, 大量任务具有 高频但低复杂度 的特点。

“没必要让每一个请求都去‘深度思考’。”阶跃星辰表示,“部分用户已经在做‘按需分配’: 复杂环节用重型模型, 中间步骤和高频任务用轻量模型。”

这种“按需分配”的思路,正是低推理模式的设计初衷。它让 AI 模型能够根据任务的实际需求, 灵活调整推理强度, 避免资源浪费。

📊 优化重点:Coding 与 Agent 框架体验提升

除了低推理模式外,Step 3.5 Flash 2603 还针对两个关键应用领域进行了专门优化:

  • Coding 框架: 提升代码生成、代码补全等场景的体验和稳定性。
  • Agent 框架: 优化智能体在多步骤任务中的协调能力和 token 使用效率。

这些优化表明, 阶跃星辰正在将模型能力更紧密地与实际开发和工作流需求相结合。

🚀 使用方式与行业影响

对于已经订阅 Step Plan 的用户 , 使用新模型非常简单: 只需在模型选择中切换为step-3.5-flash-2603 即可。低推理模式作为可选项, 用户可以根据具体任务需求灵活开启或关闭。

从行业角度看,Step 3.5 Flash 2603 的推出反映了 AI 模型发展的一个新趋势:

  • 精细化成本控制: 通过模式切换实现计算资源的按需分配。
  • 场景化优化 : 针对特定应用框架(如 Coding、Agent) 进行专项改进。
  • 用户体验优先: 在保持核心能力的同时, 大幅降低使用门槛和成本。

随着 AI 应用逐渐普及,如何平衡性能、成本和易用性, 将成为模型提供商竞争的关键。阶跃星辰此次更新, 无疑为市场提供了一个值得关注的解决方案。

后续仍需结合新增披露持续校准判断。
本文基于公开信息整理, 如有侵权请联系删除。
正文完
 0