共计 1199 个字符,预计需要花费 3 分钟才能阅读完成。
钛媒体旗下 AI 词元服务平台 TiToken, 发布算力优化产品 BackBy
在 2026 ITValue Summit 数字价值大会现场, 钛媒体集团发布旗下 AI 词元服务平台 TiToken, 并同步推出算力优化产品 BackBy。该平台定位为多词元聚合与解决方案服务, 海外对应平台为 Opensand, 试图从算力调度与交付环节切入, 解决 AI 落地“最后一公里”的成本与效率问题。
📌 从实时到可等待:BackBy 重新划分任务路径
BackBy 的核心思路并不复杂: 并非所有 AI 任务都需要即时响应。 以文档处理为例 , 用户问答和人工核对必须实时返回, 而字段抽取、文档分类、单篇摘要等后台工作则可以等待、可以批量执行。
BackBy 将这类任务转入非实时处理路径, 通过厂商原生 Batch 或其他合格通道完成 , 从而按更低价格计费。平台负责判断可用路径、提交任务、跟踪状态并匹配结果, 合作方只需关注业务输入与输出。
🔍 算力底座与 FDE 交付:TiToken 的双层能力
BackBy 的能力建立在 TiToken 与 Opensand 的算力服务之上。TiToken 覆盖国产主流大模型 API,Opensand 提供出海模型选择, 两者合计持续接入超过 100 个模型, 兼容 OpenAI 标准, 开发工具可无缝集成。按客户指定模型与版本对接, 新增模型由平台完成适配, 业务系统无需改造。
- 某调味品制造企业打通订单、客户、SKU、区域四类数据, 搭建经营分析看板并叠加管理层助手;
- MCN 微短剧业务中, 同一素材同时产出 3 条故事主线供客户比较勾选, 方案经校验后才可批准;
- 广告公司将 18 条爆款视频统一入库, 按推广功能、内容主题、画面形式三个维度拆解, 结论直接转为可开拍的选题与分镜脚本。
💡 前后变化: 从“全部实时”到“分层处理”
过去企业调用大模型时, 往往默认所有任务都走实时通道 , 导致后台批处理任务也承担了较高的调用成本。BackBy 带来的变化在于, 把任务按时效需求分层: 需要即时返回的继续走实时服务, 可等待的转入低价窗口或 Batch 路径。同一个指定模型, 实时执行按实时服务计费, 转入可等待窗口后按对应低价方案计费, 交付与费用在 Delivery Report 中可查。
📊 行业观察: 成本优化正在成为 AI 落地的关键变量
随着大模型进入业务系统, 调用成本不再是技术团队的内部指标 , 而直接影响到 AI 功能能否规模化铺开。将非实时任务分离出来, 用更低价格完成, 相当于在不牺牲核心体验的前提下压缩整体开销。对于文档密集型、内容生产型和数据分析型业务, 这种分层思路具备较强的可复制性。
TiToken 与 BackBy 的组合, 本质上是在算力聚合之上叠加了一层任务调度与交付管理 。能否真正降低总费用, 取决于模型适配广度、任务路径判断的准确性以及准时完成率。后续值得关注的是, 这类平台能否在更多行业场景中验证其成本优势, 并形成稳定的交付标准。