共计 1102 个字符,预计需要花费 3 分钟才能阅读完成。
大模型一体机, 开始缩水了
大模型一体机市场, 劈成了两半。
大模型一体机市场正在经历一次明显的分化: 曾被视为 ” 开箱即用私有化部署 ” 标配的满血机型热度回落, 而配置更轻、门槛更低的 AI BOX 类设备开始走量。
📌 从狂热到降温
2025 年春节前后 ,DeepSeek R1 走红, 单机部署 671B 满血版成为卖点, 短时间内六十余家厂商跟进推出一体机。争议也随之而来: 一台满血设备普遍报价 120 万至 150 万元, 若用国产加速卡还需两台并联, 预算接近 400 万元, 而多数业务其实用不到这样的算力。
不到数月, 行业共识转向 ” 模型有用 , 一体机未必有用 ”。软件优化不足、并发能力偏弱、交付后缺少模型迭代服务, 让不少机构硬件到位、业务却跑不起来。到 2025 年下半年, 中小厂商的成单主力已换到 32B 和 70B。
🔍 市场为何 ” 劈成两半 ”
进入 2026 年, 内存、SSD、GPU 相继涨价, 一体机市场进一步分层。有意思的是, 早期采购方反而成了硬件涨价周期的受益者, 有企业处置旧服务器不仅收回成本还实现盈利。
但这种账面升值不宜直接套用到新采购上。 二手设备常面临保修失效、固件兼容、功耗偏高等问题 , 要跑新一代 MoE 模型还需改造推理框架。
轻量化成为主流, 原因大致有四:
- 需求端挤泡沫, 知识库问答、公文写作等场景用小模型就够;
- MoE、蒸馏、量化等技术成熟, 同等效果所需参数量下降;
- 高端芯片供给受限, 单卡难以承载超大 MoE 模型;
- 内存等硬件涨价, 满血本地部署性价比走低。
结果是: 轻量版本撑起出货大盘, 满血高端机型则集中在有强合规要求的央国企与金融机构。
💡 高端机型真的没有价值了吗
并非如此。Agent 长链路任务、Vibe Coding 代码开发、AI 专业视频生成对推理深度与多模态理解要求较高, 仍需满血模型支撑。与此同时,Token 价格上涨、多模态生成消耗惊人, 大规模云端调用年支出容易突破百万, 本地部署的成本优势重新显现。Agent 的普及, 也让过去长期闲置的设备有了 7×24 小时运转的可能。
📊 模型迭代带来的转折
DeepSeek V4.1 Flash 采用总参数量 552B 的 MoE 架构, 规模小于此前 671B 满血版, 这意味着部分已交付设备无需加卡就有能力升级空间。开源侧,MiniMax H3 全模态模型已完成多家芯片与推理框架适配, 社区优化后让 AI 视频的本地生成变得可行, 进一步削弱了对云端视频服务的依赖。
竞争焦点正在从 ” 能跑多大参数 ”, 转向硬件、推理框架、模型适配与运维服务的整体能力。
需要提醒的是, 一体机采购并非一劳永逸 。除硬件预算, 机房供电散热、运维人力、模型版本迭代与框架调优都是持续开销, 忽略这些隐性成本, 项目落地往往不及预期。