共计 1307 个字符,预计需要花费 4 分钟才能阅读完成。
老黄 RTX Spark 真机现身 Bilibili World!CPU 和 GPU 直接焊在一起, 笔记本跑 120B 大模型
老黄在 ComputeX 发布的“超级芯片”, 已经在真机中落地了
英伟达在 Bilibili World 带来了 RTX Spark 真机展示。 这款此前在 ComputeX 公布的“超级芯片”方案, 已经出现在面向大众玩家的笔记本电脑中。它的看点不只是性能参数, 更在于英伟达试图把本地 AI 智能体、专业创作和游戏体验放进同一台个人设备。
📌 RTX Spark:CPU 与 GPU 通过高速互联协同
根据现场展示信息,RTX Spark 采用 Blackwell RTX GPU, 并搭配英伟达与联发科合作研发的 20 核 Grace CPU。两者并非走传统 PCIe 通道, 而是通过 NVLink-C2C 进行高速互联, 形成更紧密的 CPU/GPU 协同架构。
这套方案配备 128GB 统一内存,CPU 和 GPU 可共享同一内存空间 , 减少数据在不同芯片之间搬运的开销。英伟达给出的定位是面向“本地个人智能体”, 也就是让更多 AI 任务在个人电脑上完成。
- 峰值算力标称达到 1 Petaflop;
- 统一内存容量为 128GB;
- 可在本地运行参数量约 120B 的大模型;
- 上下文长度可扩展至 100 万 token。
🔍 本地智能体与隐私处理成为重点
在智能体场景中, 英伟达强调的不只是模型能否跑起来 , 还包括权限控制和隐私分流。其 OpenShell 运行时允许用户设定智能体可执行的操作, 并按照隐私策略处理请求: 敏感内容留在本地模型处理, 必要时再将脱敏信息交给云端模型。
这意味着个人电脑不再只是调用云端 AI 的终端, 也可能成为常驻型智能体的运行环境。
💡 创作与游戏: 统一内存带来更多想象空间
在内容创作方面,128GB 统一内存对大型工程更友好 。现场演示中, 英伟达展示了在虚幻引擎 5 中渲染曼哈顿 3D 场景的效果, 工程文件超过 90GB, 移动视角时画面保持流畅。视频能力方面,Blackwell 的第五代视频解码器可处理 12K、4:2:2 色度采样素材。
游戏也是 RTX Spark 面向消费端的重要场景 。资料显示, 该平台支持光线追踪、DLSS 和 Reflex, 在 1440p 分辨率下运行 3A 游戏可达到较高帧率表现。由于 RTX Spark 采用 Arm 架构, 游戏适配会是外界关注点。英伟达方面展示了 Arm 原生版《永劫无间》的运行效果, 并提到多家游戏厂商已表达支持。
📊 DGX Spark 面向开发者: 把 AI 实验搬到桌面
- RTX Spark 更偏向个人智能体、游戏和创作;
- DGX Spark 更适合模型开发、微调和本地推理;
- 二者共同指向“本地 AI 计算”这一趋势。
🚀 行业观察: 个人 AI 硬件进入新阶段
从这次展示看, 英伟达正在把 AI PC 的讨论从“是否带 AI 功能”推进到“能否在本地承载复杂智能体”。如果本地大模型、长上下文、权限管理和创作性能能够形成稳定体验, 个人电脑的使用方式可能会出现变化。
不过,Arm 生态适配、软件体验成熟度、终端价格与续航表现仍需等待更多量产产品验证。RTX Spark 和 DGX Spark 的意义在于, 它们让高规格 AI 计算从数据中心进一步走向个人桌面与移动设备, 这将是接下来 PC 与 AI 硬件市场值得持续关注的方向。