人工智能 OpenAI回应Astra推理不透明争议:模型复杂度并未跳跃式增长 OpenAI首席科学家回应Astra“推理不透明”争议,称前沿模型计算图深度相较GPT-4未出现跳跃式增长,并将继续加强思维链监控。
未来科技 中科曙光预热全球首款64线程移动工作站,轻薄机身搭载16GB显存 中科曙光宣布将推出全球首款64线程移动工作站,机身厚度仅16.9mm,配备16GB显存,本地运行35B MoE模型可达50 Tokens/s,AI推理速度提升3~5倍。
未来科技 DeepSeek V4的真正价值:国产算力突围与产业落地 DeepSeek V4发布,核心价值不在参数,而在国产芯片适配与低成本推理。通过架构优化,V4在华为昇腾上稳定运行,推理价格大幅降低,为企业规模化部署AI铺平道路。
科技 英伟达刷新AI推理速度纪录:每秒每GPU处理8064词元,DeepSeek-R1性能飙升2.77倍 在最新MLPerf v6.0基准测试中,英伟达凭借Blackwell Ultra架构实现全面性能碾压,其中DeepSeek-R1服务器端推理速度达每秒每GPU 8064词元,较前代提升2.77倍,展现其在AI硬件领域的领先地位。
科技 英伟达在MLPerf v6.0测试中创纪录:DeepSeek-R1推理速度提升2.77倍 英伟达在最新的MLPerf v6.0 AI推理基准测试中表现突出,其Blackwell Ultra架构在DeepSeek-R1服务器端测试中达到每秒每GPU处理8064个词元,相比上一版本提升2.77倍,展现了强大的AI推理性能。
未来科技 一度电的差价,如何让中国大模型在全球API市场占据价格优势? 中国大模型在全球API平台上的价格优势,背后是电价、电网与基础设施的深层较量。当推理成为AI商业竞争的核心,电力成本正从背景条件变为关键定价变量。
科技 中国大模型全球低价背后的“电力密码”:一度电如何重塑AI定价权 中国大模型在全球API市场频频报出低价,背后不仅是算法与工程的较量,更是电力成本、电网基础设施与能源结构的系统性优势。一度电的差价,正成为决定AI推理服务定价的关键变量。