科技 英伟达刷新AI推理速度纪录:每秒每GPU处理8064词元,DeepSeek-R1性能飙升2.77倍 在最新MLPerf v6.0基准测试中,英伟达凭借Blackwell Ultra架构实现全面性能碾压,其中DeepSeek-R1服务器端推理速度达每秒每GPU 8064词元,较前代提升2.77倍,展现其在AI硬件领域的领先地位。
生活 DeepSeek突发服务故障登上热搜,现已恢复访问 3月29日晚间,知名AI模型DeepSeek出现服务器故障,导致用户无法加载内容,相关话题迅速登上微博热搜。官方随后确认服务已恢复,但具体原因尚未公布。
人工智能 Anthropic最强模型Mythos意外泄露,网络安全能力或成AGI敲门砖 Anthropic内部文档意外泄露,揭示了代号Mythos(产品名Capybara)的新一代AI模型。该模型在推理、编码和网络安全方面实现阶跃式提升,尤其网络安全能力远超现有模型,已交付少数早期客户测试。Anthropic对发布持谨慎态度,担心其被用于大规模网络攻击。
人工智能 谷歌 TurboQuant 发布:称可将大模型内存占用降至 1/6,且不牺牲输出质量 谷歌研究团队披露 TurboQuant 压缩算法,称可将大语言模型键值缓存内存占用降低 6 倍,并在部分测试中带来最高 8 倍速度提升,且未见输出质量下降。
人工智能 36氪发布第二期人才留言板:百融云创、每日互动等集中招聘大模型与Agent岗位 36氪第二期“人才留言板”汇总30多个硬科技岗位,AI大模型相关招聘尤为密集,涉及百融云创、每日互动、群核科技等公司,岗位覆盖算法、产品、研发与测试。