共计 1205 个字符,预计需要花费 4 分钟才能阅读完成。
SpaceXAI 今日发布新一代模型 Grok 4.7, 官方将其定位为目前最强的编码与知识处理模型。新模型已通过 Cursor、Grok Build 和 Grok API 开放, 并支持第三方编程工具、模型路由服务及云平台接入。
📌 模型升级: 更大基座与更长强化学习
据官方介绍,Grok 4.7 使用了比前代 Grok 4.6 更大规模的基础模型, 并接受了更长时间的强化学习训练。训练数据更侧重需要数小时才能完成的复杂任务, 同时针对自我验证与长上下文管理能力进行了专项优化。
🔍 基准测试: 编程与专业工作任务表现提升
在面向长时间编程任务的 CursorBench 4.0 测试中,Grok 4.7 在价格与性能方面处于同类模型前列。在 GDPval 和 AA Briefcase 两项基准测试中, 该模型均较 Grok 4.6 有所提升。这两项测试模拟律师、护士、金融分析师等专业人士的日常工作场景, 官方称其表现已达到与其他前沿模型相近的水平。
💡 安全防护: 兼顾可用性与风险拒答
在网络安全和生物领域等双重用途场景中,Grok 4.7 试图平衡合法任务的可用性与危险任务的安全拒答。在 LatchBio 生物安全基准测试中, 该模型取得 62.4% 的成绩。在 HackerBench v0.3 测试中, 仅允许 3.3% 的高风险双重用途提示通过, 同时较少阻止合法的安全工作。公司已开始向部分网络安全合作伙伴提供邀请制访问权限, 用于红队能力和防御研究。
📊 定价与接入: 输入 2 美元起, 高速版价格翻倍
价格方面,Grok 4.7 每百万词元输入起价为 2 美元, 输出起价为 6 美元。SpaceXAI 同时还提供了高速版本, 输出速度翻倍, 但价格也翻倍。目前, 该模型已通过 Cursor 和 Grok Build 提供, 同时开放 Grok API, 并支持第三方编程工具、模型路由服务及云平台。
🚀 行业观察: 编码模型竞争进入性价比阶段
当前, 主流 AI 厂商纷纷推出面向编程和知识工作的专用模型, 竞争焦点正从单纯的性能比拼转向性能、速度与价格的综合平衡 。Grok 4.7 以“速度是同类两倍、价格只有一半”为卖点, 反映出 SpaceXAI 希望在这一细分赛道快速获取开发者与企业客户。
不过, 基准测试成绩与实际工作流表现之间往往存在差距。Grok 4.7 能否在真实编程任务、长文档处理和复杂知识工作中稳定兑现官方承诺, 仍需更多第三方评测和用户反馈来验证。
- 核心升级: 更大基座模型、更长强化学习、自我验证与长上下文优化
- 主要场景: 编程、知识工作、文档与演示文稿生成
- 接入方式:Cursor、Grok Build、Grok API 及第三方工具与云平台
- 定价策略: 输入 2 美元 / 百万词元起, 高速版价格翻倍
整体来看,Grok 4.7 是 SpaceXAI 在编码与知识处理方向的一次重要迭代。它在性能、安全与定价上给出了较为积极的信号, 但最终能否赢得开发者青睐, 还要看实际使用中的稳定性与生态支持力度。