
Grok 4.7 正式亮相,这是目前最强大的编码与知识工作模型。该模型在保持与 Grok 4.6 相同价格和速度的同时,显著提升了处理复杂任务的持久性、自我检查的严谨性以及安全护栏的校准精度,在同类产品中极具竞争力。
在聚焦长周期编码任务的 CursorBench 4.0 基准测试中,Grok 4.7 的性价比处于行业前沿。相较于前代,Grok 4.7 采用规模更大的全新基础模型,经过更长时间的强化学习训练,侧重处理需数小时解决的复杂难题。其在验证自身工作和管理长上下文方面表现更佳,并原生支持 Grok Bot 工具链,从而强化了对话任务和通用知识工作能力。
专业任务与安全性能双突破
在文档和演示文稿创建方面,Grok 4.7 表现优异。在模拟律师、护士和金融分析师等专业工作的 GDPval 和 AA Briefcase 基准测试中,其成绩均优于 Grok 4.6,并与其它前沿模型相当。
安全方面,Grok 4.7 采用全新架构,在拒绝率和越狱抵抗测试中表现最强。在网络安全和生物研究等双重用途领域,它兼顾了良性任务的实用性与危险任务的安全拒绝能力。在 LatchBio 生物安全基准测试中,Grok 4.7 以 62.4% 的成绩位居榜首。
该模型在强大网络防御能力与低误拒率之间取得了平衡。在 HackerBench v0.3 基准测试中,它仅放行 3.3% 的高风险双重用途提示,同时极少误拦合法的安全研究工作。目前,部分网络安全合作伙伴已获邀访问,利用其红队测试能力进行防御性研究。
定价与获取方式
Grok 4.7 现已在 Cursor 和 Grok Build 中上线,也可通过 Grok API、第三方编码工具链、模型路由器及云平台获取。定价为每百万输入 Token 2 美元起,每百万输出 Token 6 美元起。此外,还提供一款高速变体版本,输出速度为标准版的两倍,价格亦为两倍。
用户可前往 x.ai/build 免费试用 Grok Build。