SpaceXAI 发布编程模型 Grok 4.7:百万词元输入 2 美元起
马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起
主打写代码的 Grok 4.7 上线了,官方称速度同类两倍、价格一半,Cursor 可直接调用。
SpaceXAI 于 9 月 22 日发布 Grok 4.7,主打编程和知识工作场景,基座模型比 Grok 4.6 更大,并接受了更长时间的强化学习训练。在 CursorBench 4.0 编程测试中,该模型在价格与性能上处于同类前列;在考察律师、护士、金融分析师任务的 GDPval 与 AA Briefcase 基准上也较 Grok 4.6 有提升。安全方面,Grok 4.7 在 LatchBio 生物安全基准取得 62.4%,在 HackerBench v0.3 中仅 3.3% 的高风险双重用途提示通过。模型已通过 Cursor、Grok Build 和 Grok API 提供,输入每百万词元 2 美元起、输出 6 美元起,高速版本速度与价格均翻倍。
马斯克 SpaceXAI 发布旗下最强编码和知识处理模型 Grok 4.7,百万词元输入 2 美元起
IT之家 9 月 22 日消息,SpaceXAI 今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。 官方称其采用全新更大规模基础模型,并通过更长时间的强化学习训练提升复杂任务处理能力,是该公司目前最强的编码和知识处理模型 —— 速度是同类模型的两倍,价格却只有一半。 如前所述,Grok 4.7 针对编程和知识工作进行了优化。与 Grok 4.6 相比,新模型能够在困难任务上持续更长时间,并加强了对自身输出结果的检查能力。 在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型的前列。官方同时表示,该模型的运行速度和定价与 Grok 4.6 相同。 Grok 4.7 使用了比 Grok 4.6 更大的基座模型,并接受了更长时间的强化学习训练。训练数据更加侧重需要数小时完成的复杂任务,同时针对模型的自我验证和长上下文管理能力进行了优化。 SpaceXAI 还针对 Grok Bot harness 对 Grok 4.7 进行了原生训练,使其在对话以及一般知识工作任务中的表现得到提升。此外,该模型在文档和演示文稿生成方面也有所改进。 在 GDPval 和 AA Briefcase 两项基准测试中,Grok 4.7 均较 Grok 4.6 有所提升。这些测试要求 AI 完成律师、护士、金融分析师等专业人士日常工作中的相关任务。官方称,Grok 4.7 在两项测试中的表现已达到与其他前沿模型相近的水平。 安全方面,SpaceXAI 为 Grok 4.7 采用了全新的安全防护体系。官方表示,该模型在拒答和抵抗越狱攻击方面达到了公司目前测试中的最高水平。 在网络安全和生物领域等具有双重用途的场景中,Grok 4.7 试图兼顾合法任务的可用性与危险任务的安全拒答。在 LatchBio 生物安全基准测试中,该模型取得 62.4% 的成绩。 针对网络安全场景,SpaceXAI 表示,Grok 4.7 在 HackerBench v0.3 测试中仅允许 3.3% 的高风险双重用途提示通过,同时较少阻止合法的安全工作。此外,公司已经开始向部分网络安全合作伙伴提供邀请制访问权限,用于红队能力和防御研究。 目前,Grok 4.7 已通过 Cursor 和 Grok Build 提供,同时开放 Grok API,并支持第三方编程工具、模型路由服务及云平台。 价格方面,Grok 4.7 每百万词元输入起价为 2 美元 (IT之家注:现汇率约合 13.4 元人民币) ,输出起价为 6 美元 (现汇率约合 40.2 元人民币) 。SpaceXAI 同时还提供了高速版本,输出速度翻倍,但价格也翻倍。