Grok 4.5
-
Grok 4.5 登顶 VulcanBench 编程基准,91.3% 得分超越 Claude 和 GPT
xAI 的 Grok 4.5 在 VulcanBench 基准测试中取得 91.3% 的分数,完成 23 个任务中的 21 个,超越 Anthropic 的 Claude Fable 5 和 OpenAI 的 GPT-5.6 Sol。该基准测试专注于多文件软件工程任务,涵盖五种编程语言,并且强调可重复性和成本透明度。
-
Grok 4.5登顶FrontierSWE榜单第二,性能碾压Claude Opus与GPT-5.5
xAI最新编程模型Grok 4.5在FrontierSWE基准测试中以4.09分跃居第二,超越Anthropic与OpenAI的竞品,同时以低价策略冲击市场,引发AI工具竞争对加密投资格局的间接影响。
-
SpaceXAI 的 Grok 4.5 超越 GPT-5.6-SOL,AI 模型霸主格局生变
SpaceXAI 推出的 Grok 4.5 模型在浏览器代理任务中超越 GPT-5.6-Sol,逼近 Claude Opus 4.8,排名 AI 指数第四。这一进展加剧了顶尖 AI 模型性能的压缩,可能动摇 Google 和 Anthropic 的领先地位。
-
Grok 4.5 价格碾压 Claude Opus,但性能仍被压制
SpaceXAI 发布编程模型 Grok 4.5,价格仅为 Anthropic Claude Opus 的几分之一,但在独立基准测试中排名第四。在编程任务上,Grok 4.5 成本更低,部分测试优于对手;整体智能指数落后于 Fable 5、GPT-5.5 和 Opus 4.8。
-
马斯克宣布 Grok 4.5:更快更便宜的 Opus 级模型,即将公开发布
马斯克宣布 Grok 4.5 将于 7 月 9 日公开发布,称其为“Opus 级模型但更快、更省成本”。该模型由 xAI(已更名为 SpaceXAI)与 Cursor 联合开发,基于 1.5T 参数基础模型。
-
马斯克急推Grok 4.5公开上线,正面硬刚OpenAI GPT-5.6
马斯克宣布SpaceXAI将于明日向公众发布Opus级模型Grok 4.5,称其运行更快、成本更低。同日,OpenAI也计划全面推出GPT-5.6系列。双方旗舰模型几乎同步上线,竞争白热化。