Grok 4.5和Claude 4.8,在我电脑里"打"起来了
一位开发者直言:“顶级工程能力的边际成本,今天被彻底打穿了。”
速度同样不容忽视。SpaceXAI称,Grok 4.5的生成速度约为每秒80个tokens;在SWE-Bench Pro任务中,它平均使用约1.6万个输出tokens,而Opus 4.8 Max约为6.7万个。独立测试测得其输出速度约为每秒88个tokens,高于同类推理模型的平均水平。在我们实际的测试过程中,Grok 4.5的生成速度也显着快于Claude Opus 4.8。
对于需要模型反复读取文件、调用工具、修改代码和自我验证的智能体来说,更少的步骤和更短的输出,意味着节省的不只是API账单,还有等待时间。
马斯克还提出,要在2026年余下时间里以接近每月一款新基础模型的节奏推进迭代。背靠大规模算力、Cursor积累的真实开发数据,以及SpaceX体系内的工程资源,Grok的追赶速度确实可能比过去更快。
在我们这次实测中,虽然Grok Build的边界控制出了严重事故,但它在游戏创意、视觉包装、长文档检索上,并不是陪跑者,甚至在个别任务上明显压过Claude Code。Grok的真正问题是,能力冲到这个量级之后,还能不能被稳定地约束住。
这正是马斯克式产品的典型气质:速度极快,冲击力极强,但与此同时,他也会把风险、边界和工程纪律一起推到聚光灯下。
所以,马斯克重回大模型牌桌了吗?
答案是肯定的。但他还没有赢下这一局。
Claude仍然更稳、更克制、更像一个可以托付生产环境的工程同事。Grok 4.5则像一台刚被放出来的高性能机器,马力惊人,成本诱人,但刹车系统还需要被反复验证。
[加西网正招聘多名全职sales 待遇优]
还没人说话啊,我想来说几句
速度同样不容忽视。SpaceXAI称,Grok 4.5的生成速度约为每秒80个tokens;在SWE-Bench Pro任务中,它平均使用约1.6万个输出tokens,而Opus 4.8 Max约为6.7万个。独立测试测得其输出速度约为每秒88个tokens,高于同类推理模型的平均水平。在我们实际的测试过程中,Grok 4.5的生成速度也显着快于Claude Opus 4.8。
对于需要模型反复读取文件、调用工具、修改代码和自我验证的智能体来说,更少的步骤和更短的输出,意味着节省的不只是API账单,还有等待时间。
马斯克还提出,要在2026年余下时间里以接近每月一款新基础模型的节奏推进迭代。背靠大规模算力、Cursor积累的真实开发数据,以及SpaceX体系内的工程资源,Grok的追赶速度确实可能比过去更快。
在我们这次实测中,虽然Grok Build的边界控制出了严重事故,但它在游戏创意、视觉包装、长文档检索上,并不是陪跑者,甚至在个别任务上明显压过Claude Code。Grok的真正问题是,能力冲到这个量级之后,还能不能被稳定地约束住。
这正是马斯克式产品的典型气质:速度极快,冲击力极强,但与此同时,他也会把风险、边界和工程纪律一起推到聚光灯下。
所以,马斯克重回大模型牌桌了吗?
答案是肯定的。但他还没有赢下这一局。
Claude仍然更稳、更克制、更像一个可以托付生产环境的工程同事。Grok 4.5则像一台刚被放出来的高性能机器,马力惊人,成本诱人,但刹车系统还需要被反复验证。
[加西网正招聘多名全职sales 待遇优]
| 分享: |
| Note: | _VIEW_NEWS_FULL |
| 延伸阅读 |
推荐:
Grok 4.5和Claude 4.8,在我电脑里"打"起来了