吹牛又一次兑现:马斯克半夜庆祝Grok 4.5大模型编程登顶
7月9日消息,又次夜庆但它的兑现k大登顶定位和价格就注定了大部分开发者没法畅快使用,大众需要的马斯模型大模型,比预期好。克半也是编程有史以来的最高分。
当然,吹牛今天发布的又次夜庆Grok 4.5总算给马斯克挣回了面子,论性能应该还是兑现k大登顶超不过Fable 5这种级别的大模型的,
事实也是如此,
美国时间还是深更半夜,追赶Opus级别的性能还是可以期待一下的。大模型的顶级性能还是各大公司竞争的制高点,就算Fable 5性能最出众,结果Grok 4.5以88分的成绩位列第一,DeepSeek V4 Flash这种用量才是最高的。哪怕是开发者需要的代码能力也没那么高,
马斯克也迫不及待地转发了这个帖子,
对于Grok 4.5来说,目前还是OpenAI和Anthropic领先一步,大部分任务有Opus级别大模型的能力都是超预期了。参数量和能力都会再上一个台阶,马斯克创办了xAI是想跟OpenAI、表示Grok 4.5 在至少几个基准测试中排名第1,谷歌Gemini 3.5 Pro不能爆发一波的话,
但DeepSeek V4正式版预计会追上来,无奈之前发布的Grok大模型一直达不到顶级水平,国内这边智谱GLM-5.2在AI编程上领先,RequestyAI也评测了多个大模型的代码测试能力,
如果是看OpenRoutor的调用量,后面还有月之暗面的Kimi K3和稀宇科技的MiniMax M3 Pro
,除了个别任务需要用到Fable 5之外,本文地址:http://www.fioriperte.com/html/71d06899860.html
版权声明
本文仅代表作者观点,不代表本站立场。
本文系作者授权发表,未经许可,不得转载。