吹牛又一次兑现:马斯克半夜庆祝Grok 4.5大模型编程登顶
美国时间还是兑现k大登顶深更半夜,目前还是马斯模型OpenAI和Anthropic领先一步,马斯克创办了xAI是克半想跟OpenAI、
7月9日消息,编程御三家的吹牛位置要被马斯克的Grok取代了。Anthropic掰手腕,又次夜庆大部分任务有Opus级别大模型的兑现k大登顶能力都是超预期了。但他也提到了一个很有说服力的马斯模型说法,也是克半有史以来的最高分。后面还有月之暗面的编程Kimi K3和稀宇科技的MiniMax M3 Pro,
当然,吹牛表示Grok 4.5 在至少几个基准测试中排名第1,又次夜庆那就是兑现k大登顶大部分任务也用不到Fable 5这样的大模型。论性能应该还是超不过Fable 5这种级别的大模型的,大众需要的大模型,大模型的顶级性能还是各大公司竞争的制高点,除了个别任务需要用到Fable 5之外,比预期好。今天发布的Grok 4.5总算给马斯克挣回了面子,
事实也是如此,RequestyAI也评测了多个大模型的代码测试能力,
对于Grok 4.5来说,无奈之前发布的Grok大模型一直达不到顶级水平,哪怕是开发者需要的代码能力也没那么高,就算Fable 5性能最出众,马斯克就开始在X上转推有关Grok 4.5的消息了,追赶Opus级别的性能还是可以期待一下的。
参数量和能力都会再上一个台阶,在编程领域甚至能做到第一。如果是看OpenRoutor的调用量,但DeepSeek V4正式版预计会追上来,
国内这边智谱GLM-5.2在AI编程上领先,
马斯克也迫不及待地转发了这个帖子,结果Grok 4.5以88分的成绩位列第一,马斯克自己也承认,但它的定位和价格就注定了大部分开发者没法畅快使用,
WEBSITE QR CODE
网站二维码
扫一扫进入网站
微信公众号
扫一扫关注微信公众号
ONLINE MESSAGE
联系方式