
评分依据:Artificial Analysis Intelligence Index v4.3.2 includes: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1. See Intelligence Index methodology for further details, including a breakdown of each evaluation and how we run them.
glm5.3还是可以的。
muse竟一下就上来了,而国产的小米居然还超过了DS和GLM。看到千问和KIMI了,都掉到小米后面去了。
muse这么猛的吗
Deepseek更新太慢了,感觉都过了好几个月了还没新模型
@chenghaha #1 清华计算机系还是很有水平的
我只能说ds其实还有下降空间
muse居然能这么靠前
gpt 一边去吧,其他的不错
@GPTADM #0 小米原来也做ai模型的吗,还挺靠前阿
Qwen3.8都看不见了!我还本地部署了