国模被ko了
deepseek吧
全部回复
仅看楼主
level 4
deep@ 楼主
毫无招架之力,打得落花流水呀!就等着接下来的智谱 5.4 和 DeepSeek-V4.1 Pro,kimi k3.1 看能不能扳回一城了
2026年10月09日 07点10分 1
level 4
deep@ 楼主
MIMO 还有点战斗力
2026年10月09日 07点10分 2
刷分王和luna一桌去[阴险]我求你们别看aa了
2026年10月09日 07点10分
一看二楼就释怀了(关羽之歌〰)
2026年10月09日 10点10分
这个写代码真不行[怒],又卡又笨
2026年10月09日 08点10分
MIMO 是纯屎。这几天用了快 300 块的做开发,真不如DS 和 GLM。
2026年10月09日 12点10分
level 7
依旧AA榜
2026年10月09日 08点10分 3
level 1
aa榜月底更新v5之后差距会更大,国模现在就靠几个低含金量的elobench撑着,而且还有几个存在错题的饱和bench,等到换成terminal-sicience这几个需要硬智力的bench之后,就会知道谁在裸泳。[滑稽]预计到时候Claude会不变,gpt上升,mimo/grok/muse这些刷分狂会大幅下降。
eci指数更符合真实差距,主要是更新太慢。
2026年10月09日 08点10分 4
terminal-science,astra 63%,opus5.5 59%,国模最高的也就11%,这个是接下来aa榜要更新的高权重bench,刷分狂都要暴露了。[你懂的]
2026年10月09日 08点10分
level 7
怎么又提野榜了,4.1F在这个位置,实际上更好用的没几个,一大串刷分的都模型…
2026年10月09日 08点10分 5
level 1
只要这榜上有mimo一律鉴定为野榜[滑稽]
2026年10月09日 09点10分 6
level 8
仿佛唱衰国模,你美国爹就会送你词元似的。
2026年10月09日 10点10分 7
level 9
一看国模之光是mimo就知道纯野榜[笑眼]
2026年10月09日 11点10分 8
level 4
又在吹 mimo,我真希望你们这些吹的永远只能用 MIMO 这么好、分又高的大模型[笑眼]
2026年10月09日 12点10分 9
level 7
野榜,就算是对的还是得让gpt指挥ds干活,不然对于大部分人来说gpt的套餐根本不值
2026年10月09日 12点10分 10
level 8
孩子们,模型一定自己用一下,O/的那几个6系除了astra和6.1Sol,都是狗屎[呵呵]
2026年10月09日 12点10分 11
level 8
来了来了,又是熟悉的味道
2026年10月09日 12点10分 12
level 4
小米又发挥传统艺能了
2026年10月09日 13点10分 13
level 1
小米牛逼
2026年10月09日 15点10分 14
1