假如把v4.1f放到2024年的大模型竞技场
deepseek吧
全部回复
仅看楼主
level 11
南山雪_ 楼主
截止到2024年12月。这是降维打击啊
2026年09月25日 14点09分 1
level 8
所以ai的发展是真的快
2026年09月25日 14点09分 2
是啊
2026年09月25日 14点09分
level 8
如同天上降魔主[笑眼]
2026年09月25日 14点09分 3
level 7
小红书那个垃圾模型,都能跟 4o 打得有来有回[滑稽]
2026年09月25日 14点09分 4
level 11
南山雪_ 楼主
AI发展的速度肯定是超出2024年人们的想象的,当时2023年的人们测AI都是用弱智吧的题目,谁还记得当时分辨GPT3.5和4.0的方法是询问它“鲁迅为什么要批判周树人”“番茄炒洗衣机怎么制作”[太开心]而现在比较AI的方法都是一句话生成小游戏了,这在当时的人们来说是想都不敢想的。
2023年我初步接触AI,当时的GPT4公认地表最强,很多人都把GPT4当成了AI发展的最终形态,而放到现在,gpt4在榜单上已经远远排不上号了。当时的许多人还把大模型与小爱同学,天猫助手这样的语音助手混为一谈。
上下文这一块也是,2023年,模型上下文在8k,16k,而32k和64k已经是超长上下文了,而现在,1m上下文已经开始普及,这一点当时的人们也几乎无法想象。
AI的发展是量变引起质变,愿早日触达AGI。
2026年09月25日 14点09分 5
level 3
全世界模型能力倒退三年而我不变[呵呵]
2026年09月25日 14点09分 7
level 11
南山雪_ 楼主
这要给当年的人用到这模型真得眩晕瘫坐吧
2026年09月25日 15点09分 8
level 9
真的很难想象,明年这个时候肥波5这些都是淘汰掉的傻子模型了[呵呵]但是这就是事实了
2026年09月25日 15点09分 9
现在好多模型在榜上挺不住2个月,fb5已经算能撑的了,撑了三个半月
2026年09月25日 15点09分
level 11
对比下去年12月看看[呵呵]
2026年09月25日 15点09分 10
level 8
注意:那个时期最强国模是qwen,当时六小龙的模型根本进不了第一梯队
2026年09月25日 16点09分 11
level 5
ai目前的发展速度已经超过摩尔定律了吧
2026年09月25日 17点09分 12
纯靠堆料啊[滑稽]就差用超算部署AI了。现在这算力,几千张的算力卡。后面堆不上了,迟早用大型超算来部署[喷]要我说,等老中的超算ai中心建造完成。这些硬堆算力卡的,都得死[滑稽][滑稽]
2026年09月26日 05点09分
level 7
AI的膨胀速度飞快,现在claude opus5.5都超过GPT6了,国模啥时候有这个能力,那真是要起飞了。。
2026年09月25日 17点09分 13
level 9
想看和25年年末的对比[吐舌]
2026年09月25日 21点09分 14
level 1
感叹一下这两年的发展[小乖]记得24年年中公司找了个外部专家来搞培训介绍llm的发展情况。当时只知道有gpt,又贵还各种限额,账号也不好注册,是真的希望能有替代品,最好是国内的,至少使用门槛别像gpt那么高[小乖]
培训的时候他们讲了当时国内的产品:刚搓出来的豆包(24年7月就在用现在这个形象了),现场演示了简单的语音功能但没继续介绍;讯飞星火说是当时国模里的第一梯队,记得说是文字能力最强以及上下文长度长,但离gpt还差得远;通义千问的优势是语音识别,推荐做会议纪要啥的;重头戏是大篇幅讲了kimi,当时刚融资完,说是当时国模的黑马,不过后来很长时间没啥动静,直到k3出来后上他们官网才发现上一次用Kimi网页版是24年7月[阴险]
讲真当时对国模只是期待但并不看好,尤其是基于对其他领域科研的固有印象觉得国内要搓出gpto1怎么也得两三年,哪想到ai发展速度会这么快。24年年底的时候有个在券商实习的同学跟我们提了一下幻方在ai上要有大动作(顺便一提,她还说当时幻方搞这个的技术负责人被小米挖走了),当时只把这事当个茶余饭后的趣谈,以为只是又一个普通的国内企业发起的堂吉诃德式的冲锋。结果过了两个月大肥鱼横空出世[阴险]
但ai发展的速度实在是太恐怖了,别的领域推动这种程度的进步要两三年,在ai这边就两三个月。25年年初肥鱼挤进世界第一梯队,以为怎么也能领跑一两年,结果不到半年就落后了,后面的性能排行更是各种城头变幻大王旗。把现在的模型放到两年前如同天神下凡,不敢想象27年年底的模型放到现在会是什么概念[阴险]
2026年09月26日 00点09分 15
level 6
但是也有训练集里有测试集的原因吧,当然提升确实很大就是了
2026年09月26日 02点09分 16
1