#*顺其自然#*
DATong179
关注数: 26
粉丝数: 11
发帖数: 1,012
关注贴吧数: 24
一道积分题的做法 这道题在吧里难住了诸多ai,也包括kingfall,而只有o3pro给出了正确的结果,可是过程非常简略,具体计算也是跳步严重,哪怕让它细致解释也是如此。考虑到o3pro实际上是调用python解出的这道题目,我在aistudio中给测试模型blacktooth(能力类似kingfall)设计了以下提示词,这一次它给出了一个正确且可读的回答,这个过程不是硬凑的,模型能很好地解释每一步。说明gemini这类模型最大的问题是不能调用工具算对,导致一种方法执行下去之后变得非常繁琐,模型自己就放弃这条路线了。或许先让模型跑一遍,给出些可能的思路(比如留数法之类的),再用我这样的提示词让gemini处理问题,效果会更好。
O3和gemini推理能力的测评 我发在了gemini吧,帖子太长了,我很难再写一遍,大家可以看看这个链接。 https://tieba.baidu.com/p/9776868091
关于chatgpt O3和gemini 2.5 pro 先说说我理解的推理能力。在我看来推理能力就是你描述一些新概念和它们之间的逻辑关系之后,模型能够以自己的方式理解这些概念、逻辑关系、限制条件。然后基于这种理解去检索自己已有的知识和处理策略,最终发现概念体系自身蕴含的结构,提出自己的猜想或者回应人类提出的猜想。除了研究概念体系本身以为,推理模型还应当尝试用自己学习的新概念体系来分析具体问题,为一些经典问题提供简洁的处理方法,为尚未解决的问题提供新的处理思路,从而让人类看到一个概念体系解决问题的价值。 总而言之,推理意味着理解概念体系本身或用概念体系来解决其他问题。而经过我的测试,我发现chatgptO3内化新的概念体系的能力并不强,它无法在冗长的任务中保持对基本概念的理解。它的的所谓推理,更多的是分析问题的关键限制后,找出一些策略来把问题转化为编程语言,之后交给python来运行代码、穷举遍历,然后它在评估结果。换句话说O3强大的是工具调用能力,而真正的理解力和注意力并不如gemini。对于gemini,我可以输入给它一整本书或论文,让它为我解释概念,之后再用这些概念和策略尝试处理其他问题,而这一点O3做不到 下面是具体的测试
百利金M750杆帽 信息如下,吧友可小刀
出百利金m750 吧友可以小刀
20240528【晒笔】万宝龙144精钢 最近入了一只万宝龙144精钢,是我第一支144,向吧友展示一下,也咨询一些关于144的问题,希望吧友不吝赐教。
万宝龙144精钢 M尖,感觉笔握有点细,故出掉。成色不错,主要瑕疵为笔尾轻微插拔痕迹。吧友可以自刀50
百利金m600双鸟f配m215笔杆 特价重新发个贴。 元旦特价1000,吧友或粉丝减50,爽快的可以增小礼物。
百利金m215银环配m600双鸟f 本吧吧友自曝身份,立减50。
出辉柏嘉伯爵f,可换可刀 没写多少字,成色很新,写感也不错,现在不怎么练字了,故出掉。
230811【水帖】最近全新购入的百利金m800蓝色沙丘,晒几张美图
百利金m800蓝色沙丘,成色极新。 很低的价格了,再挂几天,出不出去就自用了
出万宝龙146ef,五代非t
出百乐912,上的黑色大漆,黄白双色尖,粗细为f
230603【割爱】
20230425【割爱】出万宝龙大班145ef尖 价格实惠,吧友可小刀。
出万宝龙145ef,刀锋打磨 出万宝龙一代145ef,刀锋打磨,软弹顺滑,阻尼适中。笔迹较细但不飞白挂纸。整体上中性笔大小,轻便舒适,长期书写不累,适合日用做笔记。学生党想入146,只好忍痛割爱。整体上浅浅的日用毛痕(灯下才能看出)没有划痕,笔帽有轻微刻字,成色很好。可以参见下图。顺丰包邮,可小刀,有意向可以私聊。
230424【割爱】出万宝龙145ef,刀锋打磨 出万宝龙一代145ef,刀锋打磨,软弹顺滑,阻尼适中。笔迹较细但不飞白挂纸。整体上中性笔大小,轻便舒适,长期书写不累,适合日用做笔记。学生党想入146,只好忍痛割爱。 整体上浅浅的日用毛痕(灯下才能看出)没有划痕,笔帽有轻微刻字,成色很好。可以参见下图。顺丰包邮,有意向可以私聊。
出百乐capless十代,蓝色,F尖。学生党,笔太软不太顺手,卖出去回血。 笔尾处有轻微划痕,功能正常,下单的话赠注墨器,墨囊,con40吸墨器。
1
下一页