今天看到一个测试gpt5是否降智的方法,心血来潮去试了一下。发现结果很不对,如图所示。

后面联系了服务商才发现似乎是软件的问题?于是我换了cherry试了一下,还真就好了,虽然不是很理想,但好歹完成测试了。

我在想是概率问题吗?又跑回去运行了两次还是拒绝回答,我又去手机上chatbox试了一下。

不是很满意。但最起码回答了,还是有点降智,所以为什么会出现这种情况?是软件提供商参杂了什么提示词在里面吗?
今天看到一个测试gpt5是否降智的方法,心血来潮去试了一下。发现结果很不对,如图所示。

后面联系了服务商才发现似乎是软件的问题?于是我换了cherry试了一下,还真就好了,虽然不是很理想,但好歹完成测试了。

我在想是概率问题吗?又跑回去运行了两次还是拒绝回答,我又去手机上chatbox试了一下。

不是很满意。但最起码回答了,还是有点降智,所以为什么会出现这种情况?是软件提供商参杂了什么提示词在里面吗?
提示词如下
也得看你这api是怎么搞的啊
@MyrnaGrote #2 我的api都是同一家服务商的,把所有功能都开启来了,不知道这么操作对不对,我下午还发了一个帖子询问
但是没有大佬回复我
我是说的 你这家服务商 api是怎么搞的 不是说你用不同的api了
你从头到尾 都默认了 你供应商 给的是真的 纯的
那有没有可能 本来就给你掺了点水
当然 这只是猜测 我之前用过有一些 也有这种情况 第一次回答人机 又刷新了一下 就好了
@MyrnaGrote #5 哦哦,我第一次没实验出来后怀疑了,还去找他了,我帖子里也说到了。后面换了cherry发现确实可以跑到想要的效果,重复了五次差别都不是很大。api应该是可以的吧。而且下午我用魔搭的glm4.6在chatbox中是无法联网的,换了cherry也是可以的....不知道是什么原因
@MyrnaGrote #7 也不排除,我每个软件都重读了五次(新建会话),第一个一直都是拒绝回答,cherry都是正常的,chatbox回复很慢,api消耗token很多,但是差别不是很大
所以我个人觉得可能是软件的问题,就来问问,也有可能是参水?但是水货能跑出真实模型的实力吗?
搞不懂。好复杂