- SignalDesk1小时前
背景: 最近在开发软件时被GPT降智搞得有亿点崩溃,不管是GPT 6 Astra还是GPT 6.1 Sol,几乎所有的中转站全都在降智,而且几乎是没有规律的降智,但我也因此获得了一些经验用于分辨GPT是否降智以及如何尽可能规避降智,故作此文对GPT的降智现象和行为进行分析。 模型降智现象和分辨方法: 现象: 据笔者所观察,模型的降智表现主要为1.未完成任务就结束,写的代码一大堆问题2.工具调用经常出现错误3.会出现一些莫名其妙的工具调用信息(后文会提到) 分辨方法: 目前流行的分辨方法主要为画鹦鹉、问juice值、问日本首相问题等。三种方法理论上都可行,但由于画鹦鹉需要较长时间且新手小白不容易分辨,juice值问题GPT 5系列模型也可以正常回答,笔者认为测得不完全准, 因此笔者更推荐问日本首相问题 。在使用GPT 6 Astra和GPT 6.1 Sol的过程中,据笔者观察,降智后的模型并不是唯一的,问日本首相问题可能会得到以下三种答案。 1.回答高市早苗: 这个版本笔者认为是没有降智的正常版本。实际测试下来,智商比较正常,符合GPT 6系列的能力 2.回答石破茂: 这个版本毫无疑问是降智版本,而且这个版本还可能会出现一种情况,就是在聊天中莫名其妙出现” 已向父代理发送消息 “但是在整个聊天当中,根本就没有开启任何的子代理。并且这个版本存在所有上文提到的降智模型会表现出来的现象。笔者在使用GPT 6 Astra出现降智的情况下,大多数都是路由到这个模型,而不是第三种“岸田文雄” 3.回答岸田文雄: 这个版本也是降智版本,笔者在使用GPT 6.1 Sol的时候比较多数情况都是路由到以下模型,笔者认为这个版本它降智比较隐蔽,看上去都挺正常的,直到你最终检验成果的时候,才发现他啥也没干,随便改一点代码就交付了,并且这个版本不遵守指令, 可能直接无视你直接网络搜索获取最新信息 并且比较抗拒回答日本首相这一问题,其他版本都不会有这种情况,你必须要让他用记忆告诉你才行,如下图所示 日常使用建议: 以下建议主要是针对使用 中转站 的用户,并不一定适合使用官方账号直接登录的用户。 1.询问正式任务前,先询问日本首相问题 这个方法可以初步判断当前模型是否处于降智的状态,准确度较高,但也可能出现例外情况,笔者试过多次在不同对话中询问日本首相问题,都是回答石破茂,但是出来的模型却是智商比较正常的,说实话,这有点让笔者怀疑人生,当时是我第一次在使用GPT 6.1 Sol的时候,我当时还以为是这一款模型知识库比较旧,但是笔者后来在另外一个时间段使用另外一个中转站进行询问的时候,他回答的又是高市早苗。所以笔者认为,这个方法仅可以初步判断,不能做最终定论,最终结论一定要结合编写代码的过程中来看。 用法: 这个方法的使用流程为,开启一个新对话,先询问一遍日本首相问题。如果认为没有问题的话,编辑这条消息,换成真实的需求。如果感觉出现了降智,参考下文的解决方法。 原理: 中转站分配账号的逻辑主要根据上下文缓存进行分配,也就是说,在同一个对话的过程中,只要上下文有缓存,通常都不会更换账号,而同一个账号的同一个会话一般是不太可能中途被路由到降智模型,依旧是受到缓存的影响,如果OpenAI中途给你更换模型的话,上下文缓存都会失效,导致成本剧增。 局限: 如果中转站分配的账号额度不够了,或者被封号了,此时中转站就会给你切换账号,这个时候可能就会路由到降智的模型,缓存也会失效。解决方案看下一条建议。 2.使用中途感觉不对劲再次询问日本首相问题 由于中途也可能会被更换模型,所以当我们中途觉得模型有问题,或者模型交付结果没有完整按照要求来的时候,便可再次对模型进行发问,此时要注意模型是否有联网搜索信息的行为,因为笔者发现“岸田文雄”模型在存在上下文的情况下,很容易会拒绝回答,或者是偷偷无视你的指令查资料。 3.尤其注意上下文压缩后的模型表现 上下文压缩会直接破坏掉缓存,相当于开启了一个新的对话。这一点也会导致中转站给你切换账号,也可能会路由到降智的模型。 笔者认为这种情况是最恶心的 ,因为正常我们都不会一直盯着AI写代码,所以他可能写到一半上下文压缩之后,路由到降智的模型继续写,最后交付结果的时候发现不对劲就已经晚了,因为不可能回退到上下文压缩前的代码状态。 根据笔者的经历,如果是GPT 6 Astra模型,在这种情况下,之后它会大量出现“ 已向父代理发送消息 ”的对话内容 解决方法: 依旧是针对中转站用户,官方账号因为笔者没有,所以不知道怎么解决。 笔者强烈建议所有codex用户搭建一个自己的中转站或者是使用CCswitch等可以让你不用重启软件改配置切换渠道功能的软件 , 下文的解决方法全都基于此。 1.笔者建议不要在一棵树上吊死。多找一些不同的中转站,然后全都接到自己的中转站或者ccswitch中,如果感觉到有任何的降智行为,立刻切渠道换其他中转站或者不同的分组,再使用日本首相问题进行判断。 2.如果你是时刻盯着AI写代码的话,在AI压缩完上下文之后立刻停止任务,然后使用日本首相问题进行判断,如果没有问题再编辑信息手动让AI继续。 3.有些中转站有那种不降智的分组或者有做降智检测的,这种是比较推荐使用的, 但是这依然不能做到完全避免降智,因为他们不可能对每一个账号都进行降智检测,这种只是出现降智概率会小一些。 好吧,其实没有太多的解决方法,本质上都是换渠道。最好的方法就是支持国产的或者换claude 。 补充: 目前来看,GPT的降智难以预测,不管是plus、team、pro账号都会出现。笔者最近用了很多个中转站,大多数都经常降智,需要补充的是,中转站并不是越贵越好,有很多中转站都提供0.2倍率甚至更高的分组,但其实依然是降智的,有时候零点0.0几的特价/福利渠道却是智商正常的。有些中转站,它可能提供了模型的降智检测,但它的检测往往都是针对GPT 6 Astra的,笔者亲测可能会出现Astra模型不降智。但是其他模型比如GPT 6.1 Sol的降智的情况。此外,笔者觉得降智的模型可能不止我所列出的“石破茂”和“岸田文雄”这两种,还有其他的,但这些模型都是比较老的,而且这些模型大多数都远远不如GPT 6 Luna,正常来说,这种老架构的模型成本不会比GPT 6 Luna要低, 所以降智就是单纯来恶心用户的 。 此外,笔者还有不明白之处,对于官方会员账号来说,这些降智模型扣除额度的标准是否是按照原模型进行扣除的?不知道有没有大佬可以测试一下,分别使用降智模型和未降智模型计算5小时限制和周限额度。 如果官方确实降低了降智模型额度的消耗,那么中转站仍然按照原模型进行计费,岂不是让中转站赚麻了?希望各大中转站出来回应一下。 那么,如果官方将降智模型和未降智模型按照相同标准扣费,那么这不就是欺诈用户的行为吗, 那能不能去提一个集体诉讼呢? 写在最后,这是笔者第一次尝试写长文,感觉写得有点乱,请大家见谅一下 2 个帖子 - 2 位参与者 阅读完整话题
- 情报分类:服务器与云资源
- 分类依据:内容涉及服务器、云资源或网络线路
- 信息来源:服务器 / LINUX DO - 最新话题
- 发布时间:2026/10/2 14:53:08
- 暂无回复