首页全站导航手机版加入收藏关注我们
全站导航
  • 手游行业
  • 游戏问答
  • 新游前瞻
  • 游戏动态
  • 视频攻略
  • 新游预告
  • 热游视频
  • 周边视频
  • 资讯中心
  • 游戏攻略
  • 礼包中心
  • 热门攻略
  • 游戏专区
  • 手游合集
  • 手游分类
  • 手游开服
  • 手游开测
  • 全部手游
  • 苹果排行
  • 安卓排行
  • 单机排行
  • 网游排行
  • 福利美图
  • 吐槽八卦
  • 内涵GIF
  • 游戏截图
  • 游戏壁纸
关注我们
手游巴士

资讯

  • 资讯
  • 游戏
  • 视频
  • 礼包
  • 图片
  • 首页
  • 游戏中心
  • 手游行业
  • 新游资讯
  • 新游预告
  • 游戏活动
  • 综合资讯
  • 硬件资讯
  • 游戏攻略
  • 游戏评测
当前位置:首页 > 手游资讯 > 业界资讯 > GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

2023-11-02 12:50 来源:shouyoubus.com 作者:佚名

用手机看

扫描二维码随身看资讯 使用手机 二维码应用 扫描右侧二维码,您可以
1.在手机上细细品读~
2.分享给你的微信好友或朋友圈~

有网友找到了GPT-4变“笨”的又一证据。

他质疑:

OpenAI会缓存历史回复,让GPT-4直接复述以前生成过的答案。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

最明显的例子就是讲笑话。

证据显示,即使他将模型的temperature值调高,GPT-4仍重复同一个“科学家与原子”的回答。

就是那个“为什么科学家不信任原子?因为万物都是由它们编造/构造(make up)出来的”的冷笑话。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

在此,按理说temperature值越大,模型越容易生成一些意想不到的词,不该重复同一个笑话了。

不止如此,即使咱们不动参数,换一个措辞,强调让它讲一个新的、不同的笑话,也无济于事。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

发现者表示:

这说明GPT-4不仅使用缓存,还是聚类查询而非精准匹配某个提问。

这样的好处不言而喻,回复速度可以更快。

不过既然高价买了会员,享受的只是这样的缓存检索服务,谁心里也不爽。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

还有人看完后的心情是:

如果真这样的话,我们一直用GPT-4来评价其他大模型的回答是不是不太公平?

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

当然,也有人不认为这是外部缓存的结果,可能模型本身答案的重复性就有这么高:

此前已有研究表明ChatGPT在讲笑话时,90%的情况下都会重复同样的25个。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

具体怎么说?

证据实锤GPT-4用缓存回复

不仅是忽略temperature值,这位网友还发现:

更改模型的top_p值也没用,GPT-4就跟那一个笑话干上了。

(top_p:用来控制模型返回结果的真实性,想要更准确和基于事实的答案就把值调低,想要多样化的答案就调高)

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

唯一的破解办法是把随机性参数n拉高,这样我们就可以获得“非缓存”的答案,得到一个新笑话。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

不过,它的“代价”是回复速度变慢,毕竟生成新内容会带来一定延迟。

值得一提的是,还有人似乎在本地模型上也发现了类似现象。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

有人表示:截图中的“prefix-match hit”(前缀匹配命中)似乎可以证明确实是用的缓存。

那么问题就来了,大模型到底是如何缓存我们的聊天信息的呢?

好问题,从开头展现的第二个例子来看,显然是进行了某种“聚类”操作,但具体如何应用于深度多轮对话咱不知道。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

姑且不论这个问题,倒是有人看到这里,想起来ChatGPT那句“您的数据存在我们这儿,但一旦聊天结束对话内容就会被删除”的声明,恍然大悟。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

这不禁让一些人开始担忧数据安全问题:

这是否意味着我们发起的聊天内容仍然保存在他们的数据库中?

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

当然,有人分析这个担忧可能过虑了:

也许只是我们的查询embedding和回答缓存被存下来了。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

因此,就像发现者本人说的:

缓存这个操作本身我不太担心。

我担心的是OpenAI这样简单粗暴地汇总我们的问题进行回答,毫不关心temperature等设置,直接聚合明显有不同含义的提示,这样影响很不好,可能“废掉”许多(基于GPT-4的)应用。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

当然,并不是所有人都同意以上发现能够证明OpenAI真的就是在用缓存回复。

他们的理由是作者采用的案例恰好是讲笑话。

毕竟就在今年6月,两个德国学者测试发现,让ChatGPT随便讲个笑话,1008次结果中有90%的情况下都是同样25个笑话的变体。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

像“科学家和原子”这个更是尤其出现频率最高,它讲了119次。

因此也就能理解为什么看起来好像是缓存了之前的回答一样。

因此,有网友也提议用其他类型的问题测一测再看。

不过作者坚持认为,不一定非得换问题,光通过测量延迟时间就能很容易地分辨出是不是缓存了。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

最后,我们不妨再从“另一个角度”看这个问题:

GPT-4一直讲一个笑话怎么了?

一直以来,咱们不都是强调要让大模型输出一致、可靠的回答吗?这不,它多听话啊(手动狗头)。

GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

所以,GPT-4究竟有没有缓存,你有观察到类似现象吗?

参考链接:https://twitter.com/hammer_mt/status/1719150885559812379

责任编辑:落木

以上就是手游巴士为您提供《GPT-4更笨了!一个笑话讲八百遍:让换新的也不听》的详细内容,更多精彩内容请继续阅读上一篇《开机就是鸿蒙4!华为nova 11 SE预售:1949元起》

表羞涩嘛~喜欢就点我

分享吧~提高逼格:

相关阅读

  • 2023-11-02 18亿打造!《惊奇队长2》票房口碑双堪忧:评价仅为“一般”

  • 2023-11-02 Q3印度手机出货量:苹果未进前五 中国手机占比过半

  • 2023-11-02 《完蛋!我被美女包围了》女演员余冰慧拍小米14宣传片 网友点赞:双厨狂喜

  • 2023-11-02 《绝地求生》开发商将在韩国游戏展上展出《越来越黑暗》手游

  • 2023-11-02 《胜利女神》公开全新角色“小红帽”动作展示视频

  • 2023-11-02 果然又跳票了!《浩劫前夕》中文配音宣传片曝光

  • 2023-11-02 《英雄联盟》衍生游戏《努努之歌:英雄联盟外传》发售

  • 2023-11-02 开机就是鸿蒙4!华为nova 11 SE预售:1949元起

  • 2023-11-02 《无限世界》打造全题材战斗体系,海陆空全方位战斗!

  • 2023-11-02 GPT-4更笨了!一个笑话讲八百遍:让换新的也不听

  • 2023-11-02 《街头篮球》18周年庆联动决定:热血系列梦回青春

  • 2023-11-02 爆料称卡普空为《生化危机9》项目投入巨资 将是系列最大规模和预算游戏

  • 2023-11-02 波顿干红葡萄酒冠名《巅峰战舰》2023StarRoad星路联赛

  • 2023-11-02 《战神:诸神黄昏》DLC是真实存在的,或将会在今年年底公布

  • 2023-11-02 EA宣布《战地1》《战地5》Windows 7和8将在2023年1月停止了支持

  • 2023-11-02 万代《My Hero Ultra Rumble》化身为“我的英雄学院”的角色

  • 2023-11-02 SE与罗氏制药合作推出《勇者斗恶龙》怪物史莱姆为外形设计的眼药水

  • 2023-11-02 SUNSOFT公开复活LOGO视频 宣告其复兴之旅正式启动!

  • 2023-11-02 真相终将揭晓《波比游戏时间》第三章Steam页面上线

  • 2023-11-02 《进击的巨人》动画完结纪念书公布 豪华资料周边附赠

  • 2023-11-02 年度梗王集结,《率土之滨》“率斯卡”玩家欢乐趴玩转真三国

  • 2023-11-01 多项行业首创硬核科技,TRYFUN春风发布元力智能飞机杯2

  • 2023-11-01 AG获成都国资数千万元投资!进一步加深成都地域化属性!

  • 2023-11-01 《白荆回廊》iOS预订开启!预约就送专属定制头像

  • 2023-11-01 《宝可梦大集结》手游预约正式开启,限量测试招募中

热点推荐

  • 《胜利女神》公开全新角色“小红帽”动作展示视频《胜利女神》公开全新角色“小红帽”动作展示视频
  • 《胜利女神》的姐妹版?韩国二次元新作《守护女神》公开《胜利女神》的姐妹版?韩国二次元新作《守护女神》公开
  • 《Apex》第19赛季战斗通行证预告公布 排位赛新机制《Apex》第19赛季战斗通行证预告公布 排位赛新机制
  • 长安幻想庄生梦蝶:他一定是开挂了!怎么能放5招真技能?长安幻想庄生梦蝶:他一定是开挂了!怎么能放5招真技能?

热门游戏

  • 时逆

    时逆

    立即下载
  • 剑侠世界

    剑侠世界

    立即下载
  • 铁甲风暴

    铁甲风暴

    立即下载
  • 三国志奇侠传

    三国志奇侠传

    立即下载
  • 蜀山战神

    蜀山战神

    立即下载
  • 人气动漫大乱斗

    人气动漫大乱斗

    立即下载

热点资讯

更多+
  • 刘慈欣献声!《流浪地球》手游预约正式开启
    刘慈欣献声!《流浪地球》手游预约正式开启
  • 《天龙八部2:飞龙战天》手游更新活动开启
    《天龙八部2:飞龙战天》手游更新活动开启
  • 缤纷搭配 定格时尚《光遇》时装节:展示你的个性装扮
    缤纷搭配 定格时尚《光遇》时装节:展示你的个性装扮

小编热推

更多+
《无限世界》打造全题材战斗体系,海陆空全方位战斗!

满分攻略

  • 《崩坏:星穹铁道》无尽位面第4关高分攻略

    满分 《崩坏:星穹铁道》无尽位面第4关高分攻略

    04关
    查看全部
  • 《崩坏:星穹铁道》无尽位面第3关高分攻略

    满分 《崩坏:星穹铁道》无尽位面第3关高分攻略

    03关
    查看全部
  • 《崩坏:星穹铁道》无尽位面第5关高分攻略

    满分 《崩坏:星穹铁道》无尽位面第5关高分攻略

    05关
    查看全部

热门礼包

更多+

三国杀

三国杀 剩余:500/500 有效日期:2017-05-02

领取

三国杀

领取

三国杀愚人节礼包

三国杀愚人节礼包 剩余:500/500 有效日期:2017-05-31

领取

三国杀愚人节礼包

领取

三国杀独家礼包

三国杀独家礼包 剩余:500/500 有效日期:2017-07-26

领取

三国杀独家礼包

领取

三国杀移动版国庆礼包

三国杀移动版国庆礼包 剩余:500/500 有效日期:2017-11-29

领取

三国杀移动版国庆礼包

领取

一步高升新手礼包

一步高升新手礼包 剩余:491/1000 有效日期:2019-09-14

领取

一步高升新手礼包

领取

奶块首发大礼包

奶块首发大礼包 剩余:344/1900 有效日期:1970-01-01

领取

奶块首发大礼包

领取

奶块成长礼包

奶块成长礼包 剩余:297/1167 有效日期:2017-12-31

领取

奶块成长礼包

领取

植物大战僵尸2特权礼包

植物大战僵尸2特权礼包 剩余:232/300 有效日期:2018-05-31

领取

植物大战僵尸2特权礼包

领取

银河战舰代言人公测礼包

银河战舰代言人公测礼包 剩余:232/300 有效日期:2018-10-01

领取

银河战舰代言人公测礼包

领取

植物大战僵尸2豪华福包

植物大战僵尸2豪华福包 剩余:228/500 有效日期:2018-07-31

领取

植物大战僵尸2豪华福包

领取

热门合集

更多+
  • 适合女生玩的HTML5游戏

    查看合集
  • 2017手机游戏排行榜

    查看合集

手游资讯

NEWS
手游行业 手游活动 新游前瞻 综合资讯

最全攻略

RAIDERS
游戏资料 游戏攻略 硬件资讯 游戏问答

视频中心

VIDEO
视频攻略 新游预告 热门游戏 周边视频

游戏中心

GAME
手游合集 游戏分类 发号中心 热门专区

手游排行

TOP 100
安卓榜 苹果榜 单机榜 网游榜

手游巴士

手游巴士

  • 关于我们
  • 商务洽谈
  • 联系我们
  • 友情链接
  • 版权声明

Copyright © 2020-2022 手游巴士 shouyoubus.com, All Rights Reserved.赣ICP备2021011040号