OpenAI承认ChatGPT变懒惰,正在修复该问题

OpenAI旗下的官方ChatGPT账号在社交平台表示,已经收到了大量用户关于GPT-4变懒惰的反馈。

这是因为自11月11日以来,OpenAI就没有更新过该模型。当然这不是故意的,大模型的行为是不可预测的,正在研究修复该问题。

图片

外界猜测,OpenAI可能是为了节省算力资源以及减少非法内容的输出,限制了GPT-4的部分功能。

GPT-4变懒惰的报道

该账号进一步指出,GPT-4并不是从11 月 11 日开始懒惰的,很可能已经持续了很长一段时间。模型的部分功被降级,日常使用很难觉察到。

图片

事实上,在OpenAI的官方开发者论坛中,已经有不少用户抱怨GPT-4变懒惰的问题。

一位名叫Jonathan的用户表示,自OpenAI的开发者大会之后,ChatGPT的输出上限是850个tokens,表现的非常懒惰

图片

在回答内容的时候,经常会空出一些占位符文本让用户自己来回答,并且在一条消息中很长时间拒绝回答内容。

关于ChatGPT的懒惰行为,Jonathan从技术层面进行了猜测:1)这种带空位符的回复模式,OpenAI可能正在测试新的推理方法。

2)OpenAI 正在托管许多不同上下文大小的模型,不想在一些没用且无聊的问题上浪费AI算力。

3)OpenAI内部的主网络在不同语境的 GPT4 中是相同的,这导致他们有了 gpt-4-4k、gpt-4-8k、gpt-4-16k......gpt-4-120k 等模型,所有这些模型都共享相同的 RLHF核心(人类反馈强化学习)和其他的私密数据。

图片

4)在完成调用之前,每个模型会对每个输入进行850-1024个推理步骤。这使得 OpenAI 可以一次性更新模型的批次,而不是在调用发生时按需更新。

这种模式可以节省从 CPU 到 GPU再到CPU的运行时间。

5)为了在 850-1024 个推理步骤内正确地向用户返回简明扼要的内容,OpenAI额外训练了一个RLHF核心网络,以便在简单问题时进行调用,以减少模型遍历节省算力资源。

总体来说,Jonathan的核心猜测就是,OpenAI主要是为了节省庞大的算力支出,才使得ChatGPT变得越来越懒惰。

一位名叫Matt用户在社交平台分享了ChatGPT变懒的证据,同时也验证了Jonathan在技术层面的猜测。

ChatGPT在回答问题时,只会回答部分内容,剩下的留给用户自己来想。

图片

例如,向ChatGPT提问,列出从现在到 2024 年 5 月 5 日的所有周末。

ChatGPT回答:我可以为你提供从现在到 2024 年 5 月 5 日之间的周数,但我无法为每一周列出详尽的清单。不过,我可以给你一个粗略的估计。

假设当前日期是 2023 年 11 月 27 日。从现在到 2024 年 5 月 5 日,大约有 24 周。

如果您需要更精确的计算,可以使用日期计算器或编程工具来计算两个特定日期之间的周数。

用户:你当然可以列出所有的星期?用这种格式:周一 4/12 - 周日 10/12 周一 11/12 - 周日 17/12。

ChatGPT:当然我可以按照你指定的格式展示日期,提供2023年11月27日至2024年5月5日的周数列表。然后加上详细的日期。

图片

也就是说,需要“哄着”ChatGPT才能让它回答更具体的内容。只用模糊的问题,让其回答海量内容已经不太可能了,这个问题在编程领域也比较明显。

图片

此外,在谷歌的APP商店中,最近ChatGPT也收到了不少1星的评分。就连OpenAI在谷歌地图的公司地址,也有人打一颗星,原因就是因为ChatGPT变懒惰了,可见此次情况的严重性。

图片

本文素材来源ChatGPT社交平台、OpenAI开发论坛、网络,如有侵权请联系删除

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.mzph.cn/news/213177.shtml

如若内容造成侵权/违法违规/事实不符,请联系多彩编程网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

企业欠税信息API:实现税务管理的智能化与高效化

前言 随着经济的发展和社会的进步,企业欠税问题逐渐凸显,成为制约经济发展的重要因素。为了解决这一问题,企业欠税信息API应运而生。它通过先进的技术手段,提供了一种全新的欠税信息查询方式,帮助企业实现税务管理的智…

nginx多ip部署

1.修改网卡信息自定义多个IP 进入/etc/sysconfig/network-scripts,编辑ifcfg-ens33网卡文件。将dhcp动态分配修改成static,同时添加ip地址子网掩码、网关和DNS。 修改完成后重启网卡,systemctl restart network 2.修改nginx配置文件 有几个…

Vue3无废话,快速上手

Vue3无废话&#xff0c;快速上手 认识Vue3 1. Vue2 选项式 API vs Vue3 组合式API <script> export default {data(){return {count:0}},methods:{addCount(){this.count}} } </script><script setup> import { ref } from vue const count ref(0) const…

【c++随笔16】reserve之后,使用std::copy会崩溃?

【c随笔16】reserve之后&#xff0c;使用std::copy会崩溃? 一、reserve之后&#xff0c;使用std::copy会崩溃?二、函数std::reserve、std::resize、std::copy1、std::resize&#xff1a;2、std::reserve&#xff1a;3、std::copy&#xff1a; 三、崩溃原因分析方案1、你可以使…

机器学习 | Python贝叶斯超参数优化模型答疑

机器学习 | Python贝叶斯超参数优化模型答疑 目录 机器学习 | Python贝叶斯超参数优化模型答疑问题汇总问题1答疑问题2答疑问题3答疑问题汇总 问题1:想问一下贝叶斯优化是什么? 问题2:为什么使用贝叶斯优化? 问题3:如何实现? 问题1答疑 超参数优化在大多数机器学习流水线…

浅析不同NAND架构的差异与影响

SSD的存储介质是什么&#xff0c;它就是NAND闪存。那你知道NAND闪存是怎么工作的吗&#xff1f;其实&#xff0c;它就是由很多个晶体管组成的。这些晶体管里面存储着电荷&#xff0c;代表着我们的二进制数据&#xff0c;要么是“0”&#xff0c;要么是“1”。NAND闪存原理上是一…

Spring日志完结篇,MyBatis操作数据库(入门)

目录 Spring可以对日志进行分目录打印 日志持久化&#xff08;让日志进行长期的保存&#xff09; MyBatis操作数据库(优秀的持久层框架) MyBatis的写法 开发规范&#xff1a; 单元测试的写法 传递参数 Spring可以对日志进行分目录打印 他的意思是说spring相关只打印INFO…

mysql中的DQL查询

表格为&#xff1a; DQL 基础查询 语法&#xff1a;select 查询列表 from 表名&#xff1a;&#xff08;查询的结果是一个虚拟表格&#xff09; -- 查询指定的列 SELECT NAME,birthday,phone FROM student -- 查询所有的列 * 所有的列&#xff0c; 查询结果是虚拟的表格&am…

中国各省、市乡村振兴水平数据(附stata计算代码,2000-2022)

数据简介&#xff1a;乡村振兴是当下经济学研究的热点之一&#xff0c;对乡村振兴进行测度&#xff0c;是研究基础。测度乡村振兴水平的学术论文广泛发表在《数量经济技术经济研究》等顶刊上。数据来源&#xff1a;主要来源于《中国农村统计年鉴》、《中国人口和就业统计年鉴》…

CRM系统选择技巧,什么样的CRM系统好用?

SaaS行业发展迅速&#xff0c;更多的企业逐渐选择CRM管理系统。打开搜索引擎&#xff0c;有非常多的结果。怎样在数十万个搜索结果中选择适合您的CRM系统&#xff1f;下面我们将聊聊&#xff0c;怎样选择CRM系统。 第一步&#xff1a;明确自身需求 重要性&#xff1a;每家企业…

仿照MyBatis手写一个持久层框架学习

首先数据准备&#xff0c;创建MySQL数据库mybatis&#xff0c;创建表并插入数据。 DROP TABLE IF EXISTS user_t; CREATE TABLE user_t ( id INT PRIMARY KEY, username VARCHAR ( 128 ) ); INSERT INTO user_t VALUES(1,Tom); INSERT INTO user_t VALUES(2,Jerry);JDBC API允…

nginx中Include使用

1.include介绍 自己的理解&#xff1a;如果学过C语言的话&#xff0c;感觉和C语言中的Include引入是一样的&#xff0c;引入的文件中可以写任何东西&#xff0c;比如server相关信息&#xff0c;相当于替换的作用&#xff0c;一般情况下server是写在nginx.conf配置文件中的&…

VR串流线方案:实现同时充电传输视频信号

VR&#xff08;Virtual Reality&#xff09;&#xff0c;俗称虚拟现实技术&#xff0c;是一项具有巨大潜力的技术创新&#xff0c;正在以惊人的速度改变我们的生活方式和体验&#xff0c;利用专门设计的设备&#xff0c;如头戴式显示器&#xff08;VR头盔&#xff09;、手柄、定…

idea 本身快捷键ctrl+d复制 无法像eclipse快捷键ctrl+alt+上下键,自动换行格式问题解决

问题 例如我使用ctrld 想复制如下内容 复制效果如下&#xff0c;没有自动换行&#xff0c;还需要自己在进行调整 解决 让如下快捷键第一个删除 修改成如下&#xff0c;将第二个添加ctrld 提示&#xff1a;对应想要修改的item&#xff0c;直接右键&#xff0c;remove是删…

分子生成领域的stable diffusion - GEOLDM

一、关于stable diffusion 很多人都知道stable diffusion&#xff0c;stable diffusion的出现改变了机器生成领域&#xff0c;让AI技术第一次无比的接近正常人。大语言模型&#xff0c;AIGC概念于是兴起。基于stable diffusion 大家开发了lora&#xff0c; hyperwork等微调技术…

[GWCTF 2019]我有一个数据库1

提示 信息收集phpmyadmin的版本漏洞 这里看起来不像是加密应该是编码错误 这里访问robots.txt 直接把phpinfo.php放出来了 这里能看到它所有的信息 这里并没有能找到可控点 用dirsearch扫了一遍 ####注意扫描buuctf的题需要控制扫描速度&#xff0c;每一秒只能扫10个多一个都…

聚类算法的性能度量

聚类算法的性能度量 聚类算法就是根据数据中样本与样本之间的距离或相似度&#xff0c;将样本划分为若干组&#xff0f;类&#xff0f;簇&#xff0c;其划分的原则&#xff1a;簇内样本相似、簇间样本不相似&#xff0c;聚类的结果是产生一个簇的集合。 其划分方式主要分为两…

API接口并发测试:如何测试API接口的最大并发能力?

本文将深入探讨API接口并发测试&#xff0c;介绍并比较不同的API并发测试工具&#xff0c;并分享如何有效测量和提高API接口在最大并发情况下的性能。了解如何应对高并发压力是保证系统稳定性和用户满意度的关键&#xff0c;让我们一起来探索这个重要的话题。 随着互联网的迅速…

float,flex和grid布局

页面布局往往会影响着整体的结构与项目的样式&#xff0c;通常我们用的布局方式有三种&#xff1a;float,flex,grid 1.float或position布局 1.1概念 首先对于一个页面来说&#xff0c;有浮动流&#xff0c;文档流&#xff0c;文本流这几种模式&#xff0c;而float布局则是…

【EI会议征稿中】第六届下一代数据驱动网络国际学术会议(NGDN 2024)

第六届下一代数据驱动网络国际学术会议&#xff08;NGDN 2024&#xff09; The Sixth International Conference on Next Generation Data-driven Networks 基于前几届在英国埃克塞特 (ISPA 2020) 、中国沈阳 (TrustCom 2021) 和中国武汉 (IEEETrustCom-2022)成功举办的经验&a…