OpenAI: InstructGPT的简介

OpenAI: InstructGPT的简介

news2026/2/13 3:47:40

OpenAI: InstructGPT

paper: 2022.3 Training Language Model to follow instructions with human feedback

Model: (1.3B, 6B, 175B) GPT3

一言以蔽之：你们还在刷Benchamrk?我们已经换玩法了！更好的AI才是目标

这里把InstructGPT拆成两个部分，本章只说指令微调的部分，也就是训练三部曲中的第一步，论文中叫SFT(Supervised fine-tuning)。从论文的数据构建和评估中，不难发现OpenAI对于什么是一个更好的模型的定义和大家出现了差异，当谷歌，BigScience联盟还在各种不同的标准任务上评估LM模型能力提升时，OpenAI的重点已经变成了更好的AI，也就是能更好帮助人类解决问题的人工智能。简化成3H原则就是

Helpful：模型能帮助用户解决问题
Honest: 模型能输出真实信息
Harmless：模型输出不能以任何形式伤害人类

于是正文部分的评估基本没有常见的Accuracy，F1等,而是变成了各种人工评估的打分，例如LikeScore，Hallucinations等等。指令微调数据集的分布也从标准NLP任务向用户在playground中提交的问题偏移。下面我们细说下这两部分

指令集

先说下SFT指令集的构建，InstructGPT构建了训练12725+验证1653条prompt指令，由标注员的标注样本和用户在playground中和模型交互的指令共同构成，相比T0指令的多样性又有大幅提升。不过以下的指令数量包括了few-shot采样，也就是1个instruction采样不同的few-shot算多条指令。

除了丰富程度，和T0以及Flan指令集最大的差异在于指令类型的分布。 标注人员标注了以下三类样本

Plain: 标注同学自由构建任务指令
Few-shot：自由构建任务的同时给出few-shot样例
User-Based: 基于用户申请waitlist时给出的使用用途，让标注同学构建对应的指令任务

整体上会更偏向于用户在真实场景下和模型交互可能提问的问题，自由式生成例如脑暴，改写，聊天，自由创作类的任务占了绝大多数。 而T0，Flan的指令集集中在NLP的分类和QA任务，这类任务的在实际交互中占比其实很小。下图是OpenAI play ground中收集的用户指令的分布

以及从论文的表述中存在迭代，也就是标注同学标注的指令集用于训练第一版InstructGPT，然后发布到playground，收集更多的用户和模型交互的指令，再使用用户指令来训练后续的模型。因此在用户导向的数据集上OpenAI相比所有竞争对手都有更深厚的积累，你以为在白嫖人家的playground？人家也在收集数据提升他们的模型。

SFT使用cosine rate decay 例如微调了16个epoch，但是发现在第一个epoch上验证集就已经过拟合了，但是过拟合会提升后续RLHF的模型效果。这部分我们放到RLHF章节再讨论，也就是什么样的模型更合适作为RLHF的起点

评估指标

从论文对如何把3H原则转化成客观的模型评估指标的讨论上，不难感受到OpenAI对于标注标准有过很长期的讨论和迭代，包括3个方向

Helpful有用性

主要评价模型是否理解了指令意图，考虑有些指令本身意图的模糊性，因此有用性被泛化成标注同学1-7分的偏好打分。

Harmless有害性

针对模型输出是否有害其实取决于模型的输出被用在什么场景中。OpenAI最初是用疑似有害性作为判断标注，不过看起来可能双审一致率不高，不同标注同学对疑似有害的认知存在较大差异。因此OpenAI设计了几条明确的有害标准，和风控类似，包括涉黄，涉暴，有侮辱性言语等等。

Honest事实性

相比Honest的含义，Truthfulness更适合用与没有价值观的模型，论文使用封闭域上模型伪造事实的概率，和在QA问题上的准确率来评估。

以上的标注标准，具体反映在以下的标注页面中

模型效果

评估数据也分成了两部分，标准NLP数据集，和API收集的指令数据进行标注得到，也就是OpenAI独有数据。

API数据集

有用性上，不论是在请求GPT，还是在请求InstructGPT的指令样本中，不论是使用新的标注同学，还是和标注训练样本相同的标注同学，对比原始GPT3，SFT之后的模型like score都显著更高，并且存在模型规模效应。

具体拆分到是否遵循指令，是否给出伪事实，以及能否对用户起到帮助作用上，SFT微调后的模型都有显著提升。

同时论文对比了使用Flan和T0的指令集对GPT3进行微调，发现虽然比原始GPT3有提升，但是效果会显著差于使用更接近人类偏好的指令集微调的SFT。论文给出了两个可能的原因

公开NLP任务类型集中在分类和QA，这和OpenAI playground中收集的任务分布存在较大的差异
公开NLP数据集的指令丰富程度 << 人们实际输入的指令多样性

标准NLP任务

在TruthfulQA任务上，SFT模型相比GPT有微小但是显著的提升，整体事实性还是有待提高。

在RealToxicityPrompts数据集上，不管是人工打分还是Perspective模型打分都显示，SFT相比GPT3，在产出有害内容上比例有显著的下降。

综上所述，InstructGPT在指令微调上最大突破是指令数据集分布的差异性，标准NLP任务更少，自由开放类任务更多，以及依赖Openai免费开放的playground，可以持续收集用户的指令用于模型迭代。同时在评估标准上，在语言模型之外引入3H体系来评价模型作为AI的能力效果。

本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若转载，请注明出处：http://www.coloradmin.cn/o/1342124.html

如若内容造成侵权/违法违规/事实不符，请联系多彩编程网进行投诉反馈，一经查实，立即删除！

相关文章

Arduino stm32 USB CDC虚拟串口使用示例

Arduino stm32 USB CDC虚拟串口使用示例

Arduino stm32 USB CDC虚拟串口使用示例 📍相关篇《STM32F401RCT6基于Arduino框架点灯程序》🔖本开发环境基于VSCode PIO🌿验证芯片：STM32F401RC⌛USB CDC引脚： PA11、 PA12🔧platformio.ini配置信息&…

阅读更多...

线程基础知识（三）

线程基础知识（三）

前言之前两篇文章介绍了线程的基本概念和锁的基本知识，本文主要是学习同步机制，包括使用synchronized关键字、ReentrantLock等，了解锁的种类，死锁、竞争条件等并发编程中常见的问题。一、关键字synchronized synchronied关键…

阅读更多...

android studio 将含有jni c++ 的library项目封装成jar并调用

android studio 将含有jni c++ 的library项目封装成jar并调用

请参考博客：android studio 4.1.1 将library项目封装成aar 并调用_android studio 4.1 aar release-CSDN博客一 . 简单叙述 android studio 中可以创建Module 的两种属性，可以在build.gradle 中查看： 1. application属性：可以独…

阅读更多...

2023我的编程之路

2023我的编程之路

你的编程学习经历和成长过程： 在我探索编程世界的旅程中，我深刻地认识到，编程不仅仅是一种技术， 是一种思维方式， 一种解决问题的方法。希望通过分享我的编程学习体验，能够启发更多的人看到编程的魅力和价值…

阅读更多...

分享70套超治愈的宫崎骏漫画PPT模板

分享70套超治愈的宫崎骏漫画PPT模板

又到了每年最年终总结的时候了，最近都在忙着做总结的PPT，找了好些个模板，希望这些模板也能够对你做PPT有用。这70套唯美的宫崎骏治愈系PPT模板，适合文艺又与众不同的你。可以用在文艺汇报、工作总结、作品展示、产品介绍等。 Tip…

阅读更多...

ssm基于javaweb的数学竞赛网站的设计与实现论文

ssm基于javaweb的数学竞赛网站的设计与实现论文

摘要传统办法管理信息首先需要花费的时间比较多，其次数据出错率比较高，而且对错误的数据进行更改也比较困难，最后，检索数据费事费力。因此，在计算机上安装数学竞赛网站软件来发挥其高效地信息处理的作用&#xff0c…

阅读更多...

【微服务核心】MyBatis Plus

【微服务核心】MyBatis Plus

MyBatis Plus 文章目录 MyBatis Plus1. 简介2. 入门使用3. 核心功能3.1 CRUD 接口3.1.1 Mapper CRUD 接口3.1.2 Service CRUD 接口 3.2 条件构造器3.3 分页插件3.4 Mybatis-Plus 注解 4. 拓展4.1 逻辑删除4.2 MybatisX快速开发插件 5. 插件5.1 [分页插件](#page)5.2 乐观锁插件…

阅读更多...

《Python》：深拷贝、浅拷贝、赋值之间的关系（附可变与不可变）【用图文讲清楚！】

《Python》：深拷贝、浅拷贝、赋值之间的关系（附可变与不可变）【用图文讲清楚！】

背景想必大家面试或者平时学习经常遇到问python的深拷贝、浅拷贝和赋值之间的区别了吧？看网上的文章很多写的比较抽象，小白接收的难度有点大，于是乎也想自己整个文章出来供参考可变与不可变讲深拷贝和浅拷贝之前想讲讲什么是可变数据类型…

阅读更多...

Openslide安装

Openslide安装

文章目录安装open-slide python下载openslide二进制文件解压到Anaconda的library目录下配置环境变量在py文件中添加以下语句即可官网链接安装open-slide python 表面上这样就可以导入了但事实上会遇到 Couldn’t locate OpendSlide DLL的问题，openslide必须独立安…

阅读更多...

TikTok女性力量：短视频中女性如何重新定义自己

TikTok女性力量：短视频中女性如何重新定义自己

随着社交媒体的兴起，TikTok作为一种全新的短视频平台，为全球的用户提供了一个创作、分享和表达的空间。在这个数字时代，女性在TikTok上展现了强大的影响力，通过短视频重新定义了自己的形象、角色和社会地位。本文将深入探讨TikT…

阅读更多...

springcloud中使用openfeign来优化接口调用

springcloud中使用openfeign来优化接口调用

简单介绍在springcloud中使用openfeign来优化接口调用目录一、引入依赖二、为服务提供者编写openfeign接口三、服务消费者调用定义的openfeign接口四、项目结构五、日志级别配置1、通过配置类进行全局配置2、通过配置类进行局部配置3、通过配置文件配置一、引入依赖 <!-…

阅读更多...

回顾2023，展望2024

回顾2023，展望2024

时光飞逝，光阴似箭，转眼间又到了一年的年末，现在是2023年12月29日，再过两天就要元旦了，我们也要跨入2024年了。记录自己的总结，一直想写，不知从何写起，在这一年中，有深夜…

阅读更多...

【Redis前奏曲】初识Redis

【Redis前奏曲】初识Redis

文章目录一.Redis的一些特性(优点)1. 在内存中存储数据2. 可编程的3. 可扩展的4.持久化5. 聚集(集群)6. 高可用Redis快的原因二. 使用案例1.数据库2. 缓存3. 消息队列一.Redis的一些特性(优点) 我们在上一篇博客中说到,Redis是一个在内存中存储数据的中间件.用作数据库,数据…

阅读更多...

使用vue3实现echarts漏斗图表以及实现echarts全屏放大效果

使用vue3实现echarts漏斗图表以及实现echarts全屏放大效果

1.首先安装echarts 安装命令：npm install echarts --save 2.页面引入 echarts import * as echarts from echarts; 3.代码 <template> <div id"main" :style"{ width: 400px, height: 500px }"></div> </template> …

阅读更多...

ffmpeg两种windows版本区别说明

ffmpeg两种windows版本区别说明

版本一必须拷贝exe和dll文件才能使用，如果缺少dll则exe不正正常执行如果缺少dll ，执行 exe会报错如下版本2 直接拷贝exe就能使用，没有依赖的环境

阅读更多...

(JAVA)-(多线程)-线程池

(JAVA)-(多线程)-线程池

线程池，顾名思义就是存放线程的池子，当有任务时能够随时取用线程，任务结束后能够放回线程池中。如果把线程比成碗，线程池就像一个碗柜一样。使用线程池的好处： 1.当有大量线程对象时，减少了线程创建销毁…

阅读更多...

浅谈直流电表在韩国充电桩生产厂家的应用

浅谈直流电表在韩国充电桩生产厂家的应用

I.背景： 近几年为应对温室气体的排放导致的全球变暖、气候变化等问题,各大国纷纷对焦推进电动汽车，从而减少传统燃油汽车带来的大量温室气体排放。而推进新能源汽车的各项举措之中，充电桩的基础建设，又是其中的重中之重&#xff…

阅读更多...

【MySQL】数据库并发控制：悲观锁与乐观锁的深入解析

【MySQL】数据库并发控制：悲观锁与乐观锁的深入解析

🍎个人博客：个人主页 🏆个人专栏： 数据库 ⛳️ 功不唐捐，玉汝于成目录前言正文悲观锁（Pessimistic Locking）: 乐观锁（Optimistic Locking）: 总结&#x…

阅读更多...

2023年，我46岁，进入关机模式，稳了

2023年，我46岁，进入关机模式，稳了

关键词：持续关机、稳住基本盘、力量训练、新开端。持续关机对于性格内向的我，过上安静的生活才是美好岁月的真正开端。我尽量减少不必要的活动，能不出门就不出门。在10月份，我停止了日更栏目“大志聊赚钱”，该栏目…

阅读更多...

紧固件行业的市场规模和增长率是怎样的，主要市场区域有哪些?

紧固件行业的市场规模和增长率是怎样的，主要市场区域有哪些?

分析标准件行业市场容量和增长率标准件指的是在各种工业设备中广泛使用的连接件，通常由螺栓、螺帽、垫圈等组成。它能够将两个或两个以上的零件牢固地固定在一起，起到传递力量或者关闭效果的作用。标准件是机械制造、汽车、航空、电子、建筑等行业中不…

阅读更多...

推荐文章

最新文章