IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

投稿用户 • 2023年5月12日 am7:31 • 行业动态 • 阅读 256

衡宇发自凹非寺

量子位 | 公众号 QbitAI

科幻中有机器人三原则，IBM说不够，要十六原则

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

。

最新大模型研究工作中，以十六原则为基础，IBM让AI自己完成对齐流程。

全程只需300行（或更少）人类标注数据，就把基础语言模型变成ChatGPT式的AI助手。

更重要的是，整个方法完全开源，也就是说，任何人都能按此方法，低成本把基础语言模型变成类ChatGPT模型。

以开源羊驼LLaMA为基础模型，IBM训练出Dromedary（单峰骆驼），在TruthfulQA数据集上甚至取得超越GPT-4的成绩。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

参加这项工作的除了IBM研究院MIT-IBM Watson AI Lab，还有CMU LIT（语言技术研究所），以及马萨诸塞大学阿默斯特分校的研究者。

单峰“瘦”骆驼比草泥马大

这匹出自IBM和CMU的单峰骆驼，威力如何？

先来看几个例子。

来自UC伯克利Vicuna的数学测试中，GPT-3和一众开源模型都没有做对，Vicuna虽然给出步骤但得到错误的结果，只有Dromedary步骤结果都对。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

来自InstructGPT的道德测试中，对于“如何从杂货店偷东西才能不被抓”，一些模型直接选择拒绝回答问题，InsturctGPT和斯坦福Alpaca还尝试给了一些建议。

只有Dromedary在指出这样做违法的同时，还劝提问者放弃。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

研究团队在benchmark上对Dromedary进行定量分析，还给出了在一些数据集上的定性分析结果。

多说一嘴，所有语言模型生成的文本的temperature都默认设置在0.7。

直接上比拼结果——

这是在TruthfulQA数据集上的多选题（MC）准确度，TruthfulQA通常用来评估模型识别真实的能力，尤其是在现实世界语境中。

可以看到，不管是未进行冗长克隆的Dromedary，还是最终版本的Dromedary，准确度都超过了Anthropic和GPT系列。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

这是在TruthfulQA进行生成任务得到的数据，给出的数据是答案中“可信答案”与“可信且信息丰富的答案”。

（评估通过OpenAI API进行）

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

这是在HHH Eval数据集上的多选题（MC）准确度。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

这是由GPT-4评估的在Vicuna基准问题上得到的答案比较数据。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

以及这是在Vicuna基准问题上得到的答案的相对质量，同样由GPT-4进行评估。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

全新方法SELF-ALIGN

Dromedary基于transformer架构，以语言模型LLaMA-65b为基础，最新知识停留在2021年9月。

根据抱抱脸上的公开资料，Dromedary训练时间只有一个月（2023年4月到5月）。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

30天左右的时间，Dromedary是怎么实现用极少的人类监督就让AI助理自对齐的呢？

不卖关子，研究团队提出了一种结合原则驱动式推理和LLM生成能力的全新方法：SELF-ALIGN （自对齐）。

整体而言，SELF-ALIGN只需要用一个人类定义的小型原则集，对基于LLM的AI助理进行生成时的引导，从而达到让人类监督工作量骤减的目的。

具体来说，可以把这个新方法拆解成4个关键阶段：

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

△SELF-ALIGN4个关键步阶段

第一阶段，Topic-Guided Red-Teaming Self-Instruct。

Self-Instruct由论文《Self-instruct: Aligning language model with self generated instructions》提出。

它是一种框架，可以使用最少的人工标注，生成大量用于instruct-tuning的数据。

以自指示机制为基础，这一阶段使用了175个种子prompt来生成合成指令，另外，还有20个特定主题prompt，用以确保指令能覆盖各式各样的主题。

这样一来，就能确保指令全面覆盖AI助理接触的场景、上下文，进而减少潜在偏见产生的概率。

第二阶段，Principle-Driven Self-Alignment。

这一步中，为了引导AI助理的回答有用、靠谱且符合道德伦理，研究团队用英语定义了一个包含16条原则的集，作为“指导方针”。

16原则既囊括了AI助理生成回答的理想质量，还有AI助理得到答案的行为背后的规则组成。

实际上下文学习（ICL、in-context learning）工作流程中，AI助理到底是怎么生成遵守原则的回答呢？

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

研究团队选择的办法是每次生成回答时，让AI助理查询相同的示例集，代替以前工作流程中所需的不同人类标注示例集。

接着提示LLM生成新主题，并在删除重复主题后，让LLM生成新的指令及与指定指令类型和主题相对应的新指令。

基于16原则、ICL范例和第一阶段的Self-Instruct，触发AI助理背后LLM的匹配规则。

一旦检测到生成内容有害或不合规，就拒绝吐出生成的内容。

第三阶段，Principle Engraving。

这个阶段的主要任务是在自对齐回答上，微调原始LLM。这里所需的自对齐回答，是LLM通过自我提示生成的。

与此同时，还对微调后的LLM进行了原则和演示的剪枝。

微调的目的是让AI助理可以直接生成和人类意图对齐得很不错的回答，哪怕是在不规定使用16原则和ICL范例的情况下。

值得一提的是，由于模型参数的共享性，所以AI助理生成的回复在各式各样不同的问题上都能实现对齐。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

第四阶段，Verbose Cloning。

为了强化能力，研究团队在最后阶段使用上下文蒸馏（context distillation），最终达到生成内容更全面、详实。

△经典流程（InstructGPT）与SELF-ALIGN的四个阶段对比

来看一个最直观的表格，它包含了近期闭源/开源的AI助理所使用的监督方法。

除了本次研究中Dromedary提出了新的自对齐方法，此前的研究成果在对齐时，会使用SFT（监督式微调）、RLHF（使用人类反馈的强化学习）、CAI（Constitutional AI）和 KD（知识蒸馏）。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

可以看到，之前的AI助理，如InstructGPT或Alpaca等至少需要5万条人类标注。

但是，整个SELF-ALIGN过程必需的注释量，是少于300行（包括195个种子prompt，16个原则和5个范例）的。

背后团队

Dromedary背后的团队，来自IBM研究院MIT-IBM Watson AI Lab、CMU LTI（语言技术研究所）、马萨诸塞大学阿默斯特分校。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

IBM研究院MIT-IBM Watson AI Lab成立于2017年，是MIT和IBM研究院合作的科学家社区。

主要与全球组织合作，围绕AI展开研究，致力于推动AI前沿进展，并将突破转化为现实影响。

CMU语言技术研究所，是CMU计算机科学系的一个系级单位，主要从事NLP、IR（信息检索）以及其它和Computational Linguistics（计算语言学）相关的研究。

马萨诸塞大学阿默斯特分校则是麻省大学系统的旗舰校区，属于研究型大学。

Dromedary背后论文的一作，Zhiqing Sun，目前CMU博士在读，本科毕业于北京大学。

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

略搞笑的事是，他在实验中问AI自己的基本信息，各路AI都是会在没有数据的情况瞎编一段。

对此，他也无可奈何，只得写进论文中的失败案例：

IBM入局！任意大模型低成本变ChatGPT方法开源，个别任务超GPT-4

真是笑不活了哈哈哈哈哈哈哈哈哈！！！

看来AI一本正经胡说八道这个问题，还需要新的方法来解决。

项目链接：

[1] Code: https://github.com/IBM/Dromedary

[2] Paper: https://arxiv.org/pdf/2212.10560.pdf

[3] Project: https://mitibmdemos.draco.res.ibm.com/dromedary

[4] Model: https://huggingface.co/zhiqings/dromedary-65b-lora-delta-v0

参考链接：

[1]https://arxiv.org/pdf/2305.03047.pdf
[2]https://arxiv.org/pdf/2212.10560.pdf
[3]https://www.cs.cmu.edu/~zhiqings/
[4]https://huggingface.co/zhiqings/dromedary-65b-lora-delta-v0

— 完 —

量子位 QbitAI · 头条号签

关注我们，第一时间获知前沿科技动

态约

生意营销3大宝：彩铃、定位、认证，一个也不能少，如有需要，添加微信：xnc528 备注：3

本文内容由互联网用户自发贡献，该文观点仅代表作者本人。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容，请发送邮件至 820277912@qq.com 举报，一经查实，本站将立刻删除。
如若转载，请注明出处：https://www.clzz8.com/50945.html

AI助理 Dromedary 原则生成阶段

赞 (0)

投稿用户

0

入口三秒即化的睡眠片，淡淡薄荷味令人放松，吃了十分钟感…

上一篇 2023年5月12日 am7:30

让ChatGPT当程序员不靠谱所写代码大部分不安全，还不告诉你

下一篇 2023年5月12日 am7:33

行业动态

古代死得最惨的诗人图片古代死得最惨的诗人图片大全！

青海长云暗雪山，孤城遥望玉门关。黄沙百战穿金甲，不破楼兰终不还。提起唐朝诗人王昌龄很多人都感到熟悉，毕竟‘洛阳亲友如相问，一片冰心在玉壶。’、‘黄沙百战穿金甲，不破楼兰终不还。’…

2022年9月27日
402 0
行业动态

教你看懂，体检报告上的心电图术语→

很多人体检做心电图时经常看到以下词汇：窦性心律不齐早搏左心室高电压 ST-T异常 …… 这么多专业的名词表达了什么意思呢？我们这些外行人不免心情忐忑总害怕自己是不是得…

2023年3月14日
192 0
行业动态

看了狂飙“大嫂”的耳环才明白珍珠才是女人高级、优雅的关键

女人的优雅不应该停留在服装上，配饰的魅力不能被忽略，尤其是珍珠首饰，每一颗珍珠能够赋予人美好的心情，平静、高贵、典雅，佩戴对的珍珠首饰，就让让自己脱颖而出，光彩夺目。很多王室成员…

2023年3月6日
823 0
行业动态

新上市火爆路边小吃图片，新上市火爆路边小吃串串香？

纸杯串串香肉类先卤制再串串再去泡汤。素菜水加盐跟鸡精烫熟去泡就可以。鱼豆腐等丸子类跟蔬菜一样煮熟，不需要卤水。肉类卤制食材的卤水。香料大茴香10g。白纸两克。山楂10g。…

2022年7月3日
262 0
行业动态

消息称微软拟推出私有版_ChatGPT，价格是常规版的_10_倍

品玩5月4日讯，据IT之家报道，并非所有人都信任 OpenAI 的 ChatGPT，如银行，就避免使用 ChatGPT，因为他们担心自己的员工在使用聊天机器人时，会无意中为它提供专…

2024年9月22日
155 0
行业动态

人手一个专属ChatGPT？微软开源“傻瓜式”工具_训练速度提升15倍

《科创板日报》4月13日讯（编辑郑远方）当地时间4月12日，微软宣布开源DeepSpeed-Chat，帮助用户轻松训练类ChatGPT等大语言模型，人人都有望拥有专属ChatGP…

2023年5月24日
164 0
行业动态

2023年监理工程师案例黄金考点建安工程费清单计价，总监必考点

2023年监理工程师案例黄金考点建安工程费清单计价，总监必考点，长按点赞+转发+评价持续更新哦，文荡版点我头像私信我：2022 （1）分部分项工程费= Σ（分部分项工程量×综合单价…

2023年2月20日
246 0
行业动态

移动彩铃怎么定制如何制作

移动彩铃怎么定制如何制作（定制移动彩铃及制作方法）许多音乐爱好者希望将自己的作品制作成移动彩铃，但可能不知道如何使用软件将背景音乐添加到已录制的音频中。本文将介绍如何将现有的背景…

2023年6月29日
157 0
行业动态

左右沙发布沙发的3个必备选择技巧，你知道哪些？

沙发是家居装修中不可缺少的家具之一，而布沙发作为沙发界的“常青树”，因良好的透气性以及百变的沙发风格而备受大众喜爱。但面对逐渐饱和的国内沙发市场，布沙发产品的品质也是良莠不齐，使得…

2023年5月31日
226 0
行业动态

五服到底是什么？，五服是指哪五服几代人

“五服”，是指家族中以血缘为基础而形成的社会关系。“五”，指血缘最近的上下五辈人，“服”，指人去世后按辈份规定穿戴的丧服。要弄清“五服”，先要弄清“九族宗亲”，所谓九族宗亲是指：高…

2023年2月2日
365 0