清华唐杰新作WebGLM:参数100亿、主打联网搜索,性能超OpenAI WebGPT


(相关资料图)

清华唐杰团队的新作来了: WebGLM,一个参数100亿的联网问答聊天机器人(论文入选KDD2023)。 你可以问它任何问题,然后它将列举出网上(例如维基百科、相关官网)相关的文章链接,整理出答案。 比如:
ChatGPT的核心技术是什么?
或者:
谁提出的Music Transformer?它的原理是什么?
再或者:
原神3.5版本怎么样?
没有高薪工作,怎么在一线城市生活?(手动狗头)
…… 它都能给出有理有据的回答。 据介绍,在性能对比测试中,WebGLM的水平已经高于OpenAI135亿参数的WebGPT,在人类评估中,甚至与1750亿参数的模型不相上下。 那么,它是如何训练的?

可以上网的清华系WebGLM

据介绍,WebGLM的目标是通过Web搜索和检索功能,增强预训练大语言模型,同时可以进行高效的实际部署。 为此,作者基于三种策略进行开发。 首先是大模型增强检索器。 它主要是用于增强模型相关网络内容的检索能力,在给定查询的情况下查找相关引用,以便后面更好地准确回答问题。 它有两个阶段:粗粒度web搜索和细粒度LLM增强密集检索。 其次是自举生成器。 它利用GLM(比如清华之前发布的双语开源预训练模型GLM-130B)的能力为问题生成回复,提供详细的答案。 利用该生成器,作者得到WebGLM-QA——一个LLM自举引用和长程的QA数据集。 它通过上下文学习等策略进行清洗和过滤,最终包括45k的高质量过滤样本和83k的噪声样本。 WebGLM的backbone就是一个在该数据集上训练的GLM模型。 最后是基于人类偏好的打分器。 它通过优先考虑人类偏好而非昂贵的专家反馈来评估生成回复的质量,确保系统能够产生有用和吸引人的内容。 以上三大组件最终按顺序形成WebGLM的pipeline: 可以看到,正好三个模块,对应前面介绍的三部分,其中: LLM增强检索器会将前五个最相关的页面作为参考源,让自举生成器生成多个答案,最终打分器选出最可能符合人类偏好的那一个作为最终输出。

性能超OpenAI WebGPT

除了WebGLM本身,唐杰团队此次还提出了一个网络增强问答系统的评估标准,评估对象既包括参考文献,也包括最终回答。 其中前者衡量相关性、信息密度、真实性(无事实错误)、毒性(不含暴力色情等信息)和社会偏见程度这5个维度;后者则衡量流畅度、正确性、引用准确性、客观性和冗余程度。 他们用WebGPT(来自OpenAI,基于GPT-3进行微调)演示网站提供的272个问题进行对比评估,并招募了15个学历为硕士的志愿者打分。 最终结果如下: (“Rel.”、“ Den.”……分别对应上面说的10个指标。) 可以看到,尽管WebGLM的搜索结果略逊于WebGPT-175B,但远好于Perplexity.ai和WebGPT-13B(左边的参考文献评估)。 值得一提的是,WebGLM检索过程只使用了一些传统的基于单词的算法和两个累计参数量不超过300M的Contriever。 此外,WebGLM在计算性能和时间消耗方面也明显优于WebGPT-13B、并与175B不相上下。 而在最终结果方面,WebGLM在流畅度、真实性和冗余度方面均获得最高得分,正确性指标上则接近WebGPT-175B,远高于Perplexity.ai和WebGPT-13B。 作者表示,这表明WebGLM可以以更低的成本获得更高的性能。

部署与训练

WebGLM发布即开源。 要想部署它,需要从SerpAPI官网获得一个密钥,用于在搜索过程中获取搜索结果。 检索器的权重可从清华云上下载。 运行该模型的方式有两种:一是命令行界面,二是Web服务形式,并且包含WebGLM-2B和WebGLM-10B两种可选模型。 你也可以自己训练WebGLM,官方已提供好了生成器和检索器的训练数据供下载~

论文地址:https://arxiv.org/abs//2306.07906

GitHub主页:https://github.com/THUDM/WebGLM

来源:凹非寺,作者:丰色声明:此公号(ID:czfida)发布内容和图片的目的在于传播更多信息,版权归原作者所有,不为商业用途,如有侵犯,敬请作者与我们联系。

第七届金融科技与金融安全峰会

暨2023“光大杯”中关村番钛客金融科技国际创新大赛金融安全专场

将于2023年7月在北京隆重举办!

报名参会

大会咨询与合作请联系

吴老师18611627096(同微信)

共赴金融科技嘉年华

-2023“光大杯”中关村番钛客金融科技国际创新大赛-火热报名中-2023中国金融科技竞争力百强征集-全面启动

标签:

x 广告
当前快讯:浙e是哪里的车牌号(浙e)

1、浙E是浙江湖州的牌照。2、浙A杭州市、浙B宁波市、浙C温州市、浙D绍

世界即时:科画|清凉一“夏”,请查收你的预防中暑小贴士

中暑是指人体在高温和热辐射的长时间作用下,机体体温调节出现障碍,水

环球快报:河北唐山:多彩活动迎端午

6月20日,河北省唐山市丰润区白官屯镇福庆寺小学的孩子们通过包粽子、

当前资讯!麋鹿“迷路” 被电线缠住 消防紧急救助

近日,江苏南通海安一渔民报警称,在南通市海安市滨海新区滨海北路和览

香港一客机中止起飞 11人受伤 8人稳定3人已出院-天天播资讯

中新社香港6月24日电(记者曾平)国泰航空一班前往洛杉矶的客机中止起飞

要闻:西安经开区举办西安市“新征程、再出发”应急诗歌诵读暨安全文化演出活动

今年6月是第22个“安全生产月”,近日,围绕主题“人人讲安全、个个会

国际范儿,龙舟“划”向世界!端午节已成全人类共同文化遗产

金羊网

【病娇/纯爱】囚禁,只是为了更好的保护你(续二)

(图网侵删)我环顾四周,熟悉的街道,熟悉的青砖院墙。我的大脑开始闪

时刻发现挖掘潜在生活的力量,让力量在我们内心发根开花_世界快看点

​科学地生活,掌握着自身的命运,在永恒的能量面前,与命运共呼吸

重装系统工具哪个好用

要是大家的电脑系统不是很好用的话,还是比较推荐大家去重装系统的,下

x 广告

Copyright ©  2015-2023 亚洲都市网版权所有  备案号:京ICP备2021034106号-51   联系邮箱:5 516 538 @qq.com