首页 快讯内容详情
轻量版ChatGPT训练方法开源围绕LLaMA打造,号称训练速度比OpenAI快15倍

轻量版ChatGPT训练方法开源围绕LLaMA打造,号称训练速度比OpenAI快15倍

分类:快讯

标签: # www.a55555.net彩票网

网址:

SEO查询: 爱站网 站长工具

点击直达

Meta宣布推出LLaMA才三天,业界就出现了把它打造成ChatGPT的开源训练方法,号称比ChatGPT训练速度最高快15倍。 

LLaMA是Meta推出的超快超小型GPT-3,参数量只有后者的10%,只需要单张GPU就能执行。 

把它变成ChatGPT的方法名叫ChatLLaMA,基于RLHF(基于人类回馈的强化学习)进行训练,在网上很快掀起了一阵热度。 

ChatLLaMA - an open-source implementation of LLaMA based on RLHF.Claims a 15x faster training process than ChatGPT. It allows users to fine-tune personalized ChatLLaMA assistants.https://t.co/puc3BF1JSU pic.twitter.com/bpZBbxoOfV

— elvis (@omarsar0) February 27, 2023

所以,Meta的开源版ChatGPT真的要来了吗?

事情倒也没那么简单。 

把LLaMA训练成ChatGPT的「开源方法」

点进ChatLLaMA专案主页来看,会发现它实际上整合了四个部分—— 

DeepSpeed、RLHF方法、LLaMA和基于LangChain agent产生的资料集。 

其中,DeepSpeed是一个开源深度学习训练最佳化库,包含名叫Zero的现存最佳化技术,用于提升大模型训练能力,具体指帮模型提升训练速度、降低成本、提升模型可用性等。 

RLHF则会采用奖励模型来对预训练模型进行微调。奖励模型即先用多个模型产生问题问答,再依靠人工对问答进行排序,让它学会评分;随后,基于奖励学习给模型产生的回答进行评分,透过强化学习的方式增强模型能力。 

LangChain是一个大语言模型应用开发库,希望将各种大语言模型整合起来,结合其他知识来源或运算能力创建一个实用的应用程式。LangChain agent则会像思维链一样放出GPT-3思考的全过程,将操作记录下来。 

,

Google-Drive电报群www.tel8.vip)是一个Telegram群组分享平台。Google-Drive电报群包括Google-Drive电报群、telegram群组索引、Telegram群组导航、新加坡telegram群组、telegram中文群组、telegram群组(其他)、Telegram 美国 群组、telegram群组爬虫、电报群 科学上网、小飞机 怎么 加 群、tg群等内容。Google-Drive电报群为广大电报用户提供各种电报群组/电报频道/电报机器人导航服务。

,

这时候你会发现,最关键的依旧是LLaMA的模型权重。它从哪里来? 

嘿嘿,自己去找Meta申请吧,ChatLLaMA并不提供。(虽然Meta声称开源LLaMA,但依旧需要申请)

所以本质上来说,ChatLLaMA并不是一个开源ChatGPT专案,而只是一种基于LLaMA的训练方法,其库内整合的几个专案原本也都是开源的。 

实际上,ChatLLaMA也并非由Meta打造,而是来自一个叫做Nebuly AI的初创AI企业。 

Nebuly AI做了一个叫做Nebullvm的开源库,里面整合了一系列随插即用的最佳化模组,用于提升AI系统性能。

例如这是Nebullvm目前包含的一些模组,包括基于DeepMind开源的AlphaTensor演算法打造的OpenAlphaTensor、自动感知硬体并对其进行加速的最佳化模组……

ChatLLaMA也在这一系列模组中,但要注意的是它的开源license也是不可商用的。 

看完这个专案后,有网友表示,要是有人真搞到LLaMA的模型权重(程式码)就好了……

 当前暂无评论,快来抢沙发吧~

发布评论