六八读书

手机浏览器扫描二维码访问

第113章 意外的邀请(第1页)

相比效果显著,非常出色的老虎算法,移动端优化排序算法的效果要稍差一些。

因而孟繁岐并没有急着推动上线测试,而是等待结合AI语言解释模型的那一个更新准备一起推动。

目前针对语言问题所采用的通常是循环神经网络(RNN)和长短期记忆办法(LSTM),这两个工作都是上个世纪末的老办法了。

这两种方法简明好用,因而一直兴盛到2017年左右。

直到Transformer,也就是ChatGPT的T方法出现。

通常来说,大家都认为Transformer方法之所以能够迅速取代RNN和LSTM,主要是因为它更方便并行进行。

在多个设备上容易做到并行,这件事最核心的意义便是让规模庞大的版本成为可能,这也为后来ChatGPT这样的究极巨无霸模型奠定了基础。

“其实老版的RNN也有办法可以把并行做得很好,领域内对这件事有很大的误解。”孟繁岐皱着眉头思索道。

原本时间线,Transformer出来之后,所有人都放下了手头老方法的研究,拥抱了T方法。

可18年实际上有人专门做了RNN的高度并行,只可惜已经太迟了。

如果这个发现可以早一年的时间,可能RNN会长期作为T办法的竞争对手,我们也有可能看到ChatRNN的出现。

“早期的T方法需要很多数据,各种参数比较难调整,需要的计算能力也很庞大。”孟繁岐即便根据后来成熟的许多方法做了一个改进的版本,T方法在早期仍旧比较麻烦。

“好在谷歌的数据和算力都不缺,而我也比较熟悉各种经典的参数设置。”孟繁岐先写了一个雏形版本的T方法,进行了一下测试。

“不过,受限于现在显卡的显存,模型没有办法做得很大,除非我专门再去开发DeepSpeed这样的高级并行方式。”

在多张卡上训练模型,可能是为了追求速度,也可能是因为一张卡上放不下了。

其中,数据并行是最简单的,也就是不同的卡都在做同样的事情,每张卡上都会存放一个模型。

只不过输入的数据不一样,不同的卡做完运算之后,再一起整合更新。

就像是所有人都拿了同样的刀切不同的菜,最后把切好的食材堆在一起。

可有的时候,一张卡上根本就放不下模型,这样的情况就比较麻烦了。因为一个人根本拿不动这把刀了,需要多人协作。

可以把每一层拆分到不同的卡上,也可以把不同层分配到不同的卡上,如此一来,其实是用多卡实现了类似单卡训练的效果。

热门小说推荐
他们的玩物

他们的玩物

本书导航站:n2qq。本书备用站:xyhuwu8c0因书包被同学丢进男厕所后,引发的一系列被操的故事。女主身娇体弱易推倒,男主们操了都说好。解锁各个场景各种姿势,花样繁多种类复杂,大型修罗场。穷酸女和一堆少爷们的故事,男主均是极品男神级别,前期虐女身,后期火葬场。...

我的师傅每到大限才突破

我的师傅每到大限才突破

我的师傅每到大限才突破情节跌宕起伏、扣人心弦,是一本情节与文笔俱佳的武侠修真小说,我的师傅每到大限才突破-猪肉200斤-小说旗免费提供我的师傅每到大限才突破最新清爽干净的文字章节在线阅读和TXT下载。...

柯南里的捡尸人

柯南里的捡尸人

柯南里的捡尸人情节跌宕起伏、扣人心弦,是一本情节与文笔俱佳的都市言情小说,柯南里的捡尸人-仙舟-小说旗免费提供柯南里的捡尸人最新清爽干净的文字章节在线阅读和TXT下载。...

罗刹岛上觅芳踪

罗刹岛上觅芳踪

花朝节举国欢庆河西叛乱平复,主将岳振霆因赫赫战功荫封郡王,获代州封地。临行代州前,王妃携一双郡主护国寺祈福,途中郡王妃,小郡主于香车玉辇中人间蒸发。唯长女幸存。可这些又与宁安镇浣纱女南星有何关联?匠人姊妹金宝儿、金锦儿背负着青铜熔炉般灼热的家族秘辛,他们的命运与河西战场未冷的血痕交织成网。当命运的大船载着郡主岳清澄......

漂亮男孩

漂亮男孩

风流多金的李家大少爷养了个十八岁的小情人,藏着掖着从来没让人见过 小美人从穷地方来,没见识且学坏,轻而易举地被人哄上床 从此拿着每月三千块过上了传说中的包养生活 谈恋爱还是包养,小美人稀里糊涂地被睡了三年,还是没有搞明白 直到三年后的某一天,命运的齿轮转动,他发现,并不是人人都拿三千块 被白白睡了三年,一脚踢出曾经的家,小美人怀揣当了三年金丝雀存下的800元巨款,开始闯荡社会 李赫延X奚齐 风流大少爷天然渣VS自强不息小美人 大纲已写完,全文梗概已发,这次不立FLAG 与正文无关内容一律折叠 一句话简介:李老板的金丝雀要闹分手...

我是替身怎么了

我是替身怎么了

我是替身怎么了情节跌宕起伏、扣人心弦,是一本情节与文笔俱佳的其他类型小说,我是替身怎么了-幸运并蒂花-小说旗免费提供我是替身怎么了最新清爽干净的文字章节在线阅读和TXT下载。...