分享小说

手机浏览器扫描二维码访问

第113章 意外的邀请(第1页)

[]

相比效果显著,非常出色的老虎算法,移动端优化排序算法的效果要稍差一些。

因而孟繁岐并没有急着推动上线测试,而是等待结合aI语言解释模型的那一个更准备一起推动。

目前针对语言问题所采用的通常是循环神经网络(Rnn)和长短期记忆办法(LsTm),这两个工作都是上个世纪末的老办法了。

这两种方法简明好用,因而一直兴盛到2o17年左右。

直到Transformer,也就是chatgpT的T方法出现。

通常来说,大家都认为Transformer方法之所以能够迅取代Rnn和LsTm,主要是因为它更方便并行进行。

在多个设备上容做到并行,这件事最核心的意义便是让规模庞大的版本成为可能,这也为后来chatgpT这样的究极巨无霸模型奠定了基础。

“其实老版的Rnn也有办法可以把并行做得很好,领域内对这件事有很大的误解。”孟繁岐皱着眉头思索道。

原本时间线,Transformer出来之后,所有人都放下了手头老方法的研究,拥抱了T方法。

可18年实际上有人专门做了Rnn的高度并行,只可惜已经太迟了。

如果这个现可以早一年的时间,可能Rnn会长期作为T办法的竞争对手,我们也有可能看到net的出现。

“早期的T方法需要很多数据,各种参数比较难调整,需要的计算能力也很庞大。”孟繁岐即便根据后来成熟的许多方法做了一个改进的版本,T方法在早期仍旧比较麻烦。

“好在谷歌的数据和算力都不缺,而我也比较熟悉各种经典的参数设置。”孟繁岐先写了一个雏形版本的T方法,进行了一下测试。

“不过,受限于现在显卡的显存,模型没有办法做得很大,除非我专门再去开deepspeed这样的高级并行方式。”

在多张卡上训练模型,可能是为了追求度,也可能是因为一张卡上放不下了。

其中,数据并行是最简单的,也就是不同的卡都在做同样的事情,每张卡上都会存放一个模型。

只不过输入的数据不一样,不同的卡做完运算之后,再一起整合更。

就像是所有人都拿了同样的刀切不同的菜,最后把切好的食材堆在一起。

可有的时候,一张卡上根本就放不下模型,这样的情况就比较麻烦了。因为一个人根本拿不动这把刀了,需要多人协作。

可以把每一层拆分到不同的卡上,也可以把不同层分配到不同的卡上,如此一来,其实是用多卡实现了类似单卡训练的效果。

显然,前者会比后者容非常多,前者只需要在不同卡上复制这些模型,分别读取数据做运算就好。

而后者则需要根据不同的情况和设置拆分合并,一个不小心就会搞错。

看了下谷歌大脑的服务器,里面有好几批2o13款的gTx泰坦,这东西着实价值不菲。

考虑到当时的其他产品,6g的显存还是鹤立鸡群的。

比起孟繁岐自己重金购置的4g旗舰款,多出的2g显存,足够做很多其他的事情了。

用度换显存,孟繁岐又做了许多参数和信息在cpu和gpu上反复转移的操作。

因为在正式入职之前,谷歌大脑分配给他的显卡就已经有16张泰坦,这部分卡拨给孟繁岐独享,随时都可以使用。

热门小说推荐
我真不是全服第一

我真不是全服第一

我真不是全服第一恭喜玩家无敌捞金怪连赢999场竞技,现排名全服第一什么玩意我还没出手呢这就赢了...

倾城大小姐爱上我

倾城大小姐爱上我

简介关于倾城大小姐爱上我人生最绝望之际,倾城大小姐闯入了陈阳生活,和他度过了荒唐一夜。第二天,陈阳才现,这位倾城大小姐竟然是自己相亲对象的闺蜜。...

悠然的古代日常

悠然的古代日常

gtp1tgtdivnetkquot1tgtahrefquotbeginquot1t立即阅读gta1t...

四合院,从一无所有,到世界首富

四合院,从一无所有,到世界首富

简介关于四合院,从一无所有,到世界富从小吃摊到食品厂老板从修车到汽车工厂从一无所有到世界富…你就只差一个系统,我叫陈平安,我为自己代言。...

网游:每十小时创造一个BUG

网游:每十小时创造一个BUG

失手摔了一下游戏头盔,谁曾想,居然摔出一个金手指苏白手上多了个没人能看见的进度条,每隔1o个小时,就能创造一个bug第一个bug,苏白提前了全球玩家十个多小时,进入了游戏等所有玩家进入游戏后,苏白已经...

画堂春娇

画堂春娇

简介关于画堂春娇前世,卢雁依错信了人,连累卢家满门被诛,落得个在午门外腰斩的下场。没想到与她共赴黄泉的,是她畏之如虎的夫君摄政王秦牧原。重活一世,就换我偿你的一世深情,还要让仇人在绝望中用血还债。挑拨离间要将她送上死路的堂妹?奈何桥上请你独行。伪善的太后?那就揭露她毒害两代帝王的阴谋,在冷宫里孤独终老才适合她。京中的流言蜚语?卢雁依嫣然一笑我的夫君我来守护。而那能止小儿夜啼的摄政王,在她面前化作绕指柔。替她点绛唇画黛眉,亲手为她穿上护国夫人的诰命礼服,成为满京城贵女最艳羡的女人。...

每日热搜小说推荐