将本站设为首页
收藏开心官网,记住:www.happyvege.net
账号:
密码:

开心书阁:看啥都有、更新最快

开心书阁:www.happyvege.net

如果你觉得好,恳请收藏

您当前的位置:开心书阁 -> 重生之AI教父 -> 第113章 意外的邀请

第113章 意外的邀请

温馨提示:如果本章属于内容错误等情况,请点击下面的按钮发送报告,我们会在一分钟内纠正,谢谢

  相比效果显著,非常出色的老虎算法,移动端优化排序算法的效果要稍差一些。

因而孟繁岐并没有急着推动上线测试,而是等待结合AI语言解释模型的那一个更新准备一起推动。

目前针对语言问题所采用的通常是循环神经网络(RNN)和长短期记忆办法(LSTM),这两个工作都是上个世纪末的老办法了。

这两种方法简明好用,因而一直兴盛到2017年左右。

直到Transformer,也就是ChatGPT的T方法出现。

通常来说,大家都认为Transformer方法之所以能够迅速取代RNN和LSTM,主要是因为它更方便并行进行。

在多个设备上容易做到并行,这件事最核心的意义便是让规模庞大的版本成为可能,这也为后来ChatGPT这样的究极巨无霸模型奠定了基础。

“其实老版的RNN也有办法可以把并行做得很好,领域内对这件事有很大的误解。”孟繁岐皱着眉头思索道。

原本时间线,Transformer出来之后,所有人都放下了手头老方法的研究,拥抱了T方法。

可18年实际上有人专门做了RNN的高度并行,只可惜已经太迟了。

如果这个发现可以早一年的时间,可能RNN会长期作为T办法的竞争对手,我们也有可能看到ChatRNN的出现。

“早期的T方法需要很多数据,各种参数比较难调整,需要的计算能力也很庞大。”孟繁岐即便根据后来成熟的许多方法做了一个改进的版本,T方法在早期仍旧比较麻烦。

“好在谷歌的数据和算力都不缺,而我也比较熟悉各种经典的参数设置。”孟繁岐先写了一个雏形版本的T方法,进行了一下测试。

“不过,受限于现在显卡的显存,模型没有办法做得很大,除非我专门再去开发DeepSpeed这样的高级并行方式。”

在多张卡上训练模型,可能是为了追求速度,也可能是因为一张卡上放不下了。

其中,数据并行是最简单的,也就是不同的卡都在做同样的事情,每张卡上都会存放一个模型。

只不过输入的数据不一样,不同的卡做完运算之后,再一起整合更新。

就像是所有人都拿了同样的刀切不同的菜,最后把切好的食材堆在一起。

可有的时候,一张卡上根本就放不下模型,这样的情况就比较麻烦了。


  本章未完,请点击下一页继续阅读!
上一页 123下一页

看了《重生之AI教父》的书友还喜欢看

大佬每天都在扒疯批大小姐的马甲
作者:舒念是苏苏
简介: 【疯批大小姐x病娇贵公子,重生+马甲+女强+虐渣+救赎+团宠】圈里人谁不知道,虞家大...
更新时间:2025-02-04 20:00:28
最新章节:第1010章 番外:“我把我此生最珍贵的宝贝,交给你了。”
穿越年代,我靠异能致富发家
作者:水墨入酒
简介: 从末世直接魂穿了年代小可怜?苏晴表示,不怕,她有木系异能在身,来一个打一个,来两个揍...
更新时间:2025-02-04 20:13:00
最新章节:第四百一十三章 药粉
从海贼开始横推万界
作者:燕云因陀罗
简介: 又名《海贼:老子是伊姆》又名《诸天万界世界政府》穿越海贼世界,重生伊姆大人,掌控世界...
更新时间:2025-02-04 19:36:00
最新章节:第一千九百五十九章 世界级别的超凡战争规模!
重生之道修今生
作者:落北望南
简介: 他是一个资本家,却喜欢踏遍万山寻宝药!\n他又是一个道士,操控行业掌握无尽财富!
更新时间:2025-02-04 20:11:13
最新章节:第865章 温馨一家人
说好军转民,这煤气罐什么鬼?
作者:那年回响
简介: 王烨重生回到82年,华清毕业的他,主动请缨担任红星军工厂的厂长,进行军转民改革。
更新时间:2025-02-04 19:46:00
最新章节:第700章 元旦!导弹艇突袭
帝皇的告死天使
作者:莫格卓根
简介: 此乃银河人类帝国的第41个千年,这即是关于那个时代的故事;人类忘记了科学和技术的力量...
更新时间:2025-02-04 20:00:00
最新章节:第3417章 瑞恩!瑞恩!(三)