>


“我们现在在做一个东西,需要你这个方向的人。”



他转身走向白板,拿起马克笔,刷刷刷写了一串公式。



林之远凑过去看。



那是一个注意力权重的数学表达式。



所谓“注意力机制”,通俗地说,就是让AI在处理一段信息时,能像人类阅读一样,自动把目光聚焦在最重要的部分,而不是平均分配精力。



但这个公式和他在论文里见过的不一样。



传统的注意力机制,是让AI在翻译时“回头看”原文。



比如翻译一句英文时,每写一个中文词,都回头看看英文原句里哪个词最相关。



而白板上这个公式,做的事情完全不同:它让一句话里的每个词,都去“看”这句话里的其他所有词。



不是回头看别人,是自己看自己。



“你们在做……序列内部的自相关计算?”



林之远的声音不自觉地提高了。



任少卿和楼天城对视了一眼。



“差不多。”任少卿说。



“我们在探索一种全新的方式来让AI理解语言。不依赖传统的循环结构。就是那种必须一个词一个词按顺序处理的老方法,而是完全用注意力机制,让所有词同时互相‘看见’彼此。”



林之远的脑子嗡了一下。



不依赖循环结构?纯注意力?



这个想法太疯狂了。当前全世界做语言AI的人,没有一个敢把循环网络完全扔掉。注意力机制在所有已发表的论文里,都只是辅助模块,从来不是主角。



“你们怎么敢往这个方向想?”



任少卿推了推眼镜,眼神里闪过敬畏:



“不是我们敢想,是老板问了我们一个问题。能不能让序列内部自己看自己。安德烈顺着这句话推导了三个月,才有了这套数学框架。”



林之远和赵明满脸震惊。



那个神秘的幕后老板,到底是个什么怪物?



“验证过了?”赵明强忍震惊,凑过来盯着白板。



“初步实验跑通了。”楼天城说。



“但还有很多工程问题。计算量随文本长度的平方增长,显存吃得很凶。我们需要更多懂并行计算和矩阵优化的人。”



他看了林之远一眼。“也需要懂推荐系统里那套相似度计算的人。本质上是同一套数学,都是在海量信息里找到最相关的那一部分。”



凯文站在旁边,盯着白板上的公式看了足足两分钟。



然后他转过头,用英文对林之远说了一句话:



“他们领先我们至少一年。”



林之远没有反驳。



斯坦福、伯克利、谷歌大脑,所有人还在想怎么让注意力更好地辅助循环网络。



而这间藏在四川山区里的实验室,已经在问一个完全不同的问题:



我们还需要循环网络吗?


本章未完,点击下一页继续阅读

(3/4)

章节目录

高二分科,我选校花也选亿万身家所有内容均来自互联网,零点小说网只为原作者黑狗不爱吃汤圆的小说进行宣传。欢迎各位书友支持黑狗不爱吃汤圆并收藏高二分科,我选校花也选亿万身家最新章节