第401章 李东教授真是“好人”(7/8)

……

平心而论,这事不能怪万斯博士不够顶尖。

要知道,今天这座展厅里,坐着全世界小半个ai产业的智商天花板。

可把这几百号人的纯数学功底统统加在一起,也未必够得上李东一个打的。

所以李东随随便便偷换一个高维流形的概念,或者把他那套降维算法上的微分算子拆下来,重新包装进ai的黑话语境里,听上去就格外自洽,格外有第一性原理的降维打击感。

什麽“指纹要扔进正确的正交基底”,什麽“强行让针从谱的尾巴跃迁到谱头”。

句句符合直觉,字字切中痛点。

可你真要拿着这几句话回实验室调参落实,烧上三个月a100就会发现一个朴素的事实……

针要是他妈的知道怎麽自主跃迁去谱头,它还能叫针吗?

这就好比一位物理宗师告诉你,实现常温超导的诀窍,是在电子撞击晶格之前,先给它规划一条没有电阻的绝对平滑轨。

听的时候,醍醐灌顶,以为找到了发《nature》的捷径。

跑的时候,loss爆炸,连显卡都得烧冒烟。

……

而李东对此,毫无心理负担,毕竟李东也没骗人,只是给他们的路全是真的,但是没有细节而已。

他端着那杯早就凉透的咖啡,在偌大的展厅里,一个挨着一个地薅了过去。

在一家以sora类视频生成闻名的多模态公司展台前,他同对方的预训练负责人,切磋了一下“高维时序数据的流形展开”。

十分锺後,记忆宫殿的书架上多了一份文献。

【抛弃基於像素重建的视频生成范式,将其重构为可交互的world model(世界模型):输入action,自回归预测next state,让agent在隐空间的“世界梦境”里,率先完成对现实物理法则的低成本试错与先验对齐。】

然後又在一家以模型可解释性研究出名的初创实验室那边,他同一位核心研究科学家,探讨了“高维隐空间内的稀疏结构”。

书架上又多了一份……

【模型内部的特征存在严重的polysemanticity,单个神经元往往身兼数职。】

【引入稀疏自编码器作为外挂字典,将纠缠的特征解耦成单义的线性组合,再沿着计算图回路,对大模型的幻觉或越狱行为执行定点编辑。】

再往後,是一位做非自回归生成架构的独角兽cto,聊的是“并行拓扑展开与采样收敛路径”。

灵感再次+1

【打破语言模型从左至右next-token prediction的强制因果约束。】

【将全局序列视为高斯噪声,引入diffusion架构全序列并行去噪,在迭代采样路径中,赋予模型在隐空间内反悔与自我纠错的非马尔可夫演化能力。】

一圈聊下来,记忆宫殿大厅里的临时书架,已经密密麻麻堆满了。

李东站在书架前,望着那一份份字迹崭新的文献,由衷地发出了一声感叹。

这些开源布道者,真是大好人啊。

而与此同时,展厅的各个角落里。
本章未完,请翻下一页继续阅读.........

附近章节