第396章 演戏都不会演(2/2)

我们马上记住本站网址,www.wanxiangxs.cc,若被浏/览/器/转/码,可退出转/码继续阅读,感谢支持.

对就是对,错就是错,中间不留半点含糊的余地。

这麽一来,模型再想信口胡诌也诌不下去了。

姚先生听完,笑着瞥了李东一眼。

“我明白了。”

“你这是来拉我入夥的,对吧?”

李东笑得有点腼腆。

“姚先生,被您看出来了。”

姚先生摇了摇头。

“你的意思,我懂。”

“可我现在,是真没那个精力喽。”

“年轻那会儿,恨不得一天掰成两天用。”

“到了我这岁数,脑子还转得动,可身子骨已经跟不上了。”

“一个基座大模型从头 Train到尾,那是拿命去填的算力黑洞,我填不动了。”

老人的语气里带着点遗憾。

“能做的也就是给你们多带几个好苗子出来,往你们这边送几点新鲜血液,栽树的人不一定坐得上树荫,这就到顶了。”

李东的脸上,适时地浮起了一抹失望。

看着他这副表情,姚先生差点没绷住。

太假了。

这小子,连演戏都不会演。

不过姚先生也没去拆穿他,而是顺着他那点失望往下说道。

“你也别失望。”

“人,我倒是还能替你介绍一个,唐杰,唐教授。”

提起唐杰这个名字,智班的学生没有不熟的。。

水木计算机系的讲席教授,头顶着 ACM、AAAI、IEEE三料大满贯 Fellow。

早在 2006年,他就带着实验室搞出了 AMiner,一个能把全球学术情报连根拔起的大数据系统。

到了 2019年,外面的大厂还一窝蜂卷在计算机视觉里,他偏偏押宝了当时冷门的自然语言和知识图谱,一手拉起了智谱。

真正让他在国际上封神的,是那套 GLM架构。

那时候外面的大模型要麽学 OpenAI搞 GPT的自回归生成,要麽学谷歌搞 BERT的双向理解。

唐杰偏要把这俩路塞进一个壳子里,硬生生蹚出了一条“自回归填空”的野路子。

到了 2022年,水木和智谱一起直接开源了千亿参数的 GLM-130B。

那一年斯坦福搞了个大模型硬核评测,几十个巅峰模型里,唯一杀进榜单的亚洲面孔,就是它。

在准确性、公平性这些零样本测试指标上,它硬刚 GPT-3不落下风,有几项测试跑得甚至更稳当。

如今智谱都已经敲了锺,成了资本圈里逢人便提的“全球大模型第一股”,市值一度逼得国内几家老牌大厂都得回头看一眼。

一个做学问的教授,没去跟风炒概念,愣是把一件本该是矽谷巨头砸钱才玩得转的事,给做成了。

说起来这条以教授身份下场、把学术界的前沿直接干成产业界天花板的路子,几年前有个姓陆的院士也干过。

如今唐杰算是又把这条路干了一遍。

就在姚先生说完的瞬间,李东立马说道。

“好。”

这反应快得,倒让姚先生都愣了一下。

他又好气又好笑地摇了摇头。

到底是上午刚跟他过了几招的人,肚子里那股劲儿,藏都藏不住。