他甚至还托了燕大的几个熟人去打听。
得到的回答都是,最近没见过李东的人。
没见过人?
这种回答骗骗别人还行,他怎麽可能信。
肯定是李东不愿意见他们而已。
想到这里李总只能独自叹了口气,又看起了国外的科技新闻。
……
就在“国外ai即将统治世界”的言论愈演愈烈的时候。
某天,frontiermath第四级的榜单,悄悄地刷新了一下。
一个陌生的大模型出现在了榜单的首位,它的名字叫做——未央!
它背後跟着的数字是73.
4%。
这是个什麽概念呢?
那个吹牛逼最厉害的gpt-6也才跑了48.
7%。
这已经不叫领先了,这叫断层。
前面那个一骑绝尘,後面一群人连它的影子都够不着。
最开始,没人把这个数字当真。
跑分榜上闹乌龙,又不是头一回的事。
多半是哪个新模型钻了题库的空子,要不就是评测脚本出了岔子,再不然,就是有人在背後刷榜……
技术论坛里清一色全是这类的猜测。
於是有好事者,拿着公开的那部分题目,自己动手复了一遍盘。
结果这个数据居然是真的!
紧接着,又有人在另外几张榜单上,看见了未央这个名字。
putnambench,那六百七十二道用lean形式化写就的普特南竞赛题,排在最前面的,从来都是那几个烧钱烧到上千美元一道题的家夥。
而未央挂上去的成绩,是六百七十二道,全解。
一道不落,且每一道题後面,都有一份机器当场就能验过的完整证明。
然後在大家吃惊的时候……
minif2f上的四百多道奥赛级的形式化题目,也被它清了个干干净净。
这两张榜,向来是机器证明这一脉的试金石。
本章未完,请翻下一页继续阅读.........