返回

第421章 未央

首页
关灯
护眼
字:
大
中
小
上一页 回目录 下一页 进书架
……

    就在“国外ai即将统治世界”的言论愈演愈烈的时候。

    某天,frontiermath第四级的榜单,悄悄地刷新了一下。

    一个陌生的大模型出现在了榜单的首位,它的名字叫做——未央!

    它背後跟着的数字是73.4%。

    这是个什麽概念呢?

    那个吹牛逼最厉害的gpt-6也才跑了48.7%。

    这已经不叫领先了,这叫断层。

    前面那个一骑绝尘,後面一群人连它的影子都够不着。

    最开始,没人把这个数字当真。

    跑分榜上闹乌龙,又不是头一回的事。

    多半是哪个新模型钻了题库的空子,要不就是评测脚本出了岔子,再不然,就是有人在背後刷榜……

    技术论坛里清一色全是这类的猜测。

    於是有好事者,拿着公开的那部分题目,自己动手复了一遍盘。

    结果这个数据居然是真的!

    紧接着,又有人在另外几张榜单上,看见了未央这个名字。

    putnambench,那六百七十二道用lean形式化写就的普特南竞赛题,排在最前面的,从来都是那几个烧钱烧到上千美元一道题的家夥。

    而未央挂上去的成绩,是六百七十二道,全解。

    一道不落,且每一道题後面,都有一份机器当场就能验过的完整证明。

    然後在大家吃惊的时候……

    minif2f上的四百多道奥赛级的形式化题目,也被它清了个干干净净。

    这两张榜,向来是机器证明这一脉的试金石。

    它们的题目虽是公开的,证明却必须一步一步由机器亲自验过,才算数。

    在这种地方,你糊弄不了任何人,蒙也蒙不过去。

    所以消息很快就在ai圈和数学圈里,一同传开了。

    谁也不知道这“未央”是打哪儿冒出来的,更想不通它凭什麽能在这几张榜上,把所有人都甩出这麽远。

    不过这种公开的跑分的大模型到底是哪家的总是有办法查到的。

    所以很快就有人把它给扒了出来……这模型出自燕大。

    燕大?

    要知道,上一个从华夏的大学

    (本章未完,请点击下一页继续阅读)
上一页 回目录 下一页 存书签