量子位一水
传 OpenAI 将千禧年难题纳入基准测试,直指霍奇猜想
原标题:OpenAI这是拿千禧年难题当Benchmark刷啊。。。
模型65
市场消息称,OpenAI 正将目光投向以“霍奇猜想”为代表的千禧年数学难题,并尝试将其纳入模型的评估范畴。从奥数竞赛题步入未解的高阶数学猜想,AI 推理能力的度量尺度正经历一次跃迁,尽管相关细节仍有待官方验证。
为什么值得读
若传闻属实,以千禧年难题作为基准意味着前沿模型的验证方式正从已知解法推导转向纯数学未知边境。
标签
OpenAI推理模型霍奇猜想千禧年难题基准测试数学推理