资讯
OpenAI史上最强!GPT-6一天攻破5道至今未解数学难题
📋总体概括
OpenAI发布号称品牌史上最强的GPT-6 Astra,训练在美国德州Stargate超算基地完成,动用超10万张GPU,并首次大规模以前代模型参与监督训练。在Epoch AI联合曼彻斯特大学发布的FrontierMath Erdős基准中,该模型在68道人类未解的Erdős难题里攻克5道,是唯一交出有效答卷的模型,GPT-5.6、Claude Fable 5.1等四款主流AI均为0分。测试要求Lean形式化证明并设300美元、72小时统一预算,试图排除背答案嫌疑。
⚡关键信息
- ▸OpenAI推出GPT-6 Astra,官方称其为智能水平最高、对齐效果最优的生成式AI模型
- ▸模型在德州Stargate超算基地训练,动用超过10万张GPU,首次大规模以前代模型参与监督训练
- ▸FrontierMath Erdős基准含68道人类悬而未决的Erdős数学难题,GPT-6 Astra攻克其中5道
- ▸GPT-5.6、Claude Fable 5.1等其余四款主流大模型在该测试中全部得0分
- ▸测试要求输出Lean形式化证明由内核自动核验,各模型统一300美元预算、限时72小时
🔥犀利点评
又是熟悉的剧本:官方定调「史上最强」、独一份的测试成绩、同行集体归零。攻破5道悬而未决猜想的含金量本该是诺贝尔级新闻,却由厂商发布会和基准论文同步造势,难免让人怀疑评测设计与被测者的亲密关系。Lean形式化验证确实堵死了「背答案」的路,这点值得肯定;但只要评测、算力和发布节奏都握在OpenAI手里,所谓代差就先当成营销看,等第三方独立复现再欢呼不迟。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →