OpenAI 公布一项很狂的内部测试:下一代重大模型的内部版本,针对数学与理论脑科学中长期未解的开放问题,产出了10项新结果。更夸张的是成本,按 GPT-5.6 Sol API 费率估算,整个过程使用的 token 约值 2,000 美元。这件事真正值得注意的,可能不是 AI「会不会解数学题」,而是它开始被拿来长时间探索:
· 尚未有标准答案的问题· 需要多步推理与反复验证的研究· 人类研究者可能花数月甚至数年的方向
当然,目前公开贴文还没有完整交代这10项结果分别是什么、如何验证,以及是否经过外部研究者确认。但如果这些成果最后站得住脚,AI的角色可能会从研究助理,逐渐走向「提出新知识的研究伙伴」。
我准备让我的AI给我找菜谱,我想觉做泡爪
