跳转到主要内容

GPT-5数学能力声明遭质疑,引发技术界争议

专家质疑GPT-5的数学突破

OpenAI近期关于GPT-5数学成就的声明在科技和学术界引发了广泛争议。争论焦点在于这个AI系统是真正解决了复杂问题,还是仅仅识别出了现有解决方案。

争议性声明

Image

图片来源说明:该图片由AI生成,图像授权服务来自Midjourney

争议始于OpenAI副总裁Kevin Weil发推称GPT-5解决了10个此前未解决的埃尔德什问题,并在另外11个问题上取得进展。这些以著名数学家保罗·埃尔德什命名的数学猜想代表了数论和组合数学中最具挑战性的难题。

然而,数学家兼埃尔德什问题网站维护者Thomas Bloom迅速反驳了这一说法。他澄清说,虽然这些问题在他的网站上被列为"开放"状态,但GPT-5实际上并未解决它们——它只是找到了包含现有解决方案的参考文献,而这些方案Bloom本人此前并不知晓。

行业反应

这一事件引发了顶尖AI研究人员的尖锐批评:

  • Meta首席AI科学家Yann LeCun称其为"自取其辱"
  • Google DeepMind CEO Demis Hassabis形容这是"令人尴尬的"

OpenAI研究员Sebastien Bubeck后来承认GPT-5只是定位到了包含解决方案的现有文献。但他坚持认为这仍然代表了文献检索能力的重大进步。

更广泛的影响

这场争议提出了重要问题:

  1. 应该如何衡量和传达AI成就
  2. 发现已有知识与创造新知识之间的区别
  3. 营销AI能力时的伦理责任

数学界强调,虽然找到晦涩的解决方案展示了有用的检索能力,但这不应与真正的解决问题突破混为一谈。

科技行业继续讨论如何在不夸大其词的情况下评估AI系统的数学推理能力的适当基准。

关键要点:

  • 🔍 GPT-5的数学声明遭到学术界和科技界专家的质疑
  • 📄 OpenAI副总裁声称的问题解决能力后来被证明只是文献检索
  • 🧩 发现与解决之间的区别对评估AI能力至关重要
  • 🤖 该事件凸显了准确表述AI进展面临的持续挑战