近日,菲尔兹奖得主、知名数学家Timothy Gowers在其博客发文探讨大语言模型(LLM)在数学研究中真正擅长的任务类型。他指出,目前LLM参与解决的许多著名数学问题,几乎都是通过构造反例来完成的,而不是给出完整严格...
Read MoreAnthropic公司研发的AI模型Claude在一个尚未正式发布的版本中,于黎曼猜想相关的核心问题上取得了令人瞩目的进展。黎曼猜想作为数学界最负盛名的未解难题之一,其核心在于黎曼zeta函数非平凡零点的分布规律,与素数...
Read More人工智能在数学领域再次取得引人瞩目的进展。近期的一系列突破显示,由20世纪传奇数学家保罗·埃尔德什提出的多个经典数学难题,正在被AI工具以前所未有的方式破解。这些成果的核心在于,AI系统运用了此前在应对此类...
Read MoreOpenAI的一个推理模型成功推翻了离散几何学中的核心猜想——“平面单位距离问题”(Planar Unit Distance Problem)。该猜想最早由20世纪著名数学家保罗·埃尔德什于1946年提出,在长达80年的时间里一直未被攻克,是离散...
Read More人工智能研究机构Epoch近日发布报告,确认其最新模型GPT-5.4 Pro成功解决了一个长期悬而未决的前沿数学开放问题——超图上的拉姆齐风格问题。该问题属于组合数学的核心领域,要求构造尽可能大的超图,使其不具备某个易...
Read MoreOpenAI近日详细公布了其AI模型在全部十道“First Proof”数学研究问题上的端到端证明尝试。First Proof是一项特定领域挑战,旨在测试AI系统能否生成完全可验证的数学论证。OpenAI的博客文章概述了该领域专家对模型提交...
Read More近日,数学界迎来一项里程碑式进展:著名数学家陶哲轩在其社交账户上宣布,埃尔德什问题#728在人工智能工具的辅助下首次被基本自主地解决。这一突破性成果并非简单复现已有文献,而是在埃尔德什问题网站社区重构问题...
Read More该GitHub仓库发布了一个包含239个科学推理问题的基准测试集,专门用于评估大语言模型(LLMs)在科学推理任务中的表现,特别是超越简单记忆的方程发现能力。这一基准测试的推出标志着AI领域对模型深层科学理解能力的量...
Read More