人工智能“迎战”奥数难题
发布时间:2024-09-03 02:05:49

  IMO中的问题涵盖了多个数学领域。但大多数IMO问题都是用英语编写的,需要翻译成AI能理解和验证的编程语言,才能让AI进行机器学习。

  继击败人类围棋大师和战略棋盘游戏顶尖高手之后,谷歌“深度思维”公司人工智能(AI)系统在英国巴斯举行的2024年国际数学奥林匹克竞赛(IMO)上,仅以1分之差与金牌失之交臂,获得了银牌。这是AI选手首次登上IMO领奖台。

  英国《自然》杂志网站在7月27日的报道中指出,“深度思维”正与其他公司竞相解决数学领域的疑难问题。近年来,IMO被广泛认为是对机器学习的一个挑战,也是衡量AI系统高级数学推理能力的理想基准。AI系统在今年IMO中的精彩表现,标志着其即将再下一城:在解决数学难题方面击败世界顶尖学生。

  “深度思维”公司训练了一个专门用于解答数学奥赛考题的AI系统,成功解答了6道竞赛题中的4道,获得28分(满分42分),达到本次比赛银牌获得者的水平。

  今年1月份,AlphaGeometry在解决欧几里得几何问题上,就已表现出奖牌级选手的水平。在今年的IMO比赛前,AlphaGeometry 2已经能够解决过去25年里83%的IMO几何问题,而其“前身”仅能解决53%。

  “深度思维”公司AI科学副总裁普什米特·科利指出,这是AI系统首次达到获IMO奖牌级别的性能。IMO主席格雷戈尔·多利纳尔也表示,AI最终将能比人类更好地解决大多数数学问题,其进步速度令人惊叹。

  几乎同一时间,软件公司Numina的科学家使用语言模型,赢得了AI数学奥林匹克奖(AIMO)的首个“进步奖”。

  但Numina团队在获奖后表示,要解决更难的数学问题,仅靠语言模型可能还不够。

  AlphaProof是一个自学习系统,其核心创新在于结合预训练语言模型与AlphaZero强化学习算法的策略。强化学习是机器学习领域一种重要的学习范式,系统可通过多次尝试找到自己的解题方法。

  这种方法需要用AI能理解和验证的语言编写大量问题,而大多数IMO问题都是用英语编写的。为解决这个问题,“深度思维”团队托马斯·赫伯特及其同事使用谷歌的大语言模型Gemini,将这些问题翻译成一种名为Lean的编程语言,以供AI进行学习。

  AlphaProof使用经过微调的Gemini模型,自动将数学问题转换为Lean语言,从而创建了一个涵盖不同难度级别的大型问题库。在强化学习阶段,系统每验证一个证明,就用它来强化AlphaProof的语言模型,提高其解决后续更具挑战性问题的能力。

  赫伯特表示,在挑战围棋游戏时,他们也采用了类似的方法:AI通过与自己对抗,来学习如何更好地玩游戏。结果显示,在某些情况下,AlphaProof能够在无限多的可能性中迈出正确的一步,展现出“灵光一闪”的能力。

  尽管AlphaProof的表现令人印象深刻,但其速度相对较慢,解决3个问题耗费了3天时间,而人类参赛者仅需4个半小时。此外,它也未能回答两个与组合数学有关的问题。

  英国数学家约瑟夫·迈尔斯审查了AI在本次IMO比赛中给出的答案。他指出,AlphaProof采取的这些技术能否予以完善还有待观察。

  英国伦敦数学科学研究所何杨辉称,AlphaProof这样的系统对于帮助数学家证明问题很有用,但它无法帮助研究人员确定需要解决和研究的问题。

  “深度思维”团队表示,他们正继续探索多种用于推进数学推理的AI方法。未来,数学研究者将与AI合作验证假说,尝试新方法来解决长期未解决的数学难题。他们也希望AlphaProof能够通过减少错误响应,帮助改进谷歌的大型语言模型。(记者 刘 霞)

  刘烈宏在启动仪式上指出,以数字技术为基础的产业数字化、以企业为载体的数字化成功转型,对数字经济创新发展至关重要。

  据了解,中国煤科首批遴选了35个项目落地实施知识产权资本化工作,涉及200余项知识产权、450余名科研人员,打通了“科技投入—科技研发—成果转化—收益分配”一体化路径。

  光明日报今日开设《我是这样做学问的》专栏,邀以探究真理、发现新知为毕生志业的求索者,将一路所循所思所感所悟与读者分享。

  我国12款“天”系列工业软件和航天领域首款智慧物联操作系统——“天鸿”操作系统成功发布。

  近日中国工程院有关专家前往安徽省淮南市,对采煤沉陷区水面种植重点项目阶段性成果进行评估。

  白皮书除前言和结束语外分为六个部分,分别是新时代中国能源转型之路、厚植能源绿色消费的底色、加快构建银河集团网址登录能源供给新体系、大力发展能源新质生产力、推进能源治理现代化、助力构建人类命运共同体。

  全国农田建设现场会28日在内蒙古自治区巴彦淖尔市召开。会议强调,要坚决扛起抓好高标准农田建设的政治责任,认真开展高标准农田建设工程质量“回头看”和专项整治行动,

  国家卫生健康委29日发布的《2023年我国卫生健康事业发展统计公报》显示,我国人均预期寿命达到78.6岁,孕产妇死亡率下降到15.1/10万,婴儿死亡率下降到4.5‰,均为历史最好水平。

  29日,在2024中国国际大数据产业博览会上,中国科学院地球化学研究所与阿里云联合发布国际首个“月球科学多模态专业大模型”(以下简称“月球专业大模型”)。中国科学院地球化学研究所研究员刘建忠介绍,在月球撞击坑年代和形态识别上,月球专业大模型的准确率已达到80%以上。

  按全国卫星导航定位基准站建设和服务“一张网”要求,整合自然资源系统卫星导航定位基准站资源的全国北斗高精度导航定位服务平台已经开通试运行。

  图为位于浙江省金华市的上山考古遗址公园发掘原址上再现的考古情景。临沂大学释光年代学实验室对水稻植硅体的测年工作并非一帆风顺,如何选择含有植硅体的沉积物就是个难题。

  近日,在海南省三亚崖州湾科技城,一场“跨界”展览别具一格。珐华彩莲池纹梅瓶、象形执壶等精美文物的复制品,与“探索一号”“探索二号”科考船和“深海勇士”号载人潜水器模型一同现身

  水清岸绿,鸟鸣啾啾,生态环境质量不断改善;山风劲吹,风机飞转,绿电点亮万家灯火;优化生产工序,使用环保材料,产业发展向绿色化迈进……

  我国科学家在野外科考工作中首次发现新疆伊吾县有戈壁熊分布。日前,中国林业科学研究院主持承担的第三次新疆科考项目——新疆自然保护地调查与国家公园潜力区科学考察阶段总结和专家咨询会召开。

  日前,中国科学技术大学谈鹏教授、肖旭博士后研发出了一种“火星电池”,以火星大气成分(模拟参照火星上大气成分比例配比)作为电池反应燃料物质,可实现高能量密度和长循环性能。相关研究成果发表在《科学通报》上。

  针对获得职称的农牧民,呼和浩特市从政策支持、教育培训、职业发展、奖补倾斜等多方面入手,形成全方位、多层次的支持体系,强化人才激励措施。

  气候变化、环境灾难和战争等因素可能会对生物资料库构成威胁。为了找到新的样本“避难所”,有人提议在月球上建造此类生物资料库,即所谓的“月球方舟”。

  中国科学技术大学热科学和能源工程系谈鹏特任教授团队开发出一种火星电池,由火星大气成分作为电池反应燃料物质,可实现高能量密度和长循环性能。

  经过十多年科研攻关,吉庆油田已初步构建起陆相页岩油勘探开发综合技术体系。今年,吉庆油田将完成100口页岩油钻井,新建产能60万吨以上。

  截至目前,青田县瓯江鼋数量达到121只,标志着通过人工助孵技术繁育的瓯江鼋形成种群规模。


本文由:银河国际医疗设备有限公司提供