站内关键词搜索入口

中国科研团队研发通矩模型,能出题解题,超国外同类系统

1月26日,有一个由北京通用人工智能研究院,也就是BIGAI,与北京大学心理与认知科学学院、北京大学智能学院、北京大学人工智能研究院以及北京大学武汉人工智能研究院联合构成的科研团队,他们研发出了“基于引导树搜索的奥数几何问题提出与解答系统”,该成果发表在了国际学术期刊《自然·机器智能》,人民网北京1月28日电 (记者赵竹青) 。

全球首个同时拥有具备自主出题以及自动解题双重能力的通用人工智能系统,是团队所开发的“通矩模型”,这一研究成果表明中国科研团队于自动化推理的逻辑核心领域达成关键技术自研,为AI辅助教育以及人工智能辅助数学研究跨出了坚实一步 。

中国科研团队研发通矩模型,能出题解题,超国外同类系统(图1)

一直以来,奥林匹克数学竞赛被视作人工智能逻辑推理能力的“检验标准”,2024年初,开发的曾引发全球震动,展现了AI在解题方面的巨大潜力,然而,本质上它是一个“被动解题者”,其训练非常依赖大规模的合成数据以及昂贵的计算资源,与之相较,我国科研团队自主研发的“通矩模型”不只是一个能够得满分交卷的“优秀学生”,更是一位能够创作出优美、新颖题目的“出题老师”。

阐述此研究情况的是,作为论文第一作者的北京通用人工智能研究院张驰博士,他介绍称:在实施的研究期间,我们察觉到了一种极为深刻的对偶性。当一个几何命题的证明难度相较于其构建复杂度明显更高的时候,它便拥有了作为奥赛题目的那种“审美价值”。凭借对这种对偶关系进行建模,“通矩模型”能够于浩如烟海的空间组合当中,精确地捕捉到那些符合人类数学家审美标准的高质量题目。而这样的情况在国际范围内是首次出现,达成了从“模仿解题”到“自主创造”的范式转变。

在具体的性能方面,“通矩模型”展现出了显著的效率优势,相较于那些需要庞大算力集群的情况,“通矩模型”仅仅依靠单张消费级显卡这一条件(比如RTX 4090),就能够在最多38分钟的时间范围内,解决将近25年全部相关的国际数学奥林匹克(IMO)几何方面试题,它的推理效率以及准确率都达到了世界顶尖的水准。除此之外,该系统凭借创新的“规范化表示”这一技巧工艺,把搜索空间压缩了几个数量级,有效地解决了传统方法当中所存在的路径爆炸此类问题。

中国科研团队研发通矩模型,能出题解题,超国外同类系统(图2)

当前,“通矩模型”所具备的原创能力,已然获得了实际的验证以及认可,系统依靠自身自主生成的3道几何方面的新题目,已经正式被选入2024年全国中学生数学联赛(北京赛区)加以考核,同时也被选入美国精英奥赛(Math类别)加以检验留存,这属于AI这个主体原创出来的题目头一回进入规格较高的人类数学竞赛范畴。

“通矩模型”的意义,远远超过了数学竞赛自身,论文共同通讯作者、北京大学心理与认知科学学院助理教授朱毅鑫说道,它借助“小数据、大任务”的范式转变,证实了人工智能能够不再一味依靠暴力计算,而是凭借理解逻辑底层的对称性与美感,达成自主的科学发现,这对于未来具身智能在复杂环境里的逻辑决策、自动化定理证明以及个性化教育,都有着深远的战略价值 。

分享更多
10

您可能还会对下面的文章感兴趣: