2025-01-01 23:25:26
133人关注
北大阿里联手推出Omni-MATH:AI数学能力的终极挑战
随着OpenAI的GPT-4在传统数学评测中屡创佳绩,北京大学和阿里巴巴的研究团队联手推出了一个全新的评测基准——Omni-MATH,旨在评估大型语言模型在奥林匹克数学竞赛级别的推理能力。这一举措不仅为AI数学能力的评估提供了新标准,也为探索AI在高级数学领域的潜力开辟了新途径。
PKU-ALI Omni数学AI挑战赛
数学AI挑战赛
AI数学竞赛
PKU-ALI合作项目
Omni数学AI赛事