OpenAI声称新模型获得IMO金牌不到24小时,剧情就出现了大反转!
多位IMO官方人士和学界大佬纷纷发声,直指OpenAI的做法“粗鲁且不恰当”。
IMO主办方要求AI公司在闭幕式一周后再公布结果,让关注的焦点留在参赛的青少年上,然而OpenAI偏偏选择在闭幕式刚结束就急不可耐地宣布了成绩。
有网友评价:OpenAI一如既往的为了炒作什么都干得出来。没有官方分数,没有耐心,也没有羞耻心。
更劲爆的是,OpenAI自称的“金牌”成绩可能根本站不住脚:
OpenAI并不是与IMO合作测试模型的AI公司之一,91位IMO官方评委中没有任何人参与评估他们的答卷。这意味着,OpenAI的”金牌”成绩完全是自说自话,没有经过官方认证。
原本以为是AI发展的里程碑时刻,没想到引发了一场关于学术道德和商业炒作的激烈争论。
事情的导火索来自一位IMO资深人士的爆料。
JosephMyers,这位从1992年就参与数学奥赛的元老级人物,与IMO秘书长RiavanHuffel进行了一番交谈。
IMO评审团和协调员们普遍认为,AI开发商在IMO期间(尤其是闭幕式之前)宣布成绩是”粗鲁且不恰当的”。官方期望AI公司在闭幕式后至少等待一周再发布结果。
OpenAI方面,则由参与这项研究的NoamBrown出面回应。
他的发言承认了OpenAI没有事先与IMO官方取得联系,只是在发布成绩之前告知了一位组织者,组织者要求他们在闭幕式之后再宣布成绩。
这与爆料中的要求闭幕式一周之后出现了矛盾。
那么事情到底如何呢?
另一家参加比赛的AI团队Harmonic的公告证实,确实有“闭幕式一周之后”这个要求,而且给出了具体时间期限7月28日之后。
就在OpenAI高调宣布成绩的同时,另一家AI巨头谷歌DeepMind却很克制,与OpenAI的张扬形成鲜明对比。
多位知情人士透露,DeepMind可能也取得了金牌水平的成绩,但他们选择遵守IMO的要求,静静等待合适的时机。
除了公告发布时间的问题,OpenAI到底得没得金牌也有争议。
领导DeepMind超级推理团队的ThangLuong补充,IMO内部其实有一份官方评分指南,外部无法获取。没有基于该指南的评分就没有资格获得奖牌。
这届IMO共6道题,每题7分。金牌线35分,OpenAI自报的成绩也刚刚过线,即使是解答过程中微小的扣分都可能让OpenAI从金牌跌到银牌。
总之这场IMO金牌之争还远未结束,一切还是以经过IMO主办方认证的成绩为准。
最后让我们将聚光灯交还给人类金牌选手。
最终成绩中,中国队以全员6金牌、总分231分占据榜首,继去年以2分之差遗憾输给老对手美国队后,再度重返世界第一。
第二名则是美国队,获得了5金一银,然后依次是韩国、日本和波兰。
中国队的六位选手分别是来自武昌实验中学的邓哲文、武汉市经开外国语高级中学的徐祺铭和谈弘毅、重庆巴蜀中学的张恒烨、杭州学军中学的董镇宇,以及上海中学的邓乐言。
其中邓哲文和徐祺铭都曾参与过2024年的IMO并成功摘金,而徐祺铭更是在去年成功入选2025年北大数学英才班。
董镇宇则是团队中唯一的高三年级,虽然他早在高一就进入国家集训队并被保送至清华姚班,但前两年的选拔中都与IMO国家队擦肩而过。
这是他第三次冲击国家队,终于百折不挠圆梦IMO。
谈弘毅在连续两年凭借中国数学奥林匹克竞赛(CMO)金牌入选国家集训队后,也同样获得了清华北大保送资格。
另外,邓乐言和张恒烨在本次IMO拿下满分42分,并列世界第一,这也是中国队从2019年起,连续7届IMO均有选手获得满分。
其中,邓乐言是中国队中年级最小的一位,只有高一的他,在去年CMO以满分成绩入选国家集训队,又在IMO国家队选拔中脱颖而出,刷新了上海近10年来IMO选手的最小年龄纪录。
去年,他还在阿里巴巴全球数学竞赛中的组合与概率赛道获得全球第五名,也是首位获得该项赛事奖牌的中学生。
张恒烨曾在2023年CMO中获得金牌并入选国家队,后来同样在阿里巴巴全球数学竞赛中获奖。去年入选国家队后,他还主动前往北大数学系旁听并受益匪浅。
要知道,本次IMO中,全球600多位参赛者,只有6人获得满分,其他所有人几乎都输在了第六题——组合数学上,这也是OpenAI唯一没有攻克的那道题。
另外,下一届IMO将在上海中学举办,上海中学至今已获得18块IMO金牌,总数位居全国第一,它也将成为全球第一所承办国际数学奥林匹克的中学。
值得注意的是,今年IMO的前30名参赛者,几乎都是亚洲或东欧面孔。
而亚军美国队也是清一色的亚洲面孔。
网友表示,也许未来的数学竞赛将是中国队vs美国队vs人工智能。
参考链接:
[1]https://x.com/HarmonicMath/status/1947023450578763991
[2]https://www.imo-official.org/
[3]https://x.com/ai_for_success/status/1946984782178709719[4]https://x.com/lmthang/status/1946960256439058844
最新发现
相关资讯
科大讯飞总裁吴晓如:大模型协同大过竞争
科大讯飞总裁吴晓如:大模型协同大过竞争产业端特别是传统产业,尚不能感受大模型发展带来的变革?吴晓如表示,接受大模型较快的是数字化程度较高的领域,它们有丰富的数据;其次是应用价值较大的领域,它们对数
2025-10-14 11:11:47
清华系前腾讯Robotics X核心成员创业,业内首款能“单手玩手机”的灵巧手来了|涌现新项目
一款能把脉、操作鼠标的“六边形”产品。
2025-09-17 11:00:00
华为全新小艺拟人化实时音视频对话功能适配机型公布,含MateXTs三折叠等
华为小艺智慧助手已在今年8月底推送了1137300版本升级,部分机型在更新该版本的小艺智慧助手后,新增支持“小艺看世界”功能。目前华为官网已公布该功能适配机型,包含MateXTs三
2025-09-17 10:30:00
通义千问系列最强大的语言模型:Qwen3-Max-Preview上线
阿里通义千问今日在官网和OpenRouter上线了最新的Qwen-3-Max-Preview模型。根据官网描述,该模型是通义千问系列中最强大的语言模型。
2025-09-17 10:00:00
AMD谈AI显卡:没有性能就没有人买推理一直有优势
9月5日消息,GPU显卡不仅决定了游戏性能,也是AI领域各大厂商竞争的焦点,NVIDIA一家占了90%以上的份额,AMD也紧追不舍。AMDCFO首席财务官JeanHu日前在花旗TMT大会上也谈到了
2025-09-17 09:30:00
支持百万卡扩展,中科曙光发布国内首个开放架构AI超集群系统
该系统以GPU为核心,实现了“算、存、网、电、冷、管、软”一体化紧耦合设计,可为万亿参数大模型训练推理、行业大模型微调、多模态大模型开发、AI4S等场景提供算力底座。
2025-09-17 09:00:00
今日热榜
当AI制药不再讲故事
2025-03-12 17:29:46ZCOOLxCanva可画:Canva可画创作者大赛“变飞为宝计划”,4/3截止征集
2025-06-21 13:01:44“AI+养老”,晚年更美好
2025-01-15 18:30:24东信集团发布首个AIGC营销大模型,赋能智能营销
2025-04-30 11:31:48美国人工智能政策与中国应对策略
2025-05-06 11:25:29男子用AI造谣“女儿被抱走”:内容是编的图是网上找的
2025-08-07 09:20:35AI体育训练场“常驻”京张遗址公园
2025-02-11 14:50:36深圳人工智能先锋城市建设加速推进
2025-05-04 19:56:38“国内AIApp产品TOP100”榜单揭晓美图秀秀斩获第三名
2025-02-24 16:54:27爱奇艺融入AI搜索,首次将生成式AI(AIGC)应用于剧情搜索等三大场景
2025-07-06 13:00:48热门推荐