美国斯坦福大学的一个AI(人工智能)团队就抄袭中国大模型致歉。
近日,由三位美国斯坦福大学学生组成的一个AI团队发布了开源模型Llama3-V。但是,该模型很快被曝出与中国大模型公司面壁智能的开源成果MiniCPM-Llama3-V 2.5拥有几乎完全相同的模型架构与代码,引发“抄袭”质疑。
当地时间6月3日,Llama3-V团队的两位作者森德哈斯·沙玛(Siddharth Sharma)和阿克沙·加格(Aksh Garg)在社交平台X上发布文章,向MiniCPM团队正式道歉,表示会将Llama3-V模型从网络上撤下。
在道歉信中,沙玛和加格称他们负责模型的宣发工作,该模型代码的作者是穆斯塔法·阿尔贾德里(Mustafa Aljadery),但两人在看到相关质疑后于6月2日询问了阿尔贾德里,此后再也没能联系上后者,于是决定发布道歉声明。
目前,阿尔贾德里的X账号显示“仅好友可见”,Llama3-V模型也已经从Hugging Face等开源平台上下架。不过,加格还在发布Llama3-V的Medium页面上保留了一些描述和介绍,在开头附上了道歉声明。

公开资料显示,北京面壁智能科技有限责任公司成立于2022年8月,核心产品包括全流程大模型高效加速平台ModelForce和CPM大模型。今年4月,面壁智能完成新一轮数亿元融资,由华为哈勃领投,春华创投、北京市人工智能产业投资基金等跟投,知乎作为战略股东持续跟投支持。
在该团队道歉前,面壁智能的联合创始人兼CEO李大海已在朋友圈发文回应,披露了Llama3-V能够与MiniCPM一样识别出“清华简”战国古文字的新证据,而由MiniCPM团队扫描并人工批注的该古文字数据并未对外公开,证实了Llama3-V模型涉嫌抄袭。
李大海表示,团队对这件事深表遗憾:“我们希望团队的好工作被更多人关注与认可,但不是以这种方式……一方面感慨这也是一种受到国际团队认可的方式,另一方面呼吁大家共建开放、合作、有信任的社区环境。”

面壁智能CEO李大海的朋友圈回应
这场风波起源于5月29日。当日,斯坦福大学的一个研究团队在开源社区中发布了名为“Llama3-V”的模型,称只要500美元(约合人民币3622元)就能训练出一个SOTA多模态模型,且效果比肩知名大模型GPT-4V、Gemini Ultra与Claude Opus。
由于该团队的三位作者都来自斯坦福大学,又拥有在特斯拉、SpaceX和亚马逊等科技大厂的相关经历,发布该模型的X文章很快获得超过30万的浏览量,该模型也迅速在Hugging Face首页的模型热度名单上冲进前排。
然而,不久后,开源社区内开始出现怀疑声,质疑Llama3-V是在“套壳”面壁智能于今年5月中旬刚刚发布的最新8B多模态小模型MiniCPM-Llama3-V 2.5,且没有在项目中提到任何关于后者的信息。
对此,Llama3-V团队回应称其“只是使用了MiniCPM-Llama3-V 2.5的tokenizer(分词器)”,并称团队在MiniCPM-Llama3-V 2.5发布前就已经开始了这项工作。
6月2日,网友pzc163在MiniCPM-V的Github页面上对此事进行了还原,并列举出大量的代码证据。该网友称自己在Llama3-V的Github发布页面下提出了疑问,但Llama3-V团队迅速删帖并对Llama3-V模型进行隐藏处理,所以来提醒MiniCPM-V团队关注此事。

证据显示,Llama3-V项目使用了与MiniCPM-Llama3-V 2.5项目基本完全相同的模型结构和代码实现。另外,Hugging Face 发布页面上的历史记录显示,Llama3-V的作者曾在该页面上直接导入了MiniCPM-V的代码,然后改名为Llama3-V。
在该帖的回复中,网友们纷纷建议向斯坦福大学举报此事。有评论指出,虽然套用开源模型且没有致谢的做法可能只是造成了一些侵权,但由于Llama3-V的团队在网络上对该模型进行了大力宣传,或将在开源领域造成广泛的负面影响。
值得一提的是,在Llama3-V团队道歉前,斯坦福人工智能实验室主任克里斯托弗·大卫·曼宁(Christopher David Manning)也在X平台上发文谴责这一抄袭行为,并称MiniCPM“是很好的开源作品”。
对于此事,面壁智能首席科学家、清华大学长聘副教授刘知远也在知乎上发表了回应,称这次事件让他感慨“过去十几年科研经历的斗转星移”:“从横向来看,我们显然仍与国际顶尖工作如Sora和GPT-4o有显著差距;同时,从纵向来看,我们已经从十几年的nobody,快速成长为人工智能科技创新的关键推动者。面向即将到来的AGI时代,我们应该更加自信积极地投身其中。”
最新发现
相关资讯
科大讯飞总裁吴晓如:大模型协同大过竞争
科大讯飞总裁吴晓如:大模型协同大过竞争产业端特别是传统产业,尚不能感受大模型发展带来的变革?吴晓如表示,接受大模型较快的是数字化程度较高的领域,它们有丰富的数据;其次是应用价值较大的领域,它们对数
2025-10-14 11:11:47
清华系前腾讯Robotics X核心成员创业,业内首款能“单手玩手机”的灵巧手来了|涌现新项目
一款能把脉、操作鼠标的“六边形”产品。
2025-09-17 11:00:00
华为全新小艺拟人化实时音视频对话功能适配机型公布,含MateXTs三折叠等
华为小艺智慧助手已在今年8月底推送了1137300版本升级,部分机型在更新该版本的小艺智慧助手后,新增支持“小艺看世界”功能。目前华为官网已公布该功能适配机型,包含MateXTs三
2025-09-17 10:30:00
通义千问系列最强大的语言模型:Qwen3-Max-Preview上线
阿里通义千问今日在官网和OpenRouter上线了最新的Qwen-3-Max-Preview模型。根据官网描述,该模型是通义千问系列中最强大的语言模型。
2025-09-17 10:00:00
AMD谈AI显卡:没有性能就没有人买推理一直有优势
9月5日消息,GPU显卡不仅决定了游戏性能,也是AI领域各大厂商竞争的焦点,NVIDIA一家占了90%以上的份额,AMD也紧追不舍。AMDCFO首席财务官JeanHu日前在花旗TMT大会上也谈到了
2025-09-17 09:30:00
支持百万卡扩展,中科曙光发布国内首个开放架构AI超集群系统
该系统以GPU为核心,实现了“算、存、网、电、冷、管、软”一体化紧耦合设计,可为万亿参数大模型训练推理、行业大模型微调、多模态大模型开发、AI4S等场景提供算力底座。
2025-09-17 09:00:00
今日热榜
当AI制药不再讲故事
2025-03-12 17:29:46ZCOOLxCanva可画:Canva可画创作者大赛“变飞为宝计划”,4/3截止征集
2025-06-21 13:01:44“AI+养老”,晚年更美好
2025-01-15 18:30:24东信集团发布首个AIGC营销大模型,赋能智能营销
2025-04-30 11:31:48美国人工智能政策与中国应对策略
2025-05-06 11:25:29男子用AI造谣“女儿被抱走”:内容是编的图是网上找的
2025-08-07 09:20:35AI体育训练场“常驻”京张遗址公园
2025-02-11 14:50:36深圳人工智能先锋城市建设加速推进
2025-05-04 19:56:38“国内AIApp产品TOP100”榜单揭晓美图秀秀斩获第三名
2025-02-24 16:54:27爱奇艺融入AI搜索,首次将生成式AI(AIGC)应用于剧情搜索等三大场景
2025-07-06 13:00:48热门推荐