6月4日消息,关于国内大模型被美国斯坦福大学团队套壳抄袭一事,有了最新进展。该斯坦福大学团队中的两位来自斯坦福的本科生发文道歉。
斯坦福Llama3-V团队的两位作者Siddharth Sharma和 Aksh Garg在X上就这一学术不端行为向中国面壁智能MiniCPM团队正式道歉,并表示会将Llama3-V模型撤下。
在这则道歉推文中,斯坦福Llama3-V团队中来自南加利福尼亚大学的Mustafa Aljadery被指是主要过错方,Mustafa Aljadery为该项目编写了代码。但是自昨天起Mustafa Aljadery已经“失联”。道歉推文的作者Aksh Garg与Siddharth Sharma主要负责帮助Mustafa进行模型推广。
斯坦福人工智能实验室主任Christopher Manning也发文谴责抄袭行为,他认为团队在事发后避重就轻,并对MiniCPM 这一中国开源模型表示赞扬。
事情起源是,5月29日,斯坦福大学的一个研究团队发布了一个名为Llama3V的模型,号称只要500美元(约等于人民币3650元)就能训练出一个SOTA多模态模型,效果比肩GPT-4V、Gemini Ultra与Claude Opus 。
因为研究团队拥有斯坦福大学等知名光环,该团队的Llama3V模型一发布就引发了诸多关注,一度冲上HuggingFace趋势榜首页。
但是,很快,在X和Hugging Face上有开发者提出质疑,认为Llama3V套壳了中国AI创企面壁智能在5月中旬发布的8B多模态开源小模型MiniCPM-Llama3-V 2.5。
有网友细心详细列举了“抄袭”证据,包括,Llama3-V的模型架构和代码与MiniCPM-Llama3-V 2.5几乎完全相同,Llama3-V使用了MinicPM-Llama3-V2.5分词器等等。
让质疑者不能忍的是,Llama3-V作者还无故删除了网友在Llama3-V页面上提交的质疑他们抄袭的问题。
于是,这位网友直接跑到面壁智能GitHub项目下留言提醒面壁智能团队关注被美国斯坦福大学团队抄袭的事情。
随后,该斯坦福团队成员已删除他们在X上官宣模型的推文,并将该项目在Github和HuggingFace上的库一并删除。
对于此事,面壁智能CEO李大海昨日在朋友圈发文做出了正式回应:“这两天收到社区和媒体及朋友的反馈,来自斯坦福团队的 Llama3V 项目与面壁小钢炮最新发布的多模态模型 MiniCPM-Llama3-V 2.5 展现出惊人的相似度。
经过团队核实,除了社区网友列出的证据外,我们还发现 Llama3V 展现出和小钢炮一样的清华简识别能力,连做错的样例都一模一样,而这一训练数据尚未对外公开。这项工作是团队同学耗时数个月,从卷帙浩繁的清华简中一个字一个字扫描下来,并逐一进行数据标注,融合进模型中的。更加 tricky的是,两个模型在高斯扰动验证后,在正确和错误表现方面都高度相似。
技术创新不易,每一项工作都是团队夜以继日的奋斗结果,也是以有限算力对全世界技术进步与创新发展作出的真诚奉献。我们希望团队的好工作被更多人关注与认可,但不是以这种方式。
我们对这件事深表遗憾!一方面感慨这也是一种受到国际团队认可的方式,另一方面也呼吁大家共建开放、合作、有信任的社区环境。一起加油合作,让世界因AGI的到来变得更好!“
面壁智能首席科学家刘知远此前也在知乎对此进行了回应,他表示“已经比较确信Llama3-V是对我们MiniCPM-Llama3-V 2.5套壳。”
刘知远同时强调:人工智能的飞速发展离不开全球算法、数据与模型的开源共享,让人们始终可以站在SOTA的肩上持续前进。我们这次开源的MiniCPM-Llama3-V 2.5就用到了最新的Llama3作为语言模型基座。而开源共享的基石是对开源协议的遵守,对其他贡献者的信任,对前人成果的尊重和致敬,Llama3-V团队无疑严重破坏了这一点。他们在受到质疑后已在Huggingface删库,该团队三人中的两位也只是斯坦福大学本科生,未来还有很长的路,如果知错能改,善莫大焉。“
面壁智能是一家人工智能大模型技术创新与应用落地企业,创立于2022年8月,创始团队主要来自清华。面壁智能联合创始人、首席科学家刘知远是清华大学计算机系长聘副教授,智源青年科学家,主要研究方向为自然语言处理、知识图谱和社会计算。
2023年4月面壁智能完成由知乎领投的数千万元天使轮融资,种子轮股东智谱AI继续跟投。随后,2023年6月,知乎公司合伙人、CTO李大海出任面壁智能的董事和CEO,负责面壁智能公司的战略发展和运营管理。
另外,面壁智能透露,今年5月该公司刚刚完成了新一轮数亿元融资。(宜月)
- 蜜度索骥:以跨模态检索技术助力“企宣”向上生长
- 网红偷税漏税事件上热搜,“收入超千万报税竟未达5000元”引发热议
- 美国最高法院计划于1月10日对TikTok禁令进行辩论
- 美国以国家安全为由调查路由器品牌TP-Link,后者回应:其安全实践符合行业标准
- 字节跳动自主研发AI GPU,旨在减少对英伟达依赖
- 消息称特斯拉上海工厂下月量产改款Model Y
- 苹果警告Meta互操作性请求过多,或威胁用户隐私安全
- 首个智能体安全生态协作组织成立:华为、荣耀、字节、蚂蚁等二十余家头部企业单位加入
- 刚果(金)指控苹果公司涉罪:供应链涉嫌使用“血矿”,法国比利时受理调查
- 我国两大科技企业连续遭受网络攻击,国家互联网应急中心成功侦破
- Netflix因未明确告知客户数据使用情况在荷兰被罚款475万欧元
免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,应及时向本网站提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后,将会依法尽快联系相关文章源头核实,沟通删除相关内容或断开相关链接。