大瓜! 国产大模型被美国斯坦福大学团队套壳抄袭, CEO回应了

TechWeb2024-06-04 10:38:26 76

[TechWeb]6月4日消息，大模型这波热度起来以后，一直是一些国内大模型被质疑套壳国外开源大模型。现在，回旋镖来了。近日，一则国内大模型被美国斯坦福大学团队套壳抄袭的消息在社交媒体上沸沸扬扬。

事情起源是，5月29日，斯坦福大学的一个研究团队发布了一个名为Llama3V的模型，号称只要500美元（约人民币3650元）就能训练出一个SOTA多模态模型，效果比肩GPT-4V、GeminiUltra与ClaudeOpus。

因为研究团队拥有斯坦福大学等知名光环，该团队的Llama3V模型一发布就引发了诸多关注，一度冲上HuggingFace趋势榜首页。

但是，很快，在X和HuggingFace上有开发者提出质疑，认为Llama3V套壳了中国AI创企面壁智能在5月中旬发布的8B多模态开源小模型MiniCPM-Llama3-V2.5。

有网友细心列举了“抄袭”证据，包括，Llama3-V的模型架构和代码与MiniCPM-Llama3-V2.5几乎完全相同，Llama3-V使用了MinicPM-Llama3-V2.5分词器等等。

最让质疑者不能忍的是，Llama3-V作者还删除了网友在Llama3-V页面上提交的质疑他们抄袭的问题。

于是，这位网友直接跑到面壁智能GitHub项目下留言提醒面壁智能团队关注被美国斯坦福大学团队抄袭的事情。

现在，该斯坦福团队成员已删除他们在X上官宣模型的推文，并将该项目在Github和HuggingFace上的库一并删除。

对于此事，面壁智能CEO李大海在朋友圈发文做出了正式回应：“这两天收到社区和媒体及朋友的反馈，来自斯坦福团队的Llama3V项目与面壁小钢炮最新发布的多模态模型MiniCPM-Llama3-V2.5展现出惊人的相似度。

经过团队核实，除了社区网友列出的证据外，我们还发现Llama3V展现出和小钢炮一样的清华简识别能力，连做错的样例都一模一样，而这一训练数据尚未对外公开。这项工作是团队同学耗时数个月，从卷帙浩繁的清华简中一个字一个字扫描下来，并逐一进行数据标注，融合进模型中的。更加tricky的是，两个模型在高斯扰动验证后，在正确和错误表现方面都高度相似。

技术创新不易，每一项工作都是团队夜以继日的奋斗结果，也是以有限算力对全世界技术进步与创新发展作出的真诚奉献。我们希望团队的好工作被更多人关注与认可，但不是以这种方式。

我们对这件事深表遗憾!一方面感慨这也是一种受到国际团队认可的方式，另一方面也呼吁大家共建开放、合作、有信任的社区环境。一起加油合作，让世界因AGI的到来变得更好!“

面壁智能是一家人工智能大模型技术创新与应用落地企业，创立于2022年8月，创始团队主要来自清华。面壁智能联合创始人、首席科学家刘知远是清华大学计算机系长聘副教授，智源青年科学家，主要研究方向为自然语言处理、知识图谱和社会计算。

2023年4月面壁智能完成由知乎领投的数千万元天使轮融资，种子轮股东智谱AI继续跟投。随后，2023年6月，知乎公司合伙人、CTO李大海出任面壁智能的董事和CEO，负责面壁智能公司的战略发展和运营管理。

另外，面壁智能透露，今年5月该公司刚刚完成了新一轮数亿元融资。

转载此文是出于传递更多信息目的。若来源标注错误或侵犯了您的合法权益，请与本站联系，我们将及时更正、删除、谢谢。
https://www.414w.com/read/652122.html

随机主题

新华都-9.95%跌停, 总市值50.18亿元 #墨西哥一场总统竞选活动舞台倒塌，已致5人死亡，约50人受伤 #事故 #意外郭艾伦评论金佳悦: 自己挺好的, 千万别谈恋爱哦孟加拉国一议员在印度被害普京访华圆满结束，临行前对华再表态，特朗普斥责拜登政府无能！12.58万起售, 长城炮2.4T柴油版来了, 提供6MT/9AT可选股市专治不服，服了之后你才知道怎么去交易！朱一珺新搭档孙文骏孙文骏（石宇奇教练孙俊之子）无视美方停火敦促, 以色列空袭加沙, 80万难民被迫逃离 900元的2060大雕，比4060ti大一圈，满载就60度？美股收评: 三大指数集体下跌, 太阳能、通讯设备板块走高, 金属、采矿、油气股跌幅居前多个炫富网红被封, “未曾设想的道路”不是歪门邪道第十一代索纳塔, 简直是个五边形战士!舒淇宝格丽之夜疑似被日本女星针对…揭秘抗战时期我党如何在老蒋眼皮底下不知不觉中壮大八路军实力。杨金发: 5-22晚间黄金持有空和继续布局做空下跌!庄菁雄接掌一年后, 上汽通用仍未走出下滑通道青发控股集团: 贸易创新为高水平开放助力郭晶晶“人生赢家”! 三子女颜值大揭秘, 儿女双全成家族颜值担当衣锦还乡! 辽宁男篮今早已经启程返回沈阳周鸿祎做客京东直播间畅谈AI：中国大模型发展关键在抓住场景

最新回复(0)