被斯坦福团队套壳 面壁智能CEO称此现象难避免

DoNews6月4日消息,近日斯坦福大学的AI研究团队的 Llama3-V 开源模型被指控抄袭了清华系明星创业公司面壁智能开发的开源模型“小钢炮”MiniCPM-Llama3-V 2.5,在网上引起热议。

6月3日上午,当事企业面壁智能的CEO李大海在朋友圈发文回应称:“我们对这件事深表遗憾。一方面感慨这也是一种受到国际团队认可的方式,另一方面呼吁大家共建开放、合作、有信任的社区环境。

《时代周报》记者就如何规避相关现象询问李大海,他称,(想规避)应该很难。“这主要是个学术道德问题。”

业内关于“套壳”的争议由来已久。有人认为,开源就该被充分利用;有人则表示,闭源才是自主研发,参考开源就是套壳。

实际上,如今所有大模型都源于2017年谷歌大脑团队发布的Transformer神经网络架构,这些包含模型架构和算法的设计决定了模型如何处理输入数据并生成输出。在此基础上,厂商在大规模的数据上对大模型进行预训练,来提高模型的泛化能力,加速后续的学习任务推进。

因神经网络架构和预训练这两项工作打造难度高、投入金额大、耗费数据量多,往往被称作大模型的内核。

原创文章,作者:网络小小,如若转载,请注明出处:https://www.sudun.com/ask/89530.html

(0)
网络小小's avatar网络小小
上一篇 2024年6月4日 下午3:58
下一篇 2024年6月4日 下午4:52

相关推荐

  • 王通培训

    想要在搜索引擎优化领域有所建树?那就来看看王通培训吧!这里汇聚了最专业的背景介绍、精心设计的课程设置、强大的师资团队以及学员们给出的真实反馈与口碑。无论你是刚入行还是想要提升自己的…

    行业资讯 2024年3月29日
    0
  • 南宁app开发有哪些企业

    南宁,这座华南地区的城市,正以其独特的魅力吸引着越来越多的人们。而随着移动互联网时代的到来,APP开发行业也在南宁蓬勃发展。那么,你是否想知道,在这片热土上,有哪些企业在推动着AP…

    行业资讯 2024年4月10日
    0
  • 如何免费获取国内外个人云服务器?

    你是否曾经为了网络安全而烦恼?你是否想过拥有一个属于自己的云服务器,以保障个人信息的安全?那么,本文将为你揭秘如何免费获取国内外个人云服务器。什么是个人云服务器?为什么需要它?如何…

    行业资讯 2024年3月25日
    0
  • 域名被墙是什么意思,二级域名被墙一级会死吗

    3.使用代理服务器:代理服务器是一种中间服务,它隐藏您的真实IP地址,并允许您访问被阻止的网站和域名。用户可以通过配置浏览器或系统代理来规避封锁并访问被封锁的二级域名。 4.修改H…

    行业资讯 2024年5月9日
    0

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注