当前位置:首页 / 新闻资讯 / 行业资讯

微软紧急撤回最先进的AI大模型WizardLM2 8x22B,原因居然忘了测试了!

发布日期:2024-04-22     267 次

4月21日消息,Meta发布超级彪悍的大语言模型Llama 3之后,微软也很快推出了自己的新一代WizardLM2 8x22B,号称迄今最强大,完全超越Claude 3 Opus&Sonnet、GPT-4等竞品,而且开源,但是马上又把它撤回去了。

没有任何征兆,微软就删除了WizardLM2大模型的相关文件、代码,而且一直没有任何公开解释。

微软的一位工程师单独给出了原因,令人啼笑皆非。

原来,微软已经几个月没有发布新的大模型,对上新流程有些陌生,居然忘了必需的幻觉测试(toxicity test),目前正在抓紧补测,很快就会重新上线。

大语言模型的“幻觉”分为两种,一是事实性幻觉,指模型生成的内容与可验证的现实世界事实不一致,二是忠实性幻觉,指模型生成的内容与用户的指令或上下文不一致。

大模型幻觉产生的原因有很多,训练数据、预训练和对齐阶段、推理阶段都会出现缺陷。

这么重要的测试都能忘掉,微软真是……

1.png

2.png

3.png


为您精选

寻找更多销售、技术和解决方案的信息?

关于绿测

广州绿测电子科技有限公司(简称:绿测科技)成立于2015年11月,是一家专注于耕耘测试与测量行业的技术开发公司。绿测科技以“工程师的测试管家”的理念向广大客户提供专业的管家服务。绿测科技的研发部及工厂设立于广州番禺区,随着公司业务的发展,先后在广西南宁、深圳、广州南沙、香港等地设立了机构。绿测科技经过深耕测试与测量领域多年,组建了一支经验丰富的团队,可为广大客户提供品质过硬的产品及测试技术服务等支持。

绿测工场服务号
绿测工场服务号
绿测科技订阅号
绿测科技订阅号
020-2204 2442
Copyright @ 2015-2024 广州绿测电子科技有限公司 版权所有 E-mail:Sales@greentest.com.cn 粤ICP备18033302号