4 月 8 日消息,Meta 公司的一位高管出面澄清了一则关于公司新 AI 模型的不实传言。该传言声称 Meta 在其新推出的 Llama 4 Maverick 和 Llama 4 Scout 模型上存在不当行为,即通过在特定基准测试的“测试集”上进行训练来提升模型的测试表现,同时隐藏模型的不足之处。

Meta 公司生成式人工智能副总裁艾哈迈德・阿尔・达赫勒(Ahmad Al-Dahle)在社交平台 X 上发表声明称,这种说法“根本不属实”。
在人工智能领域,测试集是用于在模型训练完成后评估其性能的数据集合。如果在测试集上进行训练,可能会人为地提高模型的基准测试分数,从而使模型看起来比实际更强大。
值得一提的是,Maverick 和 Scout 在某些任务上的表现不佳,以及 Meta 选择使用未发布的实验版本 Maverick 来在基准测试平台 LM Arena 上获得更好成绩的决定,都为这一谣言提供了“燃料”。研究人员观察到,可公开下载的 Maverick 与在 LM Arena 上托管的模型在行为上存在显著差异。
阿尔・达赫勒承认,部分用户在使用不同云服务提供商提供的 Maverick 和 Scout 模型时,确实遇到了“质量参差不齐”的情况。他解释道:“由于我们在模型准备好后就立即发布了,我们预计需要几天时间才能让所有公开的实现版本都调整到位。我们将继续进行错误修复并与合作伙伴进行对接。”
商务合作:13146398132
媒体合作:13341147250
爆料投稿:editor@vrarworld.cn
版权声明:本文为VRAR星球原创,任何单位及个人未经授权不得转载,否则将依法追究侵权责任。
如需转载请联系13341147250 / editor@vrarworld.cn 申请授权,转载时请注明来源并保留VRAR星球原文链接。
本文部分图片及视频来源于互联网,如涉及侵权请联系我们删除。

Prehension推出面向XR开发者的手势识别SDK

日本Pepabo研究所与横滨国立大学合作推出“无需说话即可识别语音的可穿戴设备”研究成果

Meta开始售卖适用于大部分旗下智能眼镜的充电底座

2026 ChinaJoy 全品类参展亮点汇总

2026年第二十三届ChinaJoy定档7月31日“与AI同游”引领全球数字娱乐新风向

人均康复周期缩短30%!VR认知康复训练系统在江苏落地

“海上新力量·新艺上海”庆祝中国共产党成立105周年暨纪念红军长征胜利90周年美术展引入VR沉浸体验

国内轮驳行业首个沉浸式应急实训系统在浙江舟山投运

VRacer悬浮摩托车推出全新赛道和第一批付费DLC

Prehension推出面向XR开发者的手势识别SDK

日本Pepabo研究所与横滨国立大学合作推出“无需说话即可识别语音的可穿戴设备”研究成果

Meta开始售卖适用于大部分旗下智能眼镜的充电底座

人均康复周期缩短30%!VR认知康复训练系统在江苏落地

“海上新力量·新艺上海”庆祝中国共产党成立105周年暨纪念红军长征胜利90周年美术展引入VR沉浸体验

国内轮驳行业首个沉浸式应急实训系统在浙江舟山投运

VRacer悬浮摩托车推出全新赛道和第一批付费DLC

交响乐VR节奏游戏Maestro宣布推出《进击的巨人》交响乐DLC

亚马逊Prime会员日促销活动,Quest 3S自4月涨价以来首次降价