Meta高管澄清：新AI模型Llama 4训练“作弊”传言不属实

0次浏览发布时间：2025-04-08 09:12:00

IT之家 4 月 8 日消息，Meta 公司的一位高管出面澄清了一则关于公司新 AI 模型的不实传言。该传言声称 Meta 在其新推出的 Llama 4 Maverick 和 Llama 4 Scout 模型上存在不当行为，即通过在特定基准测试的“测试集”上进行训练来提升模型的测试表现，同时隐藏模型的不足之处。

Meta 公司生成式人工智能副总裁艾哈迈德・阿尔・达赫勒（Ahmad Al-Dahle）在社交平台 X 上发表声明称，这种说法“根本不属实”。

在人工智能领域，测试集是用于在模型训练完成后评估其性能的数据集合。如果在测试集上进行训练，可能会人为地提高模型的基准测试分数，从而使模型看起来比实际更强大。

值得一提的是，Maverick 和 Scout 在某些任务上的表现不佳，以及 Meta 选择使用未发布的实验版本 Maverick 来在基准测试平台 LM Arena 上获得更好成绩的决定，都为这一谣言提供了“燃料”。研究人员观察到，可公开下载的 Maverick 与在 LM Arena 上托管的模型在行为上存在显著差异。

阿尔・达赫勒承认，部分用户在使用不同云服务提供商提供的 Maverick 和 Scout 模型时，确实遇到了“质量参差不齐”的情况。他解释道：“由于我们在模型准备好后就立即发布了，我们预计需要几天时间才能让所有公开的实现版本都调整到位。我们将继续进行错误修复并与合作伙伴进行对接。”