在花
返回时间线
· 12:11 · 已编辑 · 29 条回复 ·

Meta新AI模型“Maverick”涉嫌优化“作弊”,引发业内质疑

Meta近日发布的新旗舰AI模型“Maverick”在LM Arena排行榜上名列第二,但研究人员指出,该测试版本与开发者可用的公开版本存在明显差异。

Meta承认,参与测试的是“针对对话优化”的实验性版本。研究者发现,LM Arena上的Maverick回答更冗长,使用大量表情符号,而公开版本则表现平平。此举引发业内对AI公司是否应为排行榜优化模型的争议。过度定制测试版本可能误导开发者,破坏评测公正性。Meta与LM Arena官方目前尚未回应相关质疑。

TechCrunch

📮投稿 ☘️频道 🌸聊天

Telegram 评论区

29 条回复,可以前往 Telegram 继续讨论。

去评论区