AI 垃圾内容竟拿下DeepMind大奖

Blatant AI slop just won a 25k USD DeepMind Kaggle Grand Prize

AI 垃圾内容竟拿下DeepMind大奖

DeepMind在Kaggle举办的AGI认知能力黑客松结果出炉,超过1000支队伍角逐。令人震惊的是,部分获奖项目被社区质疑为“AI生成的垃圾内容”,却仍斩获2.5万美元大奖。比赛旨在设计超越简单记忆召回的基准,真正评估前沿模型的推理、行动与判断力。从MEDLEY-BENCH的社会压力测试,到LearningBench的即时学习能力,再到GAUGE对模型自信度的深度剖析,这些项目试图揭开LLM在元认知、执行功能和社会认知层面的真实水平。尽管争议不断,这场竞赛无疑推动了AI评估标准向更深层的认知维度迈进。

现有的基准测试衡量的是模型已经知道什么,而LearningBench衡量的是它们如何在单次对话中从零开始学习全新的系统。
  • 有评论者指出,AI 技术已在图像搜索、语音识别、实时翻译及脚本生成等场景实现从'不可能'到'日常化'的跨越,不应苛求其必须立即产生颠覆性发明。
  • 一位 PhD 研究者反驳了学术界比 Kaggle 更纯粹的观点,认为两者本质上都是艺术推广与名利游戏的混合体,核心驱动力皆为人性的自我宣传。
  • 针对'AI 垃圾内容获奖'的质疑,有评论者强调所有获奖作品均经过至少 2 至 4 名人类评委的独立评审与打分,质疑结果与评审流程不符。
  • 有观点认为 Kaggle 早已沦为笑柄,其作为数据集托管平台的价值已被 Huggingface 取代,未能随时代进步。
  • 部分评论者批评当前 AI 竞赛的数据集质量与方法论极其糟糕,暗示获奖结果可能缺乏实质技术含金量。

同日更多故事

2026-07-17