Reddit r/MachineLearning短讯中文原文BABA is AI:多模态大模型在规则泛化任务中表现不佳2 天前reddit.com作者:/u/moschles评测模型AI评分:70/1002024年ICML论文《Whatever happened to BABA is AI?》测试GPT-4o、Gemini-1.5-Pro等SOTA多模态模型,发现它们在需要操纵和组合游戏规则的泛化任务中失败严重。该研究揭示了当前大模型在复杂逻辑推理与规则泛化方面的局限性。阅读原文