← 返回信息流

Reddit r/MachineLearning短讯

BABA is AI:多模态大模型在规则泛化任务中表现不佳

reddit.com作者:/u/moschles评测模型AI评分:70/100

2024年ICML论文《Whatever happened to BABA is AI?》测试GPT-4o、Gemini-1.5-Pro等SOTA多模态模型,发现它们在需要操纵和组合游戏规则的泛化任务中失败严重。该研究揭示了当前大模型在复杂逻辑推理与规则泛化方面的局限性。

阅读原文