Reddit r/LocalLLaMA短讯
实测 Mellum2.1-12B-A2.5B 编程智能体:可用但非全能
reddit.com作者:/u/SoAp9035模型AI评分:50/100
作者使用 Pi 和 llama-server 在本地测试了 Mellum2.1-12B-A2.5B (Q8) 模型的五项单步编程任务。结果显示表现参差不齐:Pelican SVG、Browser OS 和 Minecraft 生成效果较差;Bouncing Hexagon 物理逻辑尚可,甚至能在终端运行;Flappy Bird 虽能完成,但画面简陋且难度过高。结论是该模型具备一定可用性,但在复杂一次性项目中能力有限。