← 返回信息流

Reddit r/LocalLLaMA短讯

测试 Qwen 3.8 三款模型在 AtCoder 题目上的表现及思考深度影响

reddit.com作者:/u/ColorsOfCosmos评测AI评分:70/100

作者为确定本地部署首选模型,在 RTX 5060 Ti 16GB 硬件上对比了 Swift、Next IQ3_S 和 llama.cpp 下的 Qwen 3.8 系列模型。通过运行 AtCoder 编程题并遍历四种思考深度(无、低、中、极高),评估不同量化格式与推理引擎下的性能差异及思考机制对解题准确率的影响。

阅读原文