← 返回信息流

Reddit r/LocalLLaMA短讯

Qwen 3.6 35B A3B:6GB显存运行131K上下文与视觉能力

reddit.com作者:/u/Szadbaverem69模型AI评分:50/100

HauhauCS发布Qwen3.6-35B-A3B-Uncensored模型,支持131K长上下文及视觉功能。实测在RTX 2060 6GB显卡+32GB内存环境下,使用llama.cpp Q4_K_M量化及Q8 KV缓存,初始解码速度约23 tok/s,随上下文增长稳定在15 tok/s左右。视觉投影模块运行于CPU以节省显存。

阅读原文