SHELL PULSE

8月21日 · 星期五1

  1. Reddit r/LocalLLaMAby /u/bigattichouse · 短讯AI评分:30/100

    QwenMix-3.7:合并 Qwen3.8 和 3.6 的尝试

    作者看到社区讨论 Qwen3.8 和 3.6 结构相似,于是尝试用 Qwen3.8-27B-UD-Q6_K_XL.gguf 合并两者的 HF 权重,结果可行,但仅通过冒烟测试。脚本和想法已放在模型仓库的 replicate/ 目录下。

    reddit.com开源模型原文

8月20日 · 星期四2

  1. Reddit r/LocalLLaMAby /u/pmttyji · 短讯AI评分:70/100

    AVX2:加速IQ模型大批量提示处理

    llama.cpp 的 PR #27402 通过 AVX2 优化,大幅提升 IQ 量化模型在 CPU 上大批量(如 512)提示处理的速度。在 EPYC 9654 上测试,PPL 不变,速度提升显著。

    reddit.com开源评测原文