🔴 国内外大模型动态
1. Tiel-Coder-35B-A3B:MoE编码模型 + MTP的GGUF量化版⭐⭐⭐⭐
35B总参数、仅3B激活的MoE编码模型社区量化版,自带MTP(多token预测)支持,llama.cpp直接可跑——本地部署编码助手的高性价比样本,近9万下载说明社区认可度不低
🔧 建议试一下
2. Qwen/Qwen3.8-27B:通义新一代中型多模态官方原版⭐⭐⭐
470万下载、1.3万收藏,image-text-to-text+对话能力——这是观察阿里新一代中型多模态模型能力基线的最直接入口,也是下游微调的事实底座
👀 持续关注
3. unsloth/Qwen3.8-27B-GGUF:本地部署的事实标准量化包⭐⭐⭐
906万下载的unsloth官方GGUF全家桶——用llama.cpp/ollama本地跑Qwen3.8-27B基本绕不开它,量化规格覆盖可作为估算显存需求的直接参考
⚡ 工程可参考
4. AtomicChat/Qwen3.8-Flash-Next-GGUF:轻量高速线的新迭代⭐⭐⭐
Qwen3.8-Flash-Next的社区GGUF版——Flash系列定位轻量高速场景,"Next"后缀意味着正在快速迭代,值得留意它与正式版的规格差异和收敛方向
👀 持续关注
5. RadixArk/Qwen3.8-Flash-Next-NVFP4:Blackwell原生FP4量化⭐⭐⭐
NVIDIA新一代NVFP4格式量化版,RTX 50系/Blackwell原生支持,比传统AWQ/GPTQ的INT4精度损失更小——新显卡部署低显存占用方案的直接对比对象
⚡ 工程可参考
🔴 训练与对齐
6. ISTA-DASLab/Qwen3.8-27B-GSQ-RCO-GGUF:学术前沿混合精度量化产物⭐⭐⭐
量化研究重镇ISTA-DASLab用GSQ+RCO混合精度方法量化的Qwen3.8-27B——学术前沿量化方法直接给到可跑的GGUF,做低比特部署研究时的参考实现
👀 持续关注