📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwen3.8-27B:Qwen新一代27B中坚型号正式到位⭐⭐⭐
Qwen3.8这一代的27B主力开源,transformers/safetensors原生格式,image-text-to-text+conversational双能力,12304赞是近期HF口碑顶流——关注开源模型格局的话今天必看这条,它重新划定了本地可跑档位的新基准线
👀 持续关注
HuggingFace·⬇ 2,358,347 · ❤ 12,304
2. unsloth/Qwen3.8-27B-GGUF:667万下载的本地部署事实标准⭐⭐⭐
下载量比官方原版还高近3倍,说明Qwen3.8-27B的实际需求大头在本地GGUF这条路上。unsloth量化版向来跟进最快、质量稳定,要在llama.cpp/Ollama/LM Studio里跑这款模型,从这份起步最省事
🔧 建议试一下
HuggingFace·⬇ 6,674,515 · ❤ 2,732
3. Qwen3.8-27B-FP8:官方FP8版,服务端部署甜点位⭐⭐⭐
官方下场做的FP8量化而非社区二创,265万下载。如果部署环境是vLLM/SGLang这类支持FP8的推理框架,FP8在吞吐和显存占用上通常是最佳平衡点,比GGUF更适合做在线服务——选型时官方FP8优先
⚡ 工程可参考
HuggingFace·⬇ 2,653,678 · ❤ 671
4. qwen3.8-27b-abliterated:12GB显存单卡跑27B+MTP⭐⭐⭐
社区把Qwen3.8-27B的拒绝行为剥除(abliterated)后压到3.69bpw,12GB显存就能装下——4090/5070Ti级单卡跑27B成为现实,还带MTP多token预测标签。压缩比与效果保持的平衡值得研究量化方案的人细看
👀 持续关注
HuggingFace·⬇ 24,670 · ❤ 82
5. z-lab/Qwen3.8-27B-DFlash2:给27B配的投机解码草稿模型⭐⭐⭐
speculative-decoding+draft-model标签说明这是配套Qwen3.8-27B的草稿模型——小模型起草、大模型验证的投机解码是目前推理加速性价比最高的路径之一。做推理侧工程的话,这类官方配套草稿模型的接受率数据值得跟踪
⚡ 工程可参考
HuggingFace·⬇ 26,007 · ❤ 82
🔴 训练与对齐
6. Qwen3.8-27B-Unleashed:解禁+imatrix量化社区版⭐⭐⭐
uncensored+abliterated+imatrix三标签齐活:解禁处理之外还用了imatrix(重要性矩阵)量化来降低精度损失,这是社区降损量化的标准做法。看Qwen底座的二创后训练生态怎么玩,这条是个活样本
👀 持续关注
HuggingFace·⬇ 17,309 · ❤ 90