📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwen3.8-27B 无审查 FP8 版:GPU 服务器批量推理的首选格式⭐⭐⭐
orcarouter 发布的 Qwen3.8-27B-Uncensored FP8 量化版,25 万下载、1146 赞——FP8 是 vLLM/SGLang 在数据中心 GPU 上的主流部署格式,想在服务器上批量跑无限制 Qwen(数据标注、批量生成)的话,这个版本比 GGUF 更合适,还保留了 image-text-to-text 多模态能力
🔧 建议试一下
HuggingFace·📅 08-26
2. DeepSeek-V4-Pro-0813:官方旗舰权重再更新⭐⭐⭐
DeepSeek 官方 V4 Pro 的 0813 版本权重上架,7.5 万下载、757 赞,deepseek_v4 全新架构标签——官方开源旗舰的持续迭代信号,值得留意模型卡的架构变化(MoE 配置、上下文规格)和社区量化/推理框架的适配进度,再决定自部署还是走 API
👀 持续关注
HuggingFace·📅 08-26
3. Heretic 消融版 Qwen3.8-27B GGUF:去对齐技术的迭代样本⭐⭐⭐
0bserverx 用 Heretic 方法(新一代梯度方向移除,比早期 abliteration 对模型能力损伤更小)做的 Qwen3.8-27B 去对齐 GGUF,73.5 万下载、274 赞——本地 llama.cpp/Ollama 跑无审查 Qwen 的又一选择,可与昨天 JonathanColetti 经典版对照测一下拒绝率和能力保留的差异
👀 持续关注
HuggingFace·📅 08-26
4. unsloth Qwen3.8-27B-NVFP4:Blackwell 原生 4-bit 量化⭐⭐⭐
unsloth 官方发布的 Qwen3.8-27B NVFP4 量化版,161 万下载、360 赞——NVFP4 是 Blackwell(RTX 50 系)原生支持的新一代 4-bit 浮点格式,比传统 AWQ/GPTQ 精度损失更小、显存占用更省;手上有 50 系卡想本地跑 27B 全功能版的话,这是当前最划算的方案
🔧 建议试一下
HuggingFace·📅 08-26
🔴 训练与对齐
5. CRPO:把英语偏好"翻译"给其他语言的对齐配方⭐⭐⭐
论文直面"LLM 对齐高度依赖英语偏好数据、其他语言表现次优"的问题,提出跨语言排序偏好优化(CRPO):利用英语侧的强偏好信号,通过跨语言排序迁移补齐弱语言——做多语言模型后训练(尤其中文等非英语偏好数据稀缺场景)时,这套"借强语言的偏好补弱语言"的迁移思路可以直接参考
⚡ 工程可参考
arXiv·📅 08-24