🔴 国内外大模型动态
1. Qwen3.8-27B 无审查版 GGUF:本地部署去限制 Qwen 的最热选择⭐⭐⭐⭐
JonathanColetti 发布的 Qwen3.8-27B-Uncensored GGUF 量化包,145 万下载、686 赞,登顶本周 HF 热度——想本地跑无内容限制 Qwen 的话,这是当前社区首选,llama.cpp / Ollama 即开即用,还带 MTP(多 token 预测)支持
🔧 建议试一下
2. Kimi-K3 权重开放:278 万下载、近 1.1 万赞⭐⭐⭐
月之暗面 Kimi-K3 官方权重在 HF 持续放量,compressed-tensors 格式对 vLLM 部署友好——自部署长上下文模型的国产选项,热度已进入平台期,跟踪其生态工具链(量化版、推理框架适配)即可
👀 持续关注
3. Minimax-h3-Turbo:lightx2v 转换的视频生成提速版⭐⭐⭐
lightx2v 团队转换的 MiniMax H3 Turbo 视频模型(t2v/i2v/r2v 全支持),57 万下载——ComfyUI 视频生成工作流可直接接入,Turbo 版步数少、出片快,适合快速验证创意
🔧 建议试一下
4. Comfy-Org/MiniMax-H3:ComfyUI 官方封装的 1782 万下载底模⭐⭐⭐
ComfyUI 官方打包的 MiniMax-H3 基础模型(diffusion 单文件格式),1782 万下载、1521 赞——本地图像/视频生成工作流的事实标准底模之一,做本地 AIGC 管线时直接用它最省事
👀 持续关注
🔴 训练与对齐
5. Qwen3.8-27B-Uncensored:abliteration 去对齐的另一个样本⭐⭐⭐
orcarouter 发布的 Qwen3.8-27B 消融拒绝行为(abliterated)版本,image-text-to-text 多模态、SFT+DPO 标签齐全——和第 1 条同源不同封装,可对照观察 abliteration 这条"去对齐"后训练技术路线的社区实践
👀 持续关注
6. Ornith-1.5-397B:开源大 MoE 赛道新玩家⭐⭐⭐
ornith-ai 发布 397B 参数的 Ornith-1.5,基于 qwen3_5_moe 架构、支持 image-text-to-text,3.5 万下载——又一家挤进大 MoE 开源赛道的团队,模型卡披露的训练配方和 MoE 配置值得拆解对比
👀 持续关注
🔴 RAG与知识增强
7. 为 LLM 推荐系统构建"决策相关"的物品画像⭐⭐⭐
面对海量异构、非结构化的物品元数据,论文提出 context-aware item profile 方法,只提取"影响决策"的信号喂给 LLM 做重排——这套"给文档建筛选画像再进 LLM"的思路可以直接迁移到 RAG 召回/粗排,省 token 又提精度
⚡ 工程可参考