📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. DavidAU Qwen3.8-27B Cold-Fusion GAIN V1.1:炼丹老炮的新配方⭐⭐⭐
DavidAU 是 HF 社区最多产的合并/微调实验者之一,这版叠了 GAIN Training + Cold-Fusion 两层配方,23.8 万下载——这类模型的意义不在"最强",而在提供和官方原版、Ridge/Beep 等风格变体的对照样本;本地 27B 玩家可以拿它测同一 prompt 下的风格差异
👀 持续关注
HuggingFace·📅 08-28
2. HauhauCS Qwen3.8-27B Uncensored Aggressive MTP:93万下载的无审查热门款⭐⭐⭐
无审查 27B 生态里热度最高的一档:93.8 万下载、685 赞,标签还带 multimodal/vision——"Aggressive" 版去审查更彻底,适合本地跑不想被频繁拒答打断的批处理任务;和昨天雷达里的 orcarouter/Huihui 版并排对比,基本集齐了当前社区无审查 27B 的主要流派
🔧 建议试一下
HuggingFace·📅 08-28
3. Tiel-Coder-35B-A3B GGUF:3B 激活的轻量编码 MoE⭐⭐⭐
35B 总参数、A3B(激活 3B)的 MoE 编码模型 GGUF 量化版——MoE 的好处是推理时只激活一小部分参数,消费级显卡跑编码助手延迟友好;16k 下载量还小,属于刚冒头的社区货,效果需要自验,但"小激活大容量"的本地编码路线值得跟
🔧 建议试一下
HuggingFace·📅 08-28
4. MiniMax-Music3 官方上架:国产音乐生成模型开放权重⭐⭐⭐
MiniMax 官方音乐生成模型进 HF,19.7k 下载、1274 赞热度不低,支持 diffusers 生态 text-to-music——国产大厂的开放版图从文本/图像烧到了音乐赛道;做多媒体内容或给视频配 BGM 的自动化流水线,多了一个可本地化的选项
👀 持续关注
HuggingFace·📅 08-28
5. MiniMax-H3 × Z-Image ComfyUI 原生包:社区缝合新玩法⭐⭐⭐
社区把 MiniMax-H3 和 Z-Image 做成 ComfyUI 原生可用的量化包——"大厂模型 + 工作流工具"的社区集成速度越来越快;如果平时用 ComfyUI 搭图像流水线,这类 native 包省去了手动转换格式的麻烦,直接拖进工作流就能跑
👀 持续关注
HuggingFace·📅 08-28
🔴 训练与对齐
6. RL 后训练"祛魅":把经典强化学习原理讲给 LLM 从业者⭐⭐⭐⭐
一篇定位是"给被 RL 后训练搞得晕头转向的人"的系统性梳理:RLHF/RLVR 背后的经典 RL 原理、policy gradient 到 PPO/GRPO 的演进逻辑——市面教程要么太学术要么太营销,这类把"黑盒"拆开的综述适合当团队内训材料或个人查漏补缺的地图
📖 精读全文
arXiv·📅 08-24
7. Plackett-Luce 混合模型:标注者偏好不一致的理论解法⭐⭐⭐
多标注者偏好天然异构(有人重格式、有人重事实),直接混训等于把 reward signal 平均化糊掉。这篇用 k 个 Plackett-Luce 排序模型的混合来显式建模偏好分组——偏理论的工作,但"先聚类偏好再对齐"的思路对做多目标 RLHF/DPO 数据清洗有直接启发
👀 持续关注
arXiv·📅 08-25
🔴 RAG与知识增强
8. KGQA 查询侧攻击:按阶段归因管线失效点⭐⭐⭐
对 GNN 知识图谱问答管线的鲁棒性研究,亮点在方法:把端到端指标拆到实体链接、子图检索、GNN 推理、答案生成四个阶段分别归因——做 RAG 系统的人可以直接抄这个"分阶段定位失败"的评测思路,比只看端到端准确率更能暴露系统短板
⚡ 工程可参考
arXiv·📅 08-26