🔴 国内外大模型动态
1. Qwen3.8-27B-DFlash2:投机解码版上线,z-lab 与 incoai 双repo齐发⭐⭐
Qwen3.8-27B 的 DFlash2 变体,标签明确 speculative-decoding(投机解码)——用小模型起草、大模型验证的加速路线落到 Qwen3.8 生态上,本地推理速度是痛点的人可以直接对比测试。z-lab(12.2k 下载)与 incoai(17k 下载)两个 repo 同日上榜,社区搬运+再发布的速度也是风向标
⚡ 工程可参考
2. Huihui-Qwen3.8-27B-abliterated:去审查版,200 赞领先当日大模型区⭐⭐
huihui-ai 是 abliterated(去审查)赛道的知名作者,这次把 Qwen3.8-27B 多模态版做了 abliteration 处理,200 点赞——去审查微调在 Qwen 系上持续有稳定需求,做角色扮演/创作类应用的开发者常备底座之一
👀 持续关注
3. fal 出品 MiniMax-H3-Realism-People-LoRA:人物写实增强,270 赞⭐⭐
fal(知名 AI 推理平台)官方发布的 MiniMax-H3 人物写实 LoRA,2.4 万下载+270 赞——LoRA 已成为图像大模型能力补丁的标准交付形态,"平台方出官方增强包"这个模式说明写实人物仍是最刚需的场景
👀 持续关注
🔴 训练与对齐
4. Ornith-1.5-35B-A3B-GGUF:35B 总参仅 3B 激活的 MoE,DPO 对齐,5.4 万下载⭐⭐⭐
Ornith-1.5 的 MoE 大杯:35B 参数、A3B(激活 3B)架构+DPO 后训练,MIT 协议,GGUF 全套量化开箱即用——激活量小意味着消费级显卡跑得动"35B 智商"的模型,本地部署玩家本周值得上手的新选择
🔧 建议试一下
5. Ornith-1.5-9B-GGUF:Dense 小杯版,下载量反超大杯⭐⭐⭐
同日上榜的 9B 稠密版,5.5 万下载略超 35B-A3B——小参数 dense 模型仍是本地部署的绝对主流,GGUF 生态+低门槛让 9B 级别始终有最强刚需。大小双杯同发是开源模型发布的标准策略,Qwen/Llama 玩了很多年
🔧 建议试一下
🔴 Agent框架与工程
6. 医疗多Agent系统新论文:自适应记忆 + 反思机制做医疗问答⭐⭐
arXiv 新工作,针对医疗 QA 指出单 Agent+静态检索的老三样缺了"适应性、持久记忆、反思"三件事,提出多 Agent 协作架构补齐——医疗是高错误成本场景,这篇的架构设计对做任何"需要长期记忆+自我纠错"的 Agent 系统都有迁移价值,也正好横跨记忆系统和 Agent 框架两个关注领域
📖 精读全文