🔴 国内外大模型动态
1. Qwen3.8-Flash-Next 官方预览版上线⭐⭐⭐
Qwen 官方 Flash-Next 预览版刚放出:下载刚过 5 万、点赞已冲到 4284,赞降比极高,是今日社区头号新品。Next 系列按惯例是正式发布前的架构预览,image-text-to-text + conversational 标签表明走多模态对话路线。想在正式版发布前预判 Qwen 下一步的架构方向,盯这个仓库比看新闻快
👀 持续关注
2. GLM-5.3-Flash 开源权重版:19万下载的轻量多模态底座⭐⭐⭐
智谱 GLM-5.3-Flash 开源版,19 万下载、1616 赞。Flash 定位轻量高速,带视觉理解(image-text-to-text),适合做高频调用场景的底座模型。开源权重在手,本地部署、微调实验、成本敏感的批量推理都是零授权成本起点
🔧 建议试一下
3. unsloth 闪电跟进:Qwen3.8-Flash-Next-GGUF⭐⭐⭐
unsloth 对 Flash-Next 的 GGUF 量化几乎与官方同步到位,18.8 万下载。GGUF 意味着 llama.cpp / Ollama / LM Studio 开箱即跑。这条工具链的响应速度本身就是信号:社区对 Flash-Next 的本地部署需求高度看好,预览阶段就值得量化适配
🔧 建议试一下
4. Qwen3.8-27B-OBLITERATED:今日下载量之王⭐⭐⭐
Qwen3.8-27B 的 abliterated(拒绝行为消融)版,64.5 万下载为今日之最,MLX 格式直接面向 Mac Silicon 本地运行。这类模型的价值不止于"无审查"——它证明了开源权重可被第三方任意改写行为层,做安全研究、红队测试或对齐稳健性实验时是现成素材
👀 持续关注
5. Qwen3.8-27B-Uncensored-MLX:同赛道双雄之一⭐⭐⭐
与上一条同赛道的 27B Uncensored MLX 版,9.7 万下载、1211 赞。两家团队在极短时间内各自放出去审查方案,说明 Mac 本地跑大参数"解审查"模型已是稳定生态位而非偶发行为。Mac + MLX 用户按下载量或赞数二选一即可
👀 持续关注
🔴 训练与对齐
6. Ornith-1.5-9B 原生权重:Qwen架构二开+DPO的完整案例⭐⭐⭐
Ornith 1.5 家族 9B dense 版原生权重,16 万下载。架构标签 qwen3_5,训练管线含 DPO 对齐(同家族 35B-A3B MoE 版昨日已收录)。dense 9B 是本地部署的底线尺寸:显存友好、延迟低,与 MoE 版组成"轻任务/重任务"双档方案。想研究基于 Qwen 架构二次开发 + DPO 的完整流程,这个模型卡值得读一遍
👀 持续关注
🔴 推理优化
7. Flash-Next-Uncensored-GGUF:社区改造流水线的缩影⭐⭐⭐
Flash-Next 的 uncensored GGUF 版——预览版发布当天就完成"解审查 + 量化"全套改造,从标签推断 Flash-Next 应为 MoE 架构。单个模型很小众,但它折射的事实有价值:新模型发布→社区变体改造的工具链已完全流水线化,任何开源模型的各类变体都会在 48 小时内涌现,评估开源模型影响力时这是个可用的先行指标
👀 持续关注
🔴 LLM应用架构
8. sepia:给编码Agent装的"去AI味"写作技能⭐⭐⭐
给 Claude Code / Codex / Grok Build / Antigravity 用的写作技能包:修复小说叙事架构、按投稿场景匹配专业散文规则,方法论来自 StoryScope 论文(arXiv:2604.03136),619 星。"AI 写的一眼假"是真实痛点,这个项目把对策做成了可安装的 skill——用编码 Agent 写长文的可以直接装。更值得注意的是它代表 prompt-engineering 的新方向:不是让 AI 写得更多,而是写得更不像 AI
🔧 建议试一下