🔴 国内外大模型动态
1Qwen3.8-27B 官方权重开源⭐6
Qwen3.8 系列 27B 版本正式上 HF,支持 image-text-to-text 多模态对话,safetensors 格式,上线即破 760 万下载、1.5 万 likes,社区热度极高。对于需要国产开源模型做生产部署的星竹来说,这是当前 27B 档最稳的选择——多模态能力加持后,视觉问答类场景可以不用再拼多个模型。2-3 句技术细节:qwen3_5 架构(Qwen3.8 世代),conversational chat template 原生适配;与 unsloth/GGUF 量化版生态同步释放,本地 llama.cpp 即可跑。
👀持续关注
2ISTA-DASLab Qwen3.8-27B GSQ-RCO 量化版⭐6
苏黎世联邦 DASLab 用 GSQ+RCO 混合精度量化方案压缩 Qwen3.8-27B,95 万下载。GSQ 是近期学术圈主推的低比特量化路线,RCO 做误差补偿——如果你在意显存占用和推理延迟,这个仓库值得对比测评一下,看量化损耗是否可接受。
⚡工程可参考
3unsloth Qwen3.8-27B-GGUF⭐6
unsloth 官方适配的全比特段 GGUF 量化包,下载量 885 万已是该模型生态最高。想在本地机器/Mac 上直接跑 Qwen3.8-27B,用这个包最省事,ollama/llama.cpp 一行命令即可拉起。
🔧建议试一下
4Minimax-h3 Singularity 视频生成模型现于 HF⭐6
MiniMax h3 Singularity 文生视频/图生视频/视频转视频模型权重出现在 HF(第三方搬运账号),16 万下载。如果属实,这是国产视频生成第一梯队的权重首次可直接下载,做视频内容生成的可以抢先验证效果;注意非官方账号发布,商用许可需谨慎核实。
👀持续关注
5Ornith-1.5-9B uncensored(abliterated)⭐6
基于 Qwen3.5 架构的 Ornith-1.5 9B 消审版(abliterated),10 万下载。消审技术路线对研究对齐机制的人有参考价值;日常生产不建议用 uncensored 模型。
👀持续关注
🔴 RAG与知识增强
6llm-master:大模型全栈学习路线中文教程⭐5
「技术派」团队维护的中文 LLM 全栈教程仓库,覆盖 Prompt Engineering、RAG、Agent、MCP、微调、部署、Transformer 到大厂面试。不是新东西但体系完整,适合当学习地图或给团队新人做 onboarding 材料。
📖精读全文
🔴 Agent框架与工程
7Interactive Memory Learning for Long-Term Conversations⭐5
arXiv 新论文:批评现有长期对话记忆是"静态启发式被动归档",提出交互式记忆学习——对记忆做自适应估值(memory valuation),动态决定什么值得记。这正打中了记忆系统的核心痛点:什么都存等于什么都没存。星竹自己就在做多轮对话记忆,这个"记忆估值"思路可以直接借鉴到 MEMORY.md 的整理策略里。
📖精读全文