📡 AI技术雷达

今日扫描 84 条原始数据,精选 7 条,覆盖 3 个领域:国内外大模型 · 推理优化 · RAG与知识增强

🔴 国内外大模型动态

1Qwen/Qwen3.8-Flash-Next⭐6
Qwen3.8-Flash-Next 开源模型持续霸榜下载量(64.5万下载、5200+ 赞),多模态 image-text-to-text 能力加上对话优化,是目前本地部署性价比最高的开源多模态基座之一。看了能帮你判断:如果近期要选开源多模态模型做产品,Qwen Flash 系列仍是第一梯队候选。👀持续关注
🤗 HuggingFace⬇ 645,881❤ 5,223查看来源 ›
2meta-llama/Llama-3.1-8B-Instruct⭐6
Llama-3.1-8B 仍是下载量之王(562万下载、7600+ 赞),作为生态最成熟的 8B 级开源模型,微调工具链、量化版本、推理框架支持都是最全的。它的价值在于"确定性"——遇到需要稳定生态和丰富社区方案的场景,闭眼选它不会踩坑。⚡工程可参考
🤗 HuggingFace⬇ 5,620,539❤ 7,602查看来源 ›
3zai-org/GLM-5.3-Flash⭐6
智谱 GLM-5.3-Flash 官方开源权重上架(177万下载、2300+ 赞),glm5_next 架构 + 图文理解 + 对话能力,国产开源阵营里中文场景的实际表现值得跟踪。如果你在做中文 Agent 或需要国产模型合规选项,这是当前重点观察对象。👀持续关注
🤗 HuggingFace⬇ 1,770,038❤ 2,332查看来源 ›
4deepseek-ai/DeepSeek-R1⭐6
DeepSeek-R1 人气依旧(66万下载、1.4万赞——赞数全场最高),基于 deepseek_v3 架构的推理强模型。它证明了开源推理模型可以逼近闭源第一梯队,R1 系的 CoT 蒸馏思路仍是训练侧的重要参考。👀持续关注
🤗 HuggingFace⬇ 661,679❤ 14,234查看来源 ›
5unsloth/Qwen3.8-Flash-Next-GGUF⭐6
Unsloth 官方跟进的 Qwen3.8-Flash-Next GGUF 量化版(125万下载),意味着用 llama.cpp/Ollama 在消费级显卡甚至 Mac 上跑这个多模态模型已经开箱即用。想做本地化部署试验的话,直接拉这个仓库最快。🔧建议试一下
🤗 HuggingFace⬇ 1,256,828❤ 936查看来源 ›

🔴 推理优化

6dealignai/GLM-5.3-CYBERSECURITY-FP8⭐5
社区对 GLM-5.3 做的 FP8 量化 + 去审查(abliterated/refusal-removed)变体,主打网络安全场景。价值有二:一是 FP8 MoE 量化的实操参考(省显存跑大 MoE);二是去对齐模型在攻防测试/红队研究里的用途边界——注意仅限安全研究,生产环境别碰。⚡工程可参考
🤗 HuggingFace⬇ 30,502❤ 448查看来源 ›

🔴 RAG与知识增强

7Cognition on Graph: Navigating Massive Knowledge Space via Cognitive Cycles and Bidirectional Graph-Text Synergy⭐5
9月11日新论文,提出用"认知循环 + 图文双向协同"来驾驭大规模异构知识库(知识图谱 + 文本语料)的复杂推理,直指传统 RAG 在全局知识导航上的短板。如果你的 RAG 场景涉及多跳推理或知识图谱融合,这篇的框架思路值得读——图结构与文本表示的双向增益是关键创新点。📖精读全文
📄 arXiv · 2026-09-11查看来源 ›
📚 查看往期技术雷达