📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwen3.8-27B 发布:BF16/GGUF/FP8 全格式齐发,社区生态即刻跟上⭐⭐⭐⭐
阿里 Qwen 团队发布 Qwen3.8-27B 基础模型,官方仓库 9.7k 赞、9万+下载,unsloth 同步放出 GGUF 量化版(下载量已达官方版 9 倍)、FP8 专显版也在列——一次发布、多格式覆盖,从中高端消费卡到推理集群都有对应版本可跑
看点在生态速度:基础模型与社区量化版几乎同时上线,GGUF 版 86万+ 下载说明大量用户在本地 llama.cpp 环境跑。对星竹的启示:选型开源模型时直接看多格式覆盖度,能省掉自己量化的工程成本;image-text-to-text 标签意味着它是多模态底座。
🔧 建议试一下
2. dsh-TUI:给 DeepSeek Harness 补上终端 TUI 的拼图⭐⭐⭐
社区为 DeepSeek Harness(DSH)生态做的 Claude Code 风格全屏终端 UI:思考流式展开、双击 Esc 回滚、上下文进度条 + TPS 仪表,npm 一键安装——解决 DSH 官方至今没有官方 TUI 的痛点,1.2k star 说明需求真实
🔧 建议试一下
GitHub ⭐1254·📅 08-13
🔴 训练与对齐
3. NVIDIA Nemotron-3.5-Lightning-30B-A3B:官方后训练+蒸馏谱系再扩员⭐⭐⭐⭐
NVIDIA 开源 Nemotron 3.5 Lightning 30B-A3B(MoE 架构,激活 3B),挂 post-training/DPO 标签——大厂把完整后训练流程开出来的又一员,适合当自家后训练 pipeline 的对照组或小成本基座
Nemotron 系列一贯卖点:官方技术报告把后训练数据配比、蒸馏流程写得比较清楚(参考配套 arXiv 论文),A3B 的激活参数量意味着推理成本接近 3B 模型但能力对齐 30B 级。对标 Qwen3.8-27B-A3B 同类定位,多模态任务可两家对比着选。
👀 持续关注
HuggingFace·❤️ 150
4. Muse-Glimmer-30B-GGUF:社区量化上线,32万下载验证新架构热度⭐⭐⭐
meta-models 的 Muse-Glimmer-30B(image-text-to-text 多模态)社区量化版上线,GGUF 格式 32万下载、下载量远超原版——新架构多模态模型在本地社区的接受度指标
👀 持续关注
HuggingFace·❤️ 277
🔴 Agent框架与工程
5. dsh-anchored-standard:DSH 两阶段预设——最小对齐启动,再上全量工具⭐⭐⭐
DeepSeek Harness 的两阶段 preset:先用 Minimal-aligned bootstrap 保证启动即对齐,再加载完整 Standard 工具集(Project2 98/99)——把"启动配置"和"工具集"解耦的工程思路,2.1k star
⚡ 工程可参考
GitHub ⭐2160·📅 08-14
🔴 推理优化
6. Qwen3.8-2.4T-A95B-FP8:2.4 万亿参数 MoE 的官方 FP8 量化版⭐⭐⭐
Qwen3.8 旗舰 MoE(总参 2.4T、激活 95B)的官方 FP8 版本,1万+下载——超大规模 MoE 的官方量化范式:权重存储减半、算力门槛骤降,是自建推理集群部署超大模型的标准姿势
⚡ 工程可参考
HuggingFace·❤️ 193