📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwen3.8-27B Uncensored Cyber-Agentic 量化版:社区解锁玩法⭐⭐⭐⭐
社区把Qwen3.8-27B做去审查处理并打包成GGUF量化格式,主打网络安全场景的agentic任务——反映Qwen生态的社区二创活跃度,也提示安全评测需求
👀 持续关注
HuggingFace·📅 1.5万下载
2. GPT-2仍是下载巨头:1500万月下载的经典模型⭐⭐⭐⭐
openai-community/gpt2月下载超1555万、4135赞——作为推理成本极低的基线和教学模型依然不可替代,选型小模型时可作兜底参照
⚡ 工程可参考
HuggingFace·📅 1555万下载
3. DeepSeek-V4.1-Flash 社区FP8去审查版出现⭐⭐⭐
dealignai把DeepSeek-V4.1-Flash做成FP8精度的去审查版本,上线即3.2万下载——Flash小尺寸+社区微调的组合正在成为低成本部署的热门路径
👀 持续关注
HuggingFace·📅 3.2万下载
🔴 训练与对齐
4. all-MiniLM-L6-v2:2.5亿下载的嵌入层事实标准⭐⭐⭐⭐
月下载2.56亿的轻量嵌入模型,几乎所有RAG/检索管线的默认起点——做本地向量检索原型时,384维、推理极快的它仍是性价比首选
⚡ 工程可参考
HuggingFace·📅 2.56亿下载
5. bert-base-uncased 常青树:4763万月下载⭐⭐⭐⭐
八年老模型月下载仍4700万+——分类/NER等轻量NLP任务上它依旧是工业界兜底选项,也说明"够用就行"的工程惯性有多强
⚡ 工程可参考
HuggingFace·📅 4763万下载
6. 零阶优化做LLM偏好对齐:绕开梯度的偏好提取新范式⭐⭐⭐
针对直接偏好对齐中的likelihood displacement问题,提出用零阶(无需梯度)方式从偏好对中提取信号——为显存受限场景的对齐训练提供新思路
📖 精读全文
arXiv·📅 09-16
🔴 推理优化
7. Qwen3.8-Flash GSQ+RCO量化:ISTA-DASLab新压缩方案⭐⭐⭐⭐
苏黎世联邦ISTA-DASLab给Qwen3.8-Flash打出GSQ+RCO混合精度GGUF量化版——学术组量产化量化模型的节奏值得关注,本地部署玩家可直接试
🔧 建议试一下
HuggingFace·📅 1.3万下载
🔴 RAG与知识增强
8. 知识图谱增强 vs RAG:文化类问答的正面对比实验⭐⭐⭐⭐⭐
在拉丁美洲文化问答上把KG增强和标准RAG做了系统对比,回应"长尾知识预训练记不住"的核心痛点——做垂域知识问答选型时值得直接抄结论
📖 精读全文
arXiv·📅 09-16
🔴 Agent评测与基准
9. 双视图关系学习压缩Agent基准:评测成本砍一刀⭐⭐⭐
Agent基准跑一次动辄数千美元,这篇提出建模任务-模型关系(而非只看最终分数分布)来压缩基准规模——自建评测集的团队可以借鉴其冗余分析方法
👀 持续关注
arXiv·📅 09-16