📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Ternary-Bonsai-2-27B GGUF:三元量化模型杀入下载榜前列⭐⭐⭐⭐
40万+下载、897赞的三元(2-bit级)量化27B模型,llama.cpp生态直接可用——极低显存跑中大模型的路线越来越受社区欢迎,边缘部署选型值得关注这条极端量化线
⚡ 工程可参考
HuggingFace·📅 09-19
2. Comfy-Org 发布 MiniMax-H3 ComfyUI 版:两周破2000万下载⭐⭐⭐
MiniMax-H3 的 ComfyUI 单文件版本,2027万下载、1904赞——国产模型在开源创意工具生态的渗透速度惊人,做图像/视频生成应用时 ComfyUI 分发已成标配渠道
👀 持续关注
HuggingFace·📅 09-19
3. TokenRhythm/NeoHorse-1-9B:Qwen3.5架构的Agentic微调⭐⭐⭐
基于 qwen3_5 架构的9B agentic 方向模型,887赞但下载刚过万——典型的"高关注早期"项目,可观察其 Agent 基准表现能否站稳,再决定是否纳入备选
👀 持续关注
HuggingFace·📅 09-19
🔴 训练与对齐
4. Stress-testing Alignment Midtraining:给"对齐中期训练"做压力测试⭐⭐⭐⭐
后训练不可能覆盖所有部署环境,模型必须泛化到训练分布之外——本文对"对齐中期训练"(alignment midtraining)这一新阶段做了系统性压力测试,是理解前沿对齐技术边界的好材料
📖 精读全文
arXiv·📅 09-17
5. openbmb/MiniCPM5-2B 开源发布:小模型持续进化⭐⭐⭐⭐
面壁 MiniCPM 第五代2B模型,35万下载、1560赞,SFT+DPO 全流程开源——端侧/低成本场景的自托管基座候选,关注其与 Qwen 小尺寸档的对位竞争
🔧 建议试一下
HuggingFace·📅 09-19
6. AUDITPLAN:先承诺、后回答的可审计安全对齐⭐⭐⭐
安全微调只看最终答案,难以区分"稳健拒绝"与"一刀切拒答+虚假安全理由"。AUDITPLAN 让单模型先给出可审计的承诺再作答——对做安全评估管线的人是个新抓手
👀 持续关注
arXiv·📅 09-16
🔴 推理优化
7. Zarya:自回归×掩码扩散混合模型,双模式推理⭐⭐⭐
AR模型逐 token 生成太慢、掩码扩散模型又因 KV cache 不可复用而开销大——Zarya 把两者混合,支持 AR/并行双模式推理,兼顾 KV cache 复用与并行解码,是推理加速架构层面的一条新路线
👀 持续关注
arXiv·📅 09-17