📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Kimi K2.5 独立安全评估:开源大模型的安全红线在哪?⭐⭐⭐⭐⭐
第三方团队对月之暗面Kimi K2.5做了独立安全测评,补上了官方发布时缺失的安全报告——评估国产开源前沿模型风险时的方法论范本
Kimi K2.5在编程、多模态、Agent基准上对标闭源模型,但发布时未附带安全评估。本研究聚焦开源权重放大的特有风险:越狱攻击成功率、有害内容生成、权重可被任意篡改后的滥用面。对平台选型的启示:厂商自报的安全数据不能全信,独立第三方评估才是硬依据。
🔗 续自上期雷达
📖 精读全文
arXiv·📅 04-03
2. LLM论点分类全景研究:从Llama到DeepSeek到GPT-5.2⭐⭐⭐⭐
跨越三代模型在论点挖掘任务上的系统对比,提供了一个观察"模型代际能力跃迁"的干净切片
🔗 续自上期雷达
👀 持续关注
arXiv·📅 02-25
3. Qwen3.6-27B 社区Fusion合并版:289万下载的本地部署风向标⭐⭐⭐⭐
DavidAU的Qwen3.6-27B多模型合并GGUF拿下289万下载、2014赞——想知道社区玩家现在本地真正在跑什么模型,看这类榜单比看官方宣传更真实
⚡ 工程可参考
HuggingFace·🔥 dl 2.9M
4. DeepSeek Harness 桌面端:DSH生态的现代化客户端⭐⭐⭐
为DeepSeek Harness生态打造的桌面端体验,两天拿下1.7K星——DeepSeek周边工具链正在快速成型,重度使用者值得一试
🔧 建议试一下
GitHub·⭐ 1.8k·📅 08-13
5. MiniMax-H3:国产视频生成模型新版本上线⭐⭐⭐
MiniMax发布H3,diffusers格式支持文生视频/图生视频,近200万下载、3916赞——平台若考虑视频生成能力,国产路线又多一个选项
👀 持续关注
HuggingFace·🔥 dl 2.0M
🔴 训练与对齐
6. 无参考后训练:开源LLM多语言翻译的GRPO新路线⭐⭐⭐⭐
GRPO+双质量估计模型取均值做奖励,完全不需要人工参考译文——降低RL后训练数据成本的可行路线
🔗 续自上期雷达
📖 精读全文
arXiv·📅 08-11
7. RLHF的偏好平均化正在制造系统性不公⭐⭐⭐⭐
把异质人群偏好平均成单一奖励模型,等效于多数群体的"偏好暴政"——做用户侧产品对齐时的关键警示
🔗 续自上期雷达
📖 精读全文
arXiv·📅 08-10
8. Muse-Glimmer-30B:新架构多模态对话模型,unsloth跟进GGUF⭐⭐⭐
meta-models推出的image-text-to-text对话模型,新架构muse_glimmer,1507赞;unsloth的GGUF量化版已同步上架——社区采用速度值得观察
👀 持续关注
HuggingFace·GGUF·🔥 dl 165K
9. DeepSeek-V4-Flash-0731 官方权重开放⭐⭐⭐
DeepSeek V4家族轻量成员开放权重,160万下载、3378赞——自托管场景下性价比路线的官方选项
👀 持续关注
HuggingFace·🔥 dl 1.6M
🔴 推理优化
10. Qwen3.6-35B-A3B:MoE稀疏激活在消费级本地的实证⭐⭐⭐
35B总参/3B激活的MoE视觉模型,GGUF格式233万下载——社区验证了MoE在消费级硬件上跑中等模型的可行性,本地推理选型可参考
⚡ 工程可参考
HuggingFace·🔥 dl 2.3M
11. BigBang-v1:qwen3_5_moe基座的多模态新玩家⭐⭐
endless-frontier基于qwen3_5_moe的image-text-to-text模型,早期热度一般,先挂雷达观察
👀 持续关注
HuggingFace·🔥 dl 13.8K
🔴 RAG与知识增强
12. Beyond Retrieval:长程Agent轨迹的检索后复用瓶颈⭐⭐
指出"检索到了轨迹"≠"能用":用户、实体、约束、环境状态都变了之后怎么复用旧轨迹,才是Agent记忆系统的真瓶颈——对设计记忆复用机制有直接启发
👀 持续关注
arXiv·📅 08-13
🔴 Agent框架与工程
13. pi-from-scratch:600行TypeScript写一个迷你pi-agent⭐⭐
用600行TS从零实现超级迷你版pi agent——想真正吃透agent loop内部机制(而不是只会调框架API),读改这个小项目是最快的路径
🔧 建议试一下
GitHub·⭐ 976·📅 08-09