📡 AI技术雷达

👁 阅读量加载中…
🔴 国内外大模型动态
1. Qwen3.8-27B-Uncensored-FP8:去审查版千问的服务端部署热门款⭐⭐⭐
社区abliterated(去审查)版Qwen3.8 27B的FP8权重,31.6万下载、1368赞——与昨天的GGUF版不同,FP8格式面向vLLM/SGLang这类推理框架,适合搭服务端"不轻易拒答"的私有化多模态助手
🔧 建议试一下
HuggingFace·⬇ 31.6万 · ❤ 1368
2. SLAI T-Rex:昇腾SuperPOD上全参数后训练DeepSeek-V4的系统实践⭐⭐⭐
在华为昇腾SuperPOD集群上对DeepSeek-V4这个万亿参数级MoE做全参数后训练的系统论文,直击三大痛点:显存压力、通信无法重叠、kernel执行低效——关注"国产算力+开源旗舰"训练栈落地的人值得细读其工程方案
👀 持续关注
arXiv·📅 07-22
3. Qwen-VLA:跨任务、跨环境、跨机器人本体的视觉-语言-动作统一模型⭐⭐⭐
Qwen把操控、导航等碎片化的具身任务收进一个VLA统一建模,探索异构具身决策的泛化——做embodied AI或机器人方向的话,这是Qwen系在物理世界的正式落子,路线图信号明确
👀 持续关注
arXiv·📅 05-28
4. DeepSeek-V4-Flash-Vision-Exp:DeepSeek给Flash系列加视觉了⭐⭐⭐
DeepSeek官方上架V4 Flash的视觉实验版(image-text-to-text),500赞——Flash主打低成本高速推理,加视觉后意味着"便宜的多模态API"路线在推进,实验版阶段值得蹲正式发布
👀 持续关注
HuggingFace·⬇ 1.8万 · ❤ 500
5. alibaba-pai/MiniMax-H3-Acc-LoRAs:用LoRA给视频生成模型做加速⭐⭐⭐
阿里PAI基于MiniMax-H3推出的加速LoRA集合,text-to-video方向,3.3万下载——"LoRA不改基座、只调推理步数/速度"的轻量加速思路,对本地跑视频生成管线的人是个省显存的选项
👀 持续关注
HuggingFace·⬇ 3.3万 · ❤ 187
🔴 训练与对齐
6. GRPO/SFT/DPO的上下文接地增益审计:提升靠旧机制还是新能力?⭐⭐⭐⭐
今日最高分。当prompt证据与模型记忆冲突时,模型常常无视证据——这篇论文系统审计了九种后训练方案(GRPO/SFT/DPO等)能否让模型更忠实于上下文,以及增益究竟从哪来
核心发现有二:一是后训练确实能提升"上下文接地"(context-grounding)表现,让模型在证据与记忆冲突时更倾向跟随证据;二是审计显示这些增益主要靠强化预训练阶段已有的内部机制,而非长出新能力。做RAG忠实性评测或选后训练配方时,这篇的审计方法论可直接复用。
📖 精读全文
arXiv·📅 09-01
7. distilbert-base-uncased:蒸馏派老将仍是后训练论文常客⭐⭐⭐
687万月下载的经典DistilBERT——它持续出现在对齐雷达里说明蒸馏基线仍是这类研究的标配对照组;做轻量化部署时,"40%更小、97%性能"的老结论至今够用
⚡ 工程可参考
HuggingFace·⬇ 687万 · ❤ 1033
8. facebook/mms-300m:Meta多语言语音模型轻量版⭐⭐⭐
wav2vec2架构的MMS 300M版,覆盖海量语言的语音识别——做小语种语音任务或需要轻量语音前端时,它是比whisper更省资源的选项之一
⚡ 工程可参考
HuggingFace·⬇ 1.28万 · ❤ 126
9. openai/clip-vit-base-patch32:2026万月下载的视觉编码默认项⭐⭐⭐
CLIP base版月下载超两千万——多模态管线的视觉侧编码器至今还是它挑大梁;做图文检索、图像分类零样本基线时,先跑它再谈别的
⚡ 工程可参考
HuggingFace·⬇ 2026万 · ❤ 1088
🔴 RAG与知识增强
10. MIDR:面向富视觉文档的增强索引检索⭐⭐⭐
解决"表格、图表、版式关系被OCR压平丢失"的老问题:在ColPali系多向量索引+晚交互的基础上做增强索引——做财报/论文/合同类PDF级RAG的人,这篇是近期最对口的工程参考
⚡ 工程可参考
arXiv·📅 09-01
🔴 编码Agent
11. 自适应关键Token感知检索:仓库级代码生成的上下文取舍⭐⭐⭐
真实仓库远超LLM上下文上限,这篇研究"哪些代码token对生成最关键"并做自适应检索——做编码Agent的repo级上下文管理(哪些文件进上下文、进多少)时,思路可直接借鉴
⚡ 工程可参考
arXiv·📅 09-01
🔴 LLM应用架构
12. reverify:AI逆向工程的结果由确定性工具验证⭐⭐⭐
579星新项目:AI做二进制逆向工程时,产出必须对照真实二进制用确定性工具核验,杜绝幻觉式反编译——这个"LLM生成+确定性验证兜底"的架构范式对任何高可信LLM应用都有启发
👀 持续关注
GitHub·⭐ 579 · 📅 08-31