每日论文精读 #008:CForce 让扩散语言模型敢于“抢跑”——早期预测对齐后期修正,并行解码吞吐提升 31%

上海交大 & 蚂蚁集团提出 Consistency Forcing,用模型自身解码轨迹做自蒸馏,让 dLLM 早期低上下文预测对齐后期高置信预测,TPF 从 6.94 提到 9.08 且质量不降。

2026年8月18日 · 2 分钟

每日论文精读 #007:Agent的记忆会进化还不够,检索策略也要能进化

ERSkill把记忆检索行为建模成可执行的技能程序,用经验前缀树+双前沿机制让技能集与路由器共同进化,三个记忆基准上平均分超最强基线28-31%,且跨数据集直接迁移有效

2026年8月17日 · 1 分钟

每日论文精读 #006:给AI Agent上护栏——冻结骨干+轻量分类头,50ms拦截185种攻击

SingGuard-NSFA用CIA三元组构建185类Agent安全风险分类体系,生成式推理离线审计+判别式分类头在线拦截双模式,9B模型超最强竞品6-12个F1点,50ms完成实时检测

2026年8月16日 · 1 分钟

每日论文精读 #005:AI科学家的工作流已经完整,缺的是直接看数据的能力

现有AI科学家只消费人工预处理后的文本和特征,属于’工作流完整、证据不完整’。OmniScientist让多模态感知贯穿研究全生命周期,正面对比85%获胜,还自动发现地震基准里21.7%的’噪声’标注实为真实信号

2026年8月15日 · 1 分钟

每日论文精读 #004:RLHF的偏好平均化正在制造系统性不公

标准RLHF将不同用户群体的偏好平均化为单一奖励模型,多数群体主导学习而少数群体被系统性忽视,PA-RLHF通过分离偏好模式将公平差距从15.9pp降至9.6pp

2026年8月14日 · 1 分钟

每日论文精读 #003:多智能体RL训练中的模拟器崩溃——单一用户模拟器为何让策略越训越差

发现多智能体RL中单一冻结LLM模拟器会导致策略过拟合到模拟器的模式行为,提出Verbalized Sampling和Co-Training两种互补解法

2026年8月14日 · 1 分钟

每日论文精读 #002:长上下文训练反而削弱模型知识

上下文越长不一定越好——信息丰富的训练上下文会让模型变得’依赖上下文’,削弱参数化知识。

2026年8月13日 · 1 分钟

每日论文精读 #001:结构化记忆抑制过度个性化

给AI助手的记忆分个类,就能减少跨领域泄漏和谄媚问题——不改模型、不改记忆内容,只改呈现格式。

2026年8月13日 · 1 分钟