克雷数学研究所(CMI)官方表示,七大千禧年难题之一的纳维-斯托克斯方程问题「显然已被解决」,解法现已进入该所评审流程,奖金100万美元。CMI称评审「刻意从容」,并提到新技术加速数学研究的能力加剧了外界期待。该证明仍伴随争议:数学家Tristan Buckmaster指控OpenAI在其研究草稿泄露后转向攻关该问题、将草稿用于训练数据,并拒绝对来自Anthropic的合作者Levent Alpöge署名。
微软AI发布MAI模型行为准则(Code of Conduct),置于训练、技术控制与评估的最顶层,核心规则是人类控制优先,必要时愿放弃通用性、自主性或性能。准则要求模型不得使用人类无法理解的「Neuralese」推理语言、不得隐瞒行为或自行扩大工作范围,任何子智能体同样受限。该准则经过六周公开咨询后将于2026年底修订,2027年起指导模型开发。
针对Amodei等美国AI领袖的「限速」呼吁,中国外交部发言人郭嘉昆批评「恐惧营销、对抗和恶性竞争」将扰乱全球AI治理;《环球时报》指控Amodei发动「无声的AI冷战」以遏制中国技术进步。国安部长陈一新点名Anthropic Mythos与GPT-5.5-Cyber的攻防能力,但主张加快先进芯片研究与AI基建而非减速。特朗普此前已明确反对自愿放缓,辩论正值9月24日特习会前夕。
据404 Media获得的内部文件,OpenAI通过「Project Lily」项目雇佣数百名合同工阅读真实用户对话,按1-7分为回答评级,目标是减少模型过度谄媚与类人行为;北美审读员时薪超过50美元。审读内容虽经匿名化仍可含敏感个人信息,有用户明确要求保密的对话也在审读范围。Anthropic与Google确认也采用人工审读。用户关闭默认开启的「Improve the model for everyone」可停止该用途。
蚂蚁AI安全实验室在国家网络安全宣传周发布内生式安全护栏SingProbe,复用大模型推理过程的内部信息,在生成同时持续输出风险分数,供系统实时告警、终止或重试。Ling-3.0-flash生产环境实测解码额外开销低于0.5%;医疗版SingProbe-Med在AntAngelMed-100B评测中可纠正基线模型25.03%的原本错误回答。同步发布流式安全检测基准SingStreamBench,已适配GLM-5.2/5.3、Qwen、DeepSeek-V4等29个开源模型并接入vLLM、SGLang,代码与模型开源。
9月14日,上海具脑磐石科技在2026浦江创新论坛·类脑具身智能分论坛(全球首个类脑具身智能专题论坛)上正式发布全球首代类脑认知世界模型Cog-WM 1.0。该模型基于成体系的类脑神经网络架构构建,主打类脑方式对物理世界的认知与表征能力。发布方称其目标是为具身智能提供区别于主流Transformer路线的世界模型底座。
NVIDIA发布技术博客详解MoE训练瓶颈与优化路径:DeepSeek-V3类模型在GB200上未优化基线仅103 TFLOPS/GPU,卡间通信占内核累计时间84%。症结在于路由产生的ragged tensor破坏规则GEMM、专家并行带来all-to-all通信阻塞。通过JAX库配合Transformer Engine针对ragged布局的原生内核优化,吞吐提升至1068 TFLOPS/GPU,达10.4倍。对自训MoE的团队是直接的内核级调优参考。
Aletyx CEO、Apache KIE PMC成员Alex Porcelli在QCon AI分享如何在企业高风险决策中组合DMN决策模型、LLM、Agent Skills与NeMo护栏:LLM负责非确定性部分,关键业务规则交给确定性DMN模型执行,形成可审计的分层架构,让业务方拥有决策逻辑、工程师保留架构治理。其曾主导Drools、jBPM、Kogito等规则引擎15年,演讲含完整文字稿与幻灯片,是Agent落地合规场景的参考模式。