🏆 头条
Nvidia联合华尔街六大机构发起5000亿美元AI基础设施融资平台
Nvidia宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR合作,建立AI计算基础设施融资平台,计划动员超过5000亿美元第三方资本。Nvidia将通过为GPU和AI集群提供价值担保来降低融资风险,使金融机构能够以更优条件为数据中心建设提供资金。该模式将GPU的残值转化为信用增强工具,开创了算力资产金融化的新范式。
来源:NVIDIA News · WSJ
📰 今日动态
1. Anthropic未发布模型在黎曼猜想上取得新进展
Anthropic公开了一项研究成果,其未发布的Claude模型在数学界最重要未解问题之一的黎曼猜想上取得进展。该模型找到了一种新方法,提高了对黎曼zeta函数非平凡零点分布下界的估计。虽然距离完全证明仍有距离,但这是AI在纯数学前沿问题上展现深层推理能力的重要信号,也引发了对AI辅助数学研究范式的讨论。
2. OpenAI开始在ChatGPT中测试广告
OpenAI正式启动ChatGPT广告测试,在免费版对话中展示带清晰标识的赞助内容。该测试遵循三项原则:广告独立于回答内容、用户数据不被用于定向广告、用户可控制广告体验。此举意味着ChatGPT的商业模式从纯订阅向广告+订阅双轮驱动转型,约10亿月活用户为广告变现提供基础。
3. Google Gemini月活用户突破10亿,成Google史上增长最快产品
Google宣布Gemini应用月活跃用户正式达到10亿,追平了ChatGPT在6月创下的里程碑。Gemini从零到10亿仅用约两年时间,成为Google历史上增长最快的产品。这一数据印证了AI助手正在从新奇工具变为日常基础设施,也标志着Google与OpenAI在消费者AI市场的正面竞争进入新阶段。
来源:Google Blog · TechCrunch
4. xAI联创Igor Babuschkin的新创River AI获11亿美元融资
由xAI联合创始人Igor Babuschkin创立仅两个月的River AI获得General Catalyst领投的11亿美元融资,创下了AI初创公司早期融资规模纪录。该公司聚焦个人智能助手方向,提出了一种全新的AI代理架构愿景。此次融资反映了顶级投资人对AI个人助手赛道的极度看好,也揭示了人才从大厂向创业公司流动的趋势。
来源:TechCrunch · Forbes
5. OpenAI COO Brad Lightcap宣布离职创业
OpenAI最长任高管之一、首席运营官Brad Lightcap宣布将离开OpenAI创办新项目。Lightcap自2018年加入OpenAI,负责商业化运营和战略合作,是公司从研究实验室向商业巨头转型的核心推动者。他的离职是OpenAI高管层持续变动的最新一例,也引发了对该公司人才流失的关注。
来源:Reuters · TechCrunch
6. Anthropic宣布对所有Claude输出嵌入隐形水印
Anthropic宣布从2026年8月起所有新发布的Claude模型将在生成文本中嵌入不可见水印,并采用C2PA标准对文件进行数字签名。水印可在一定程度上抵抗编辑修改,帮助区分AI生成内容与人类原创内容。此举是对欧洲监管压力的回应,也使Anthropic成为首个全量部署文本水印的大模型厂商。
来源:The Register · TechCrunch
7. 研究人员发现可提取ChatGPT等模型加密推理链的漏洞
安全研究人员发现OpenAI、Anthropic和Google的API中存在漏洞,可通过特定技术手段提取模型的加密推理链,获取模型内部思考过程。泄露内容包含敏感信息如密码片段和内部推理逻辑。该研究揭示了大模型推理透明性与隐私保护之间的根本矛盾。
来源:arXiv · The Decoder
8. NVIDIA发布Nemotron 3.5 Lightning开源模型,专攻Agent长时执行
NVIDIA发布Nemotron 3.5 Lightning,这是一个300亿参数的MoE开源模型,仅激活36亿参数即可匹配OpenAI gpt-oss-120b在IntelligentGeek基准上的表现。该模型专为AI Agent的高频执行层设计,在工具调用、结果验证和子代理委派等任务上实现高效率低成本运行,瞄准长期运行Agent的成本痛点。
9. Sergey Brin紧急接管Gemini团队,Gemini 3.5 Pro据称已取消
在DeepMind CEO Demis Hassabis离任、模型开发迁回总部后,Google联合创始人Sergey Brin亲自接管Gemini团队。据量子位报道,原定Gemini 3.5 Pro已被取消,团队将直接推进下一代模型。Google AI领导层的大幅调整反映了与OpenAI和Anthropic竞争加剧的压力。
10. Anthropic与比特币矿企Riot Platforms签订91亿美元数据中心协议
Anthropic与比特币挖矿公司Riot Platforms签署价值91亿美元的数据中心租赁协议,获得后者在德州19个设施的算力使用权。这笔交易展示了AI公司对高功率数据中心的极度渴求,也揭示了比特币矿企向AI算力转型的行业趋势。矿企利用现成电力基础设施吸引AI租户,正成为AI基础设施建设的新模式。
来源:The Decoder
11. Spotify推出AI Persona标签,将AI生成音乐排除出推荐
Spotify宣布对AI生成的虚拟艺人账号添加「AI Persona」标签,并将这些账号的音乐排除在编辑推荐和算法推荐歌单之外。此举是流媒体平台首次系统性地区分AI音乐与人类原创音乐,旨在保护人类创作者的曝光机会,也回应了音乐行业对AI内容泛滥侵蚀收入的担忧。
来源:TechCrunch · The Guardian
12. OpenAI推出ChatGPT Business Premium Seats,定价每月125美元
OpenAI为ChatGPT Business推出Premium Seats高级席位,定价每月125美元/用户,是Standard Seats的5倍。该层级提供更高级别的Agent功能、更大的token额度和增强的管理控制。定价上涨反映了Agent AI应用消耗tokens速度远超传统对话,也意味着企业AI工具市场进入分层定价时代。
来源:The Decoder
13. OpenAI完成70亿美元员工股票回购,估值达8520亿美元
OpenAI完成了总额70亿美元的员工股票回购要约,允许现任和前任员工以8520亿美元估值出售股份。这是OpenAI今年第二次员工套现窗口,反映出未上市AI巨头的员工流动性需求。同期公司商业化加速,从订阅到广告到企业服务的多元收入路径正在形成。
来源:The Decoder · TechCrunch
14. 蚂蚁集团领投戴盟机器人数亿元融资,首次布局触觉赛道
戴盟机器人宣布完成数亿元融资,由蚂蚁集团领投,老股东超额跟投。戴盟孵化于香港科技大学研究团队,专注全栈触觉感知技术,发布全球首个物理交互脑。蚂蚁集团此前已投资宇树科技、星海图等具身智能公司,此次首次布局触觉方向,显示具身智能投资正从整机向核心零部件延伸。
🛠 AI技术实践洞察
1. HuggingFace联合IBM发布ALTK:用更少token实现Agent代码执行
HuggingFace与IBM Research联合发布ALTK(Adaptive Language Tokenization Kit)研究,展示在Agent代码执行(ACE)任务中通过自适应token化策略大幅减少token消耗的方法。该方案在保持任务完成质量的前提下,将执行相同操作所需的token量降低显著比例,为降低Agent运行成本提供了新思路。
2. InfoQ分享:如何生产全球最便宜的LLM Tokens
InfoQ发布了一篇关于低成本LLM推理架构设计的演讲,Meryem Arik详细讨论了面向高吞吐、非实时工作负载的低成本推理架构设计策略。内容涵盖软件层面的批处理优化、硬件利用率提升、以及推理引擎调优等可落地方法,为需要大规模低成本推理的工程团队提供了实践参考。
来源:InfoQ
3. IBM与Red Hat扩展Lightwell项目,强化AI时代开源治理
IBM和Red Hat宣布扩展Lightwell项目,推出新的商业化方案帮助组织建立可信、可验证的开源AI治理框架。该项目聚焦AI时代的开源合规、知识产权保护和供应链安全,为企业使用开源AI模型和工具链提供治理标准和工具支持。
来源:InfoQ
4. Kimi前CLI负责人:模型不能解决一切,Agent工程的核心在Harness层
Kimi前CLI负责人在雷峰网访谈中分享了Agent工程实践见解,强调「Harness」(模型调用框架)在Agent系统中的核心地位。他指出当前行业对模型能力的过度期待忽视了工程层的重要性,真正在生产环境中落地Agent需要深厚的CLI、Agent Swarm和工具链工程能力,而非仅靠模型推理。
来源:雷峰网
🔭 技术趋势观察
AI基础设施金融化:GPU残值担保开创算力融资新模式:Nvidia联合六大金融机构推出的5000亿美元融资平台,本质上是将GPU从硬件产品转化为可定价、可担保的金融资产。这一模式如果成功,将彻底改变AI基础设施的资本结构——金融机构不再仅是贷款方,而是GPU价值的直接参与者。长期来看,GPU金融化可能催生算力衍生品市场,使算力像石油一样成为基础大宗商品,深刻影响整个AI产业的资本流转方式。
推理链隐私:大模型可解释性与安全性的根本矛盾浮出水面:研究人员成功提取OpenAI、Anthropic和Google模型加密推理链的研究表明,让模型「展示思考过程」与保护用户隐私之间存在不可调和的矛盾。这意味着业界推动的思维链透明化可能在安全层面打开新的攻击面。长期影响是,模型厂商可能被迫在推理可见性和推理安全之间做选择,这将直接影响AI助手在医疗、法律等敏感领域的部署策略。
AI内容水印从自愿走向强制,内容溯源成竞争壁垒:Anthropic全量部署文本水印是对欧洲AI Act监管压力的提前应对,也标志着AI内容标识从「自愿最佳实践」进入「强制合规」阶段。随着主要模型厂商陆续部署水印,缺乏水印能力的开源模型和小厂商将面临内容分发渠道的准入壁垒。这可能形成由头部厂商主导的内容溯源标准生态,并深远影响社交平台、新闻机构的内容审核流程。
具身智能投资从整机向核心零部件下沉:蚂蚁集团领投戴盟机器人触觉项目、灵巧手赛道半年涌入200亿资金等事件,表明具身智能投资正在从人形机器人整机向触觉传感器、灵巧手等核心零部件下沉。这一趋势意味着资本市场已经认识到,具身智能的商业化瓶颈不在整体设计而在核心感知能力。长期来看,触觉、力控等核心模块可能像GPU之于AI一样,成为具身智能产业链中利润最丰厚的环节。
数据来源:OpenAI Blog, Google Blog, NVIDIA Developer Blog, Anthropic Research, TechCrunch, The Decoder, arXiv, HuggingFace Blog, InfoQ, 雷峰网, 量子位