📰 AI洞察日报

2026年9月17日 · 星期四
👁 阅读量加载中…
🏆 头条

TypeSafe AI发布非生成式「判断模型」Jev:只打分不写文本,70-500毫秒响应、输入每百万token仅0.042美元

前OpenAI研究员、InstructGPT作者之一Diogo Almeida创办的TypeSafe AI推出System One模型Jev:开发者定义问题与候选答案,模型只输出标签与概率,不生成任何文本。响应时间70-500毫秒,单次调用可并行计算多个问题,输入价格0.042美元/百万token、输出免费,官方称比小型前沿LLM快100倍以上、便宜200倍以上,可用于客服工单分类、购买意向识别和AI回复自检。局限在于「不会幻觉」仅指输出结构受限,选项内的误判仍可能,且评测为自建工作流,未与GPT-6 Astra对比。

📰 今日动态
1

OpenAI推出Sponsored Agents:点击广告可直接对话商家Agent,ChatGPT Ads接入HubSpot与Shopify

OpenAI在美国测试Sponsored Agents,用户点击ChatGPT内广告后可选择与商家赞助的Agent开启标注清晰的独立对话,追问尺寸、材质等细节再跳转官网。同时Ads Manager支持自然语言创建与分析投放,新增AI文案与配图建议,并首次接入CRM伙伴HubSpot与电商伙伴Shopify,美国Shopify商家今日起可用ChatGPT Ads应用,9月23日扩展至国际市场。该消息在Hacker News获146分、159条讨论。

2

Google开放Home MCP服务器:Claude、ChatGPT等任意MCP Agent可控制智能家居设备

Google面向Google Home生态推出MCP服务器早期访问,任何支持MCP的Agent(Claude、ChatGPT、OpenClaw等)经用户OAuth授权后,可用自然语言查看摄像头摘要、控制Nest门铃与温控器及Matter设备、访问事件历史并搭建自定义仪表盘。用户需创建Google Cloud项目配置Home MCP,首批面向美国月费20美元的Home Premium Advanced订户在数周内推开,Google未说明何时扩展到其他订阅层级。

3

Anthropic合并Claude Chat与Cowork:模型自行判断任务形态,新增Docs与Slides

Anthropic将Claude Chat与Cowork合并为单一产品,不再让用户在「快速提问」与「大型任务」间选择界面,由Claude自主判断任务所需环境。同步推出Claude Docs与Slides,支持在对话中创建、编辑文档与演示文稿并导出PowerPoint或PDF;Claude Design并入对话,任务在关闭笔记本后继续云端执行。 rollout自Pro与Max计划开始,Team与Free随后,Enterprise管理员提前30天收到通知。

4

苹果据报自研M8 Ultra企业级AI服务器:双路/四路配置,考虑采用NVIDIA NVLink Fusion互联

The Information援引知情人士称,苹果正开发面向AI开发者、企业与政府的企业服务器,提供两颗或四颗M8 Ultra芯片两个版本,定位已训练模型的推理场景。苹果考虑采用NVIDIA开放的NVLink Fusion技术实现芯片间高速互联,CEO John Ternus约一年前批准该项目。最早2029年发布,也可能取消。背景是OpenAI等实验室已在批量采购Mac mini/Mac Studio用于计算机使用Agent训练,苹果Mac上季度营收同比增长近29%至104亿美元。

5

DeepMind成立跨学科研究机构DeepMind Institute,聚焦AGI安全、治理与失控风险

Google DeepMind成立DeepMind Institute(DMI),由Shane Legg、James Manyika与Demis Hassabis共同领导,汇集DeepMind、Google及全球学界研究者,研究AGI带来的安全、治理、网络攻击与失控风险,强调答案不应只来自技术界,还需艺术、人文与政策学科参与。DeepMind将AGI描述为具备人脑全部认知能力的系统,Hassabis认为数年内到来,Legg此前称2028年前出现「最小AGI」前身的概率为50%。

6

Mistral联手Mozilla推出Smart Window隐私助手:基于Mistral模型的多语言AI浏览,HN热榜484分

Mistral与Mozilla合作推出集成于浏览器的Smart Window助手,主打隐私优先的AI浏览体验,由Mistral模型提供多语言理解与页面问答能力,数据不经手广告生态。该合作在Hacker News获484分、172条讨论,成为当日最受关注的消费级AI产品发布之一,被视为欧洲「隐私+开源」路线对抗美国大厂助手的一次联合出击。

7

清华稳准智能发布结构化数据基础模型LimiX-2:400M参数登顶三大国际评测榜单

稳准智能联合清华大学计算机系崔鹏教授发布新一代数据大模型LimiX-2,参数规模提升至400M。在TabArena、BCCO、TALENT三个国际主流结构化数据Benchmark上,LimiX-2总体Elo分数分别达到1935、1432与1506,均位列第一,超过此前的最优模型。结构化数据(表格)基础模型路线在预测、决策类企业场景中区别于通用LLM,正形成独立技术赛道。

🛠 技术实践
1

TensorRT Edge-LLM在Jetson AGX Thor上完成MLPerf Edge Agentic基准快6.4倍

NVIDIA公布边缘Agent推理优化结果:TensorRT Edge-LLM在Jetson AGX Thor上完成MLPerf Edge Agentic基准的速度是基线的6.4倍。Agent工作流不同于单轮问答,涉及多轮工具调用与长上下文,优化重点在端侧KV缓存管理、算子融合与批处理调度。随着Agent从云端向车辆、机器人等边缘设备迁移,端侧推理栈的性能将直接决定Agent的响应延迟与功耗预算。

2

NVIDIA用Agentic AI把CUDA Tile算子从Python翻译到Rust:cuTile Rust实践

NVIDIA开发者博客展示用Agentic AI辅助将CUDA Tile算子从Python翻译为Rust(cutile-rs):基于tile的GPU算子编写系统,结合Rust所有权系统实现安全、地道的内核编写。文章给出了Agent驱动的代码翻译工作流、类型映射规则与人工校验环节,是「Agent写GPU代码」在真实工程库中的落地案例,对希望用LLM迁移数值计算代码的团队有直接参考价值。

3

Dropbox把Riviera从文件预览服务演进为支撑AI负载的通用内容处理平台

InfoQ报道Dropbox基础设施演进:Riviera平台从文件预览服务扩展为支持300多种文件格式、100多种转换操作的通用内容处理平台,成为AI工作负载的统一入口。配套文章还分享了Dropbox如何通过十年积累的基础设施效率优化(而非新建数据中心)为AI需求腾出余量。对中型团队而言,「先榨干现有infra再扩容」是AI时代更现实的数据中心策略。

📌 行业快讯
🔭 技术趋势观察