📰 AI洞察日报

2026年8月30日 · 星期日
👁 阅读量加载中…
🏆 头条

OpenAI宣布切断Cursor模型供应:SpaceX收购触发控制权变更条款,11月12日生效

OpenAI官方宣布将终止向Cursor提供模型服务,提议切断日期为2026年11月12日,并按合同给予最长提前通知。理由是SpaceX收购Cursor后,OpenAI基于马斯克旗下公司的既往记录(收购Twitter后违反合同条款、xAI在宣誓证言中承认蒸馏OpenAI数据)无法确信对方遵守服务条款,遂行使控制权变更条款下的解除权,且不再向Cursor提供未来模型。大量经Cursor调用GPT系列模型的开发者需在此前完成迁移规划。

来源:OpenAI · The Decoder
📰 今日动态
1

Mistral发布OCR 4:OlmOCRBench 85.20居首,人工评估平均胜率72%

Mistral发布文档智能模型OCR 4:支持170种语言(10个语系),在OlmOCRBench取得85.20的整体最高分,独立标注员人工评估中对所有参测领先OCR系统的平均胜率为72%。输出在文本之外新增边界框、分块类型分类(标题/表格/公式/签名等)与行内置信度,可单容器私有化部署,并作为开源Search Toolkit的文档摄取组件接入企业搜索与RAG管道。

2

Google推出WikiSkill:把Agent经验编译成持久知识库,最高提升39.6个百分点

Google Research提出WikiSkill框架(arXiv 2608.27454),将Agent工作区分为三层:不可变的执行痕迹层、只增不减的Wiki知识层、可回滚的技能层;由Wiki维护者从痕迹中蒸馏失败模式与成功策略,再生成技能更新并经验证门控把关。五个基准测试中,Gemini-3.5-Flash平均从49.5%提升至68.1%,Qwen-3.6-27B从39.4%升至63.3%,LiveMath上最高从33.0%跃至72.6%,且技能可跨模型迁移。

3

LAION开源Big Video Dataset:8000万条视频、1000万小时,迄今最大开放视频数据集

LAION发布Big Video Dataset(BVD):从CommonCrawl发现的13亿视频URL中实际下载8000万条视频,总时长1000万小时,切分出5500万条带自动生成视听描述的片段及3亿张静帧,来源以YouTube英文内容为主。论文显示,基于BVD训练的模型在常用视频-文本基准上最多超过InternVid训练模型2.1个百分点。数据集与代码已在GitHub开源,仅限研究用途(arXiv 2608.24845)。

4

FT:中国短剧Q1产量12.8万部、95%为AI生成,一分钟AI视频成本仅为真人十分之一

据Financial Times报道,2026年Q1中国上线12.8万部短剧,为2025全年总量的3倍,其中95%由AI生成(中国网络视听协会数据)。清华大学教授沈阳估算,一分钟AI视频制作成本降至90-120美元,约为真人制作的10%。部分演员被要求先将声音与形象「蒸馏」给AI工具再遭解雇,相关劳动纠纷近两三年持续上升。该行业直接从业者69万人,另有1500万人以直播为主要职业。

5

美国联邦法院裁定五角大楼拉黑Anthropic违法:违反第一修正案的报复性行为

旧金山联邦法院裁定,国防部将Anthropic列为「供应链风险」的做法违法,认定此举违反第一修正案,系对Anthropic公开批评政府AI政策的报复。此前3月,双方就Claude军事用途谈判破裂——Anthropic要求技术不得用于自主武器与大规模监控,五角大楼则要求不受限访问。华盛顿州的平行诉讼仍未判决,Anthropic名义上仍在黑名单上;该裁定正值其计划今秋IPO的敏感窗口。

🛠 技术实践
1

InfoQ演讲:为AI Agent重新架构企业数据层——从交易系统到MCP与语义模型

Fabiane Nardon(TOTVS)分享企业数据面向「token消耗型」AI Agent的准备路径:按交易系统、MCP接口、语义模型分层组织数据,平衡确定性业务逻辑与非确定性Agent调用,在控制token成本的同时让Agent可有效消费企业数据。对正规划Agent落地数据架构的团队,该演讲提供了一套可直接参照的分层方法与实战取舍,附演讲全文与幻灯片。

2

FreeToken开源边缘MoE推理系统:单张工作站GPU跑通753B的GLM-5.2

UC Berkeley与MIT团队发布开源系统FreeToken(arXiv 2608.16157):以带宽自适应的CPU-GPU协同执行、专家驻留管理、Agent状态复用与运行时内存管理为核心,把开源权重当作可本地部署的软件。实测8GB笔记本GPU可服务35B模型、游戏主机跑284B、单张工作站GPU可服务753B的GLM-5.2,支持20余种主流MoE模型与真实编码/工具型Agent负载,系统已在flashml.ai开源,可作为端侧推理选型的直接参考。

📌 行业快讯
🔭 技术趋势观察