🏆 头条

DeepSeek-V4-Flash 正式版 API 上线公测

DeepSeek 于7月31日通过 API 文档日志宣布,V4-Flash-0731 正式版 API 开放公测。模型结构与预览版一致,核心变化在于通过重新后训练提升了 Agent 工具调用、多轮规划等能力,同步公布 9 项 Agent 基准测试数据。调用方式不变,使用 deepseek-v4-flash 即可访问。官方同时透露 V4-Pro 正式版将在稍后推出,但未公布具体时间表。

来源:DeepSeek API 文档 · IT之家 · OpenAI Hub


📰 今日动态

1. OpenAI 披露跨国 AI 犯罪诈骗打击行动

OpenAI 发布安全报告,详细介绍了一起利用 ChatGPT 生成虚假人设、诈骗脚本和钓鱼邮件的跨国犯罪链条。安全团队联合执法机构封禁了相关账号,并分析了犯罪分子如何利用大模型批量生成多语言诈骗素材。报告同时说明了 OpenAI 在账户层面的滥用检测机制和后续防御策略的改进方向。

来源:OpenAI 官方博客

2. OpenAI 发表《构建丰盈智能》战略文章

OpenAI 发布署名文章,阐述对智能丰裕时代的战略思考。文章提出随着模型训练成本下降和推理效率提升,AI 的边际成本将趋近于零,类比电力普及的历史路径。OpenAI 认为这将催生大量此前不可行的新应用类别,并计划通过持续降价和开放 API 能力来推动这一趋势。文章还讨论了智能丰裕对就业、教育和公共服务领域的长期影响。

来源:OpenAI 官方博客

3. OpenAI 提升 GPT-5.6 系列 API 性价比

OpenAI 宣布 GPT-5.6 系列在多项基准测试性能持平的前提下,将 API 调用单价下调约 30%。官方将此称为"价格-性能前沿"的持续推进,目标是通过单位推理成本的降低让更多开发者能在生产环境中使用前沿模型。此次调价覆盖 GPT-5.6 标准版和迷你版,立即对 API 用户生效。

来源:OpenAI 官方博客

4. OpenAI 发布欧洲负责任 AI 合规框架

OpenAI 发布针对欧洲市场的合规计划,涵盖数据本地化存储承诺、与欧盟 AI 办公室的对接机制,以及对《人工智能法》中高风险分类条款的内部审计流程。该计划还包括在都柏林和阿姆斯特丹设立数据驻留节点,确保欧盟用户的请求处理和向量存储在区域内完成。

来源:OpenAI 官方博客

5. Google Earth AI 生图功能上线一天即紧急下架

Google Earth 于7月30日上线了 AI 图片生成功能,允许用户在真实卫星地图上叠加 AI 生成的虚假场景。上线后数小时内,社交媒体出现大量利用该工具伪造地标建筑、灾害现场的截图。Google 于7月31日紧急撤回该功能,声明称正在进行"进一步评估"。多家媒体指出该功能缺乏内容标识和用途限制。

来源:TechCrunch · Ars Technica · The Verge

6. 欧盟 AI 法案透明度条款 8 月 2 日正式生效

欧盟委员会宣布自 8 月 2 日起执行《人工智能法》相关条款。新规要求交互式 AI 系统必须向用户明确表明其 AI 身份,AI 生成或编辑的深度伪造图片、视频和音频必须添加可视化标识和机器可识别标记。各成员国主管部门将与国际 AI 办公室联合执法,违规者面临最高营业额 4% 的罚款。

来源:36氪

7. MIT 研究:LLM 存在无法消除的对抗性攻击面

MIT 等机构研究者在国际安全会议上发表论文,论证大语言模型的提示处理机制本身存在结构性漏洞。研究表明,无论采用何种对齐或过滤策略,攻击者总能在多项式时间内构造出绕过防御的对抗性提示。论文提出应将 LLM 安全策略从"完全防御"转向"限制攻击影响范围"的工程思路。

来源:MIT Technology Review

8. 苹果或为 Siri AI 高级功能设置付费墙

据 TechCrunch 报道,苹果内部正在评估将 Siri AI 的部分高级能力——包括长上下文多轮编排、跨应用自动化操作和深度个人助理——纳入付费订阅体系。该方案预计与 Apple Intelligence+ 订阅服务绑定,基础版 Siri 保持免费。报道指出苹果尚未最终确定定价和功能分界线,但相关产品决策已在推进中。

来源:TechCrunch

9. Snapchat 停止奖励完全 AI 生成的 Spotlight 内容

Snapchat 更新创作者激励政策,不再对完全由 AI 生成的 Spotlight 短视频发放创作收益。平台将要求创作者在投稿时标注内容是否涉及 AI 生成,并对混合使用 AI 辅助和纯 AI 生成两种情况进行差异化激励。该政策将于 8 月生效,是主流短视频平台首次对 AI 生成内容采取明确的降权措施。

来源:TechCrunch

10. Smallest.ai 融资 1300 万美元构建超拟真语音 AI

印度班加罗尔初创公司 Smallest.ai 完成 1300 万美元种子轮,投资方包括 Lightspeed 和 South Park Commons。该公司聚焦端到端流式语音合成,延迟控制在 200 毫秒以内,可在本地 CPU 上实时运行。目前主要面向客服自动化和语音 Agent 开发者提供 API,已有数家印度企业在生产环境中接入。

来源:TechCrunch

11. Dharma AI 发布大规模 GPU 集群管理工程实践

Dharma AI 在 HuggingFace 博客发表文章,分享了在千卡规模 GPU 集群上运行多租户训练和推理的工程经验。内容涵盖显存碎片化问题的动态回收策略、跨节点任务调度的优先级队列设计,以及如何在不影响在线推理延迟的前提下穿插执行微调任务。文末附有开源代码库链接。

来源:HuggingFace Blog

12. Liquid AI 发布 LFM2-5 系列编码器模型

Liquid AI 发布 LFM2-5 系列编码器,采用 Liquid 神经网络架构而非标准 Transformer。该模型在文本嵌入和分类任务上与同规模 BERT 相当,但推理延迟降低约 40%,参数量从 80M 到 1.3B 覆盖边缘端到服务端。模型权重以 Apache 2.0 协议开源,可在 HuggingFace 上直接下载使用。

来源:HuggingFace Blog

13. arXiv:RL 与 SFT 微调模型推理性能差异溯源

论文"Probing the Origins of Reasoning Performance"对比了强化学习和监督微调在数学推理任务上的表现。实验发现,两种方法在最终准确率上接近,但 RL 微调模型在中间层的表征质量更高,表现为更强的步骤级正确性和更稳定的注意力分配。论文认为 RL 的优势不在学到的策略本身,而在于对模型表征空间的隐式正则化。

来源:arXiv:2607.26119

14. KDnuggets 发表语音控制 AI Agent 构建教程

KDnuggets 发布技术教程,完整拆解了语音控制 AI Agent 的工程流水线。内容涵盖流式 ASR 接入、基于 VAD 的端点检测、增量式 LLM 生成与 TTS 合成的串联、以及用户打断时中断模型输出的实现方式。教程附有 Python 参考代码和一个可运行的 Demo。

来源:KDnuggets

15. SpaceX 获准一年内逐步移除 xAI 未许可涡轮发电机

马斯克旗下 SpaceX 与当地环保监管达成协议,将在一年内逐步拆除为 xAI 数据中心供电的未经许可燃气涡轮发电机。这些发电机组此前因噪音和排放超标被投诉。监管文件显示 xAI 将在过渡期内接入电网供电,但数据中心扩建计划不会暂停,预计到 2026 年底将新增约 100MW 的电力需求。

来源:TechCrunch


🔭 技术趋势观察

  1. Agent 能力取代跑分成为模型竞争核心指标:DeepSeek-V4-Flash 以 9 项 Agent 基准而非传统 MMLU 分数作为正式版核心卖点,Kimi K3 同样主打编程 Agent。这意味着行业评价标准正在迁移:客户不再为榜单分数买单,而是关注模型在工具调用、多轮规划、代码执行等真实场景中的端到端成功率。长期来看,Agent 基准将取代静态学术数据集成为模型选型的默认依据, evaluation 体系需要从"测模型"转向"测工作流"。

  2. AI 内容标识从政策讨论进入法律强制阶段:欧盟法案 8 月 2 日要求 AI 生成内容必须添加机器可读标记,Google Earth 上线一天即因虚假信息下架,Snapchat 对纯 AI 内容取消激励。三件事在同一天发生并非巧合——监管、平台、公众三层力量同时收紧。对业界的启示是:AI 生成内容的标识和水印不再是"nice to have"的合规装饰,而是产品上线的前置条件。缺乏标识方案的 AI 产品将在主要市场面临直接下架风险。

  3. LLM 安全上限被证伪,行业需重构安全预期:MIT 论文从理论上证明了对抗性攻击不可消除,这意味着过去两年基于红蓝对抗、RLHF 对齐、输入过滤的安全路线存在天花板。对业界的启示是:安全投入的回报曲线将递减,企业不应承诺"绝对安全",而应转向分层防御——将重点从"阻止所有攻击"转移到"限制攻击成功后的影响半径"和"快速检测响应"。

  4. AI 产品进入精细化商业分层阶段:OpenAI 降价 30% 扩大用户基数、苹果评估 Siri 高级功能付费墙、Snapchat 对 AI 内容差异化激励。这三个动作共同指向一个趋势:AI 功能的定价正在从"一刀切"走向"基础免费 + 高级订阅 + 企业定制"的三层结构。长期影响是 AI 收入模型将从按 token 计费转向按能力订阅计费,中间层的 AI 功能聚合和分发将催生新的平台机会。


数据来源:OpenAI Blog, DeepSeek API Docs, TechCrunch, MIT Technology Review, HuggingFace Blog, arXiv, KDnuggets, 36氪, IT之家