DeepSeek 于7月31日通过 API 文档日志宣布,V4-Flash-0731 正式版 API 开放公测。模型结构与预览版一致,核心变化在于通过重新后训练提升了 Agent 工具调用、多轮规划等能力,同步公布 9 项 Agent 基准测试数据。调用方式不变,官方同时透露 V4-Pro 正式版将在稍后推出。
OpenAI 发布安全报告,详细介绍了一起利用 ChatGPT 生成虚假人设、诈骗脚本和钓鱼邮件的跨国犯罪链条。安全团队联合执法机构封禁相关账号,分析了犯罪分子如何利用大模型批量生成多语言诈骗素材,并公布了滥用检测机制和防御策略改进方向。
OpenAI 发布署名文章,阐述对智能丰裕时代的战略思考。文章提出随着模型训练成本下降和推理效率提升,AI 的边际成本将趋近于零,类比电力普及的历史路径。OpenAI 计划通过持续降价和开放 API 来推动这一趋势,并讨论了智能丰裕对就业和教育的影响。
GPT-5.6 系列在多项基准测试性能持平的前提下,API 调用单价下调约 30%。官方称为"价格-性能前沿"的持续推进,目标是通过单位推理成本降低让更多开发者能在生产环境中使用前沿模型。调价覆盖标准版和迷你版,立即生效。
涵盖数据本地化存储承诺、与欧盟 AI 办公室对接机制,以及对《人工智能法》高风险分类条款的内部审计流程。计划在都柏林和阿姆斯特丹设立数据驻留节点,确保欧盟用户请求处理和向量存储在区域内完成。
7月30日上线的 AI 图片生成功能允许用户在真实卫星地图上叠加 AI 生成场景。上线后数小时内社交媒体出现大量伪造地标、灾害现场截图。Google 于31日紧急撤回,声明称正在进行"进一步评估"。多家媒体指出该功能缺乏内容标识和用途限制。
新规要求交互式 AI 系统必须告知用户其 AI 身份,AI 生成或编辑的深度伪造内容必须添加可视化标识和机器可识别标记。各成员国主管部门与国际 AI 办公室联合执法,违规者面临最高营业额 4% 的罚款。
论文论证大语言模型的提示处理机制本身存在结构性漏洞。无论采用何种对齐或过滤策略,攻击者总能在多项式时间内构造出绕过防御的对抗性提示。论文提出应将 LLM 安全策略从"完全防御"转向"限制攻击影响范围"。
苹果内部正评估将长上下文多轮编排、跨应用自动化操作等高级能力纳入付费订阅。该方案预计与 Apple Intelligence+ 绑定,基础版 Siri 保持免费。报道指出苹果尚未最终确定定价和功能分界线,但相关产品决策已在推进中。
平台更新创作者激励政策,不再对完全 AI 生成的短视频发放收益。要求创作者标注是否涉及 AI 生成,并对混合使用和纯 AI 生成进行差异化激励。政策 8 月生效,是主流短视频平台首次对 AI 内容明确降权。
印度班加罗尔初创公司完成种子轮,投资方含 Lightspeed 和 South Park Commons。聚焦端到端流式语音合成,延迟控制在 200ms 以内,可在本地 CPU 实时运行。目前面向客服自动化和语音 Agent 开发者提供 API。
在 HuggingFace 发表工程实践文章,分享千卡规模 GPU 集群上多租户训练和推理经验。涵盖显存碎片化动态回收、跨节点任务调度优先级队列,以及在不影响在线推理延迟的前提下穿插微调任务的方案。附开源代码库。
采用 Liquid 神经网络架构而非标准 Transformer。在文本嵌入和分类任务上与同规模 BERT 相当,推理延迟降低约 40%,参数量从 80M 到 1.3B 覆盖边缘端到服务端。Apache 2.0 开源,可在 HuggingFace 下载。
论文对比强化学习和监督微调在数学推理上的表现。实验发现两者最终准确率接近,但 RL 微调模型在中间层表征质量更高,表现为更强的步骤级正确性和更稳定的注意力分配。论文认为 RL 的优势在于对模型表征空间的隐式正则化。
完整拆解语音控制 Agent 的工程流水线:流式 ASR 接入、基于 VAD 的端点检测、增量式 LLM 生成与 TTS 合成串联,以及用户打断时中断模型输出的实现方式。附 Python 参考代码和可运行 Demo。
SpaceX 与环保监管达成协议,一年内逐步拆除为 xAI 数据中心供电的未经许可燃气涡轮发电机。xAI 将在过渡期内接入电网供电,但扩建计划不停。预计到 2026 年底将新增约 100MW 电力需求。