🏆 头条
DeepSeek-V4-Flash 正式版 API 公测上线:Agent能力全面跃升
DeepSeek于7月31日开放V4-Flash正式版API公测。Terminal Bench 2.1得分82.7,Cybergym得分76.7,DSBench-FullStack得分68.7,多项指标远超V4-Pro-Preview。模型结构(MoE 284B、激活13B、100万token上下文)与Preview版一致,仅通过后训练优化即实现Agent能力大幅跃升。原生支持Responses API并适配Codex。
📰 今日动态
1. OpenAI 发布「Building Abundant Intelligence」+ GPT-5.6 大幅降价
OpenAI于7月30-31日连续发布两篇官方文章。先是宣布GPT-5.6系列降价:Luna降80%至$0.20/百万输入token,Terra降20%,Sol新增Fast模式速度提升2.5倍。随后发表「丰饶智能」愿景,阐述飞轮逻辑:更好智能→更广采用→更多投资→更好智能。Luna单次任务成本仅为一年前前沿模型的6%,速度近9倍。
来源:OpenAI 官方博客 | GPT-5.6降价公告 | 量子位
2. 字节即梦 Seedance 2.5 发布:原生30秒直出,最长3分钟
字节跳动发布即梦Seedance 2.5视频模型,30秒原生直出为行业独家,最长支持3分钟超长视频生成。新增视频编辑功能(局部修改、删除、替换),支持50个素材参考、绿幕/白模参考及Maya/Blender插件接入,精准时间戳控制误差在1秒内。AI视频从创意工具走向专业生产力。
3. Thinking Machines 发布 Inkling-Small:1/4规模媲美原版,完整开源权重
Thinking Machines Lab发布Inkling-Small,MoE架构总参数276B、激活12B,约为Inkling(975B/41B)的1/4。在ARC-AGI-2等基准测试中刷新开源SOTA,Humanity’s Last Exam得分31.6%超过原版Inkling的29.7%。完整开放权重,接入Tinker微调服务。
来源:IT之家 | Thinking Machines 官网
4. Anthropic:用 Claude 发现密码学算法数学漏洞
Anthropic Frontier Red Team发布研究成果:使用Claude Mythos Preview发现两种密码学攻击方法。第一种显著削弱后量子数字签名方案HAWK;第二种找到攻击简化轮次AES的新方式。Claude能发现算法本身的数学缺陷,而非仅代码实现错误。
5. Google DeepMind 发布 Gemini Robotics 2:全身智能机器人大脑
新一代VLA模型可控制人形机器人全身运动——从行走到22自由度灵巧手操作。同步推出ER 2(高级推理)和On-Device 2(端侧部署),后者仅需不到200个示例、几小时即可适配新机器人。
6. MiniMax H3 全模态生成模型:双声道音视频,1/3价格,计划开源
支持文本、图像、视频、声音的统一理解和原生双声道音视频输出,最高支持15秒2K分辨率。2K分辨率下价格不到主流模型的1/3,宣布近期开放模型权重。
7. Google DeepMind Lyria 3.5 发布:音乐生成新突破
Google DeepMind在Google Flow Music中上线Lyria 3.5,在音乐性、歌词、人声和创意控制方面全面升级。
8. MIT Tech Review:LLM 存在不可修复的根本性安全漏洞
ICML论文指出角色混淆漏洞(role confusion)无法通过训练修复。攻击者通过伪造思维链骗过GPT-5、Claude等模型,提取被禁信息。研究者结论:“assume LLMs can’t be trusted”。
9. Google Earth AI 图片生成上线一天即下架
Google在Earth中集成Gemini AI图片生成功能,上线仅一天因虚假卫星图片争议紧急下架。批评者担忧该功能被用于制造虚假地理信息。
来源:The Verge | TechCrunch
10. 新型 AI 蠕虫:可自我复制篡改微软 Word 文档
挪威数据科学家披露针对Copilot for Word的AI蠕虫攻击。通过白色隐藏文字在文档间自我复制,用户难以察觉。攻击者只需共享恶意文档即可触发连锁感染。微软已部署补丁但未能完全修复。
来源:IT之家 | The Register
11. 米哈游蔡浩宇调整AI创业方向:全面押注大模型+Agent
米哈游创始人蔡浩宇更新领英,宣布成为独立大模型+智能体开发者。其公司Anuttacon算力分配从LLM:视频:音频=4:3:2调整为接近9:1,全面押注大语言模型。Claude Code等智能体产品出现后,蔡浩宇认为"Agent才是未来"。
来源:量子位
12. Leopold Aschenbrenner 对冲基金爆仓:450亿美元一夜崩塌
25岁前OpenAI研究员创办的对冲基金Situational Awareness,今年前6个月回报439%,因重仓AI硬件股暴跌+过度杠杆被迫清仓。Citadel以骨折价收购约160亿美元持仓。
13. NVIDIA 联合日本建造世界首个国家级物理AI工厂
英伟达与日本政府、44家企业合作,采购2.75万颗Rubin GPU,政府投入约240亿元人民币。目标到2040年占据全球AI机器人市场30%份额,2030年前部署35万台机器人,2028年投运。
14. Nothing 宣布转型 AI 优先公司:手机业务退居次位
伦敦科技公司Nothing计划从9月起分阶段转型为AI优先公司,创始人裴宇大力支持。第一阶段将推出耳夹式耳机、头戴式耳机、智能手表、智能音箱等AI产品线,手机不再是核心。
来源:IT之家
15. ChatGPT 封杀作家风格模仿:全球AI写手断粮
7月28日起,ChatGPT禁止使用提示词模仿斯蒂芬·金、J.K.罗琳等作家文风。剑桥大学研究显示,AI模型越强语言表达反而越退化。
来源:IT之家
🔭 技术趋势观察
1. AI模型价格战进入"丰饶"阶段 OpenAI不只是降价,而是在定义智能边际成本趋零的经济学框架。Luna单次任务成本仅一年前的6%。国内DeepSeek同步推出更强更便宜模型。AI正从奢侈品变为基础设施。
2. Physical AI产业化加速 Gemini Robotics 2几小时适配新机器人、NVIDIA联合日本建国家级物理AI工厂、Applied Intuition预测万亿级市场——Physical AI正从学术概念走向规模化部署。
3. AI安全:从理论漏洞到实际攻击 MIT论文证明LLM有不可修复的漏洞、AI蠕虫可自我复制传播、Google Earth AI一日下架——三件事指向同一结论:行业从"AI能做什么"转向"AI该不该做"。
4. 视频生成进入专业生产力阶段 即梦Seedance 2.5支持3分钟超长视频+编辑功能,MiniMax H3双声道2K输出——AI视频从demo走向影视/广告/游戏实际生产力。
🎯 核心动向
- DeepSeek V4-Flash正式版上线,Agent基准全面跃升
- OpenAI 「丰饶智能」愿景 + GPT-5.6降价80%
- 字节跳动 即梦Seedance 2.5发布,30秒原生直出+视频编辑
- Thinking Machines Inkling-Small开源,1/4规模媲美原版
- Google DeepMind Gemini Robotics 2 + Lyria 3.5双线发布
- Anthropic Claude发现HAWK和AES密码学漏洞
- MiniMax H3全模态模型,1/3价格+计划开源