2026年8月26日周三晚19:30-21:30分享
集智俱乐部 · 08-23 14:30
不是又一只数字果蝇,而是一次对 Physical AI 全栈路线的正面加码
量子位 · 08-22 19:31
作者 | Matt Foster 译者 | 张卫滨 Netflix 在其文章中介绍了将 LLM 推理纳入内部服务平台的生产经验,讨论了支持不同模型规模、硬件要求以及快速演进的推理引擎所遇到的问题。文章
AI前线 · 08-23 13:30
大家好,我是刘聪NLP。周五的时候出了两个模型,一个是神秘模型Ox Alpha,大家都猜这个模型是谁家的,我大概猜到了,文末揭秘;还有一个是DeepSeek终于上线了自己的视觉模型 DeepSeek-
刘聪NLP · 08-23 12:55
音乐生成模型通常先把波形压进连续潜变量,再在潜空间生成。压缩率提高后,高频容易消失,左右声道空间感变窄,相位也会出现不连续。阿里巴巴通义千问、莫纳什大学提出ear-VAE2,直接在复杂频谱上编码,并按
arXiv每日学术速递 · 08-23 15:04
整理 | 傅宇琪、褚杏娟 DeepSeek API 价格再调;GPT-5.6 Sol 模型价格下调, Codex 额度问题引争议;英伟达 AI 服务器涨价超 15%;宇树上市开盘涨超 6 倍后大跌 1
AI前线 · 08-23 13:30
前两天,Anthropic 发了一份 27 页的《Claude Code 创业公司指南》。整份指南来自对十多家创业公司的访谈,想回答一个很现实的问题:Claude Code 真塞进公司日常之后,究竟怎
AINLP · 08-22 22:23
谷歌芯片老将Amir Salek加入Anthropic计算团队。
机器之心 · 08-22 14:00
银河通用用一场真实对抗证明:大脑、小脑与数据闭环正在融合。 作者丨邓哲敏 编辑丨董子博
AI科技评论 · 08-22 23:08
用手机随手拍一段人物视频,想得到能从任意方向观看的动态模型,单目画面缺少背面与侧面信息。浙江大学、蚂蚁集团、香港中文大学、香港科技大学等机构提出4DAnyone,先生成多视角一致视频,再把它提升为4D
arXiv每日学术速递 · 08-23 15:04
让视频模型把绳结解开、让齿轮按规则转动,或沿迷宫走到出口,画面好看不等于过程正确。微软研究院、清华大学、麻省理工学院、伊利诺伊大学厄巴纳-香槟分校等机构提出VGI-Bench,用27项任务、810个实
arXiv每日学术速递 · 08-23 15:04
人形机器人把球打出去不算难,既保持职业网球动作风格,又在真实硬件上稳定击球更难。上海人工智能实验室、上海交通大学、诺亦腾机器人、越疆机器人等机构提出AdaPT,从转播视频学习发球与回合动作,并把策略部
arXiv每日学术速递 · 08-23 15:04
四足机器人装上机械臂后,摄像头会随底盘移动,手臂动作也会改变画面。清华大学、上海人工智能实验室、哈尔滨工业大学、云深处科技等机构提出DECOWAM,分别建模相机自运动、底盘和机械臂动作,再联合预测未来
arXiv每日学术速递 · 08-23 15:04
文本生成3D要么逐个预测形状Token,速度慢且前面出错后难以修正;要么反复更新完整3D表示,计算量随精度增加。浙江大学、加州大学伯克利分校、武汉大学等机构提出Block3D,把形状序列切成连续块,块
arXiv每日学术速递 · 08-23 15:04
智能体每次回答前都要阅读天气、日历、搜索等工具Schema。工具组合或顺序一变,普通前缀缓存就难以复用之前的KV状态。上海交通大学、东方理工学院、西安交通大学提出ReCache,让每份资源独立编码,并
arXiv每日学术速递 · 08-23 15:04