硬核盘点(09.05-09.11):本周AI圈新鲜事,看这一篇就够了!

AI应用场景
1.千问办公推出多人工作台,支持百人在线协作
千问办公推出业内首个"多人工作台":用自然语言描述需求,即可生成并发布最多支持百人同时在线协作的网页。与面向个人的AI工作台不同,它具备角色权限、云端数据库、管理后台和在线发布四项核心能力,可承载多人参与的业务流程,适用于家校协同、达人投放、连锁店铺筹备等场景,流程变更后仍可自然语言修改。定制软件的开发周期正从数月压缩到一次对话。
2.DeepSeek发布V4.1 Flash,性能超旗舰V4 Pro
DeepSeek发布V4.1 Flash:552B参数MoE模型,采用全新Causal-Encoder-Decoder非对称结构,输入激活仅8B、输出激活16B,基准测试超越包括V4 Pro在内的旗舰。KV Cache大幅压缩,HBM需求降至1/4、SSD降至1/8,较初代缩小437倍,直接压低Agent类任务成本;API采用峰谷定价,闲时价格为高峰一半,模型同步开源。V4 Pro计划有序下线——非对称结构正成为降本新解。
3.高德升级城市世界模型,10分钟生成3D场景
高德9月10日发布3D原生城市世界模型ABot-Earth 0.7,直接以时空数据训练,端到端生成3DGS场景,从一张卫星图或一段文字出发,在单块消费级GPU上约10分钟生成公里级3D城市,效率较传统模式提升1000倍。能力同步装入飞行街景2.0、导航Live与避雷指南:可买票前"坐"进剧场看座位视野,或从15个维度提前推演拥堵与闭店风险。
4.小米MiMo桌面客户端开放邀测,可试用新一代预览模型
小米MiMo Desktop开放邀测,可免费体验MiMo-X-Pro与MiMo-X-Flash两款Preview模型。它直接读取表格、图片、视频、PDF、录音乃至压缩包,拆解任务后交付文档、幻灯片、网页、3D模型甚至App;成果预览可点击、可继续修改,选中元素即可局部重生成并保留版本记录。内置Smart调度自动匹配执行路径,同会话缓存命中率最高99%。
5.OpenAI发布Images 2.5,编辑精度与多轮一致性提升
OpenAI发布ChatGPT Images 2.5,重点提升编辑精度与多轮修改一致性,新增Sketch手绘参考、创作模板与图片评论编辑。最大变化在于对"修改"的理解:过去调整服装易连带改脸,如今可针对产品、背景、文字等单个元素精准编辑而保留主体与构图。官方称用户每周生成超30亿张图片,标志着图像生成正从"一次出图"走向"持续改图"。
6.Meta发布个人Agent Muse,配独立云端安全虚拟机
Meta 9月8日发布个人AI助手Muse,用户只需说目标,Muse即可拆解任务、打开网页、填写表单,代办邮件、日程、订票乃至账单谈判。每个用户独享云端Muse Secure VM,关闭应用后仍在后台运行,另有独立系统Sentinel审查其动作,敏感操作需批准。首发美国,每周约1亿Token免费额度,另有20/100美元订阅。个人Agent正从"一问一答"走向"全天候代办"。
7.京东开源视听世界模型EchoWM,支持自由探索
京东探索研究院在JDD大会发布并开源可交互视听世界模型JoyAI-EchoWM:同一框架内联合生成视频与环境音、音乐、语音,声音随画面事件同步;采用统一"相机意图"表示,把键盘离散操作转为连续6-DoF轨迹,第一与第三人称共用一套接口。158个WBench Navigation案例取得81.7最高平均分。
AI行业动向
1.DeepSeek一次扩招150人,无AI研究岗全部投向工程基建
DeepSeek一次性扩招150人,而公司总规模仅300-500人,扩展岗位全部投向服务端开发与Agent弹性计算研发,重点面向2-10年经验资深后端。后者服务于V4技术报告披露的DSec平台,由Apiserver、Edge代理、Watcher三个Rust组件构成,跑在自研3FS文件系统上,岗位要求"修改从操作系统到应用层调度的整个系统栈"。前沿实验室的重心正从模型研究转向工程基建。
2.谷歌TPU推理性价比测算,最高领先B300近一倍
SemiAnalysis发布谷歌第七代TPU Ironwood首份第三方推理测算:同等负载下TPU每百万Token成本仅0.181美元,B200为0.222美元、B300达0.276美元,每美元性能最高领先B200达50%、对B300逼近翻倍的96%。物理吞吐TPU并不占优,胜在租赁成本断崖式低廉;按谷歌内部1.03美元/芯片/小时核算,优势放大至77%乃至130%。TorchTPU更让一行代码绕开JAX翻译层,CUDA的生态铁幕正被逐步填平。
3.需求过大,OpenAI宣布暂停200美元Pro 20X新增订阅
OpenAI首席产品官Tibo宣布暂停200美元档Pro 20X新增订阅,以保障现有用户流畅访问GPT-6 Astra;已订用户不受影响,其他套餐与API正常。此前两天他才预警Astra需求"前所未有",随后回应网友"确实不该低估Astra"。摩根士丹利称,这把瓶颈叙事从"需求侧质疑"扭转为"供给侧压力"。能力提升正直接转化为算力账单。
AI行业观点
1.对话OpenRouter CEO:软件将成Agent后台工具
OpenRouter CEO Alex Atallah在20VC对谈中给出12条判断:AI不会只剩一个赢家,多模型并用是长期常态;推理服务并非无差异的卖铲子生意——"一个Token并不等于另一个Token";路由真正出售的是选择权;价格降10倍可让使用量涨13倍(GPT-5.6 Luna实测);仅7月平台就上线70个模型,平均每10小时一个。Harness不会随模型变强而消失,未来所有软件都只是Agent的后台工具。
2.谷歌连发三款Flash,以“机海战术”再度加码AI企业端基本盘
距3.7发布仅三周,谷歌连发第三款Flash——Gemini 3.8 Flash。它空降LMArena Agent榜第14名、险胜DeepSeek-V4-Pro,HLE-Verified拿下54.9%,定价维持"半价"且是市面输出最快的模型;内部还实装只向受信防御者开放的Cyber版,漏洞挖掘成功率超70%。但高难档位靠Loop反复试错,易烧掉成倍Token。评价单位正从Token Cost转向Task Cost。
3.a16z合伙人:可验证工作先被AI接管,找山仍靠人类
a16z合伙人Anish Acharya在Lenny's Podcast中指出,"永久底层阶级"更像硅谷集体脑补的幻想:上一轮靠网络效应赢家通吃,如今技术栈每个环节都有二十家重要玩家;放射科医生被预言淘汰二十年,岗位需求反而创新高。他判断AI把"专业技能"与"创造意愿"彻底解耦;公司正演变为一系列Agent闭环,算法只能找到局部最优,撞上天花板仍需人类直觉指明下一座山。越易验证的工作越先被接管。

