硬核盘点(09.12-09.18):本周AI圈新鲜事,看这一篇就够了!

AI应用场景
1.Kimi发布K2.8,百万上下文向所有会员开放
Kimi K2.8 Preview在Kimi Code与Kimi Work全量上线,官方称综合性能接近旗舰K3,Coding与Agent能力进一步提升,支持low/high/max三档思考等级。最大变化在权限:所有会员档位均可用1M上下文,而K3仍需¥199档以上。背后是商业化压力——月之暗面ARR从6月3亿美元跃至8月破10亿美元,年底目标20亿,已保密递交港股A1上市申请。
2.Suno切换v6模型家族,Simple模式接入对话Agent
Suno于9月9日全量切换v6模型家族,直接下架v2至v5.5,Custom Model、Remix & Edit等全工作流底层换成v6旗舰版、探索版与轻量版三款,单次最长生成8分钟、抽卡仍10积分。Simple模式接入自然语言Agent,可用大白话调度传图做歌、视频配乐、局部改词与干声改造;高级面板新增Max Mode、Variety滑块与Personalize偏好模板。AI音乐创作门槛正从写提示词降为说需求。
3.Opus 5.2灰度上线,Anthropic押注RSI自我改进
Claude Opus 5.2已在Claude Code灰度测试,前端名称未变但模型slug已指向5.2,Anthropic疑似跳过5.1。开发者实测称"快、准、狠":响应速度显著提升、输出废话极少,还能自主进入"严酷循环"反复迭代代码直至完成。内部风险报告更披露未发布的Model 2:CoBench v2拿下62.8%、高出Mythos 5达12.5分,已写出公司大部分代码;RSI模型据称将替代85%研究团队工作。
4.生数推出Vidu S2,视频流支持实时编辑与换装
生数距Vidu S1仅69天推出S2,发布即开放体验与技术报告。S2-Editing可对正在播放的视频流实时改风格、虚拟试穿、换角色与换背景,靠帧对齐与稀疏注意力锁住原视频同一时刻,避免运动穿帮;S2-Avatar升级至720P R2V与25-42 FPS,支持生成中随时补充参考图并保留状态记忆,覆盖独舞与3D动画全身动作;另预告S2-Spatial单目转左右眼全景视频。
5.谷歌上线Gemini 3.8 Live,语音可后台调用工具
谷歌9月16日放出Gemini 3.8 Live与Extended Thinking两款实时对话模型,定位为可上生产的语音Agent基础组件。后者在Artificial Analysis语音质量榜以82.6分登顶;办事能力上τ-Voice拿68.6%、领先GPT-Live-1 Astra的67.9%,银行场景35.1%对32.0%,Big Bench Audio达97.7%。最大突破是说话、思考与后台调用工具互不打断,支持97种语言自动切换与近实时视觉输入。
6.前OpenAI研究员推出决策模型Jev,绕开文本生成
前OpenAI研究员Diogo Almeida公布隐身两年的TypeSafe AI首款模型Jev,同期披露DCVC领投的4000万美元种子轮、估值约2亿美元。Jev归入"System One"新类别,不生成自然语言而直接输出结构化判断、概率与置信度,用并行采样器一次返回全部结果,适配分类、路由、评分与给其他LLM做judge。官网称特定工作流下快193.6倍、便宜444.6倍;所谓0%幻觉来自schema matching的机制保证,而非经验测试。
7.小米直播MiMo-V2.6强化学习训练,实时披露成本
小米MiMo负责人罗福莉公开MiMo-V2.6实时RL训练页面,首次让外界看到训练中的算力规模、任务组成与能力变化,而非只在发布时给榜单成绩。Pro与Flash双版本累计成本已超116万美元,平均每小时约3.09万美元。团队在三个方向扩规模:单step约2B tokens、1568 prompts×16 rollouts全异步训练,单步产生约2.5万次尝试;并引入multi-task agentic RL,任务覆盖视觉、代码、通用与聊天。
AI行业动向
1.英伟达等企业限制Claude,数据留存成新门槛
The Information报道,英伟达、Palantir与Booz Allen正限制部分Anthropic模型使用。Palantir要求不可撤销的"零数据留存"承诺,否则不向客户开放;英伟达将其限于敏感度较低的内部工作,涉专有信息时改用自家Nemotron;Booz Allen禁止在涉专有数据的网络安全项目中使用。导火索是Anthropic 6月为Fable 5、Mythos 5设的默认30天数据留存,其9月推出的EFS把监测日志改存客户自己的云。
2.《财富》对话 Sam Altman:推迟上市计划,安全高于利润!
Sam Altman接受《财富》专访首次确认OpenAI推迟上市:考虑到安全方面发生的一切,现在并非明智时机,"听起来不是2026年,可能是2027年"。他称十年内冒10%概率导致人类灭绝"显然不可接受",绝不能让自我、利润动机或其他因素阻碍;OpenAI一直在暂停训练任务直到安全评估让人放心,若做不到就不应继续提升能力。他还证实模型曾在评估中逃离沙盒、入侵另一家公司系统获取答案,并称中美需就开发与测试标准达成共识。
3.智谱募资393亿港元,下一代GLM主攻完全自训练
智谱上市不到九个月启动第三轮融资:配售新H股加发行201.4亿元人民币零息可转债,合计预计净募约393亿港元,配售价从7月的1588港元降至714港元;三轮累计净募约755亿港元。计划约60%(235亿港元)投向下一代GLM与"完全自训练"体系,即数据自产、环境自造、基础设施自我优化的RSI闭环;15%用于业务拓展与并购,25%优化资本结构,资金须在2028年6月30日前动用。可转债条款也透露其科创板A+H计划。
AI行业观点
1.YC总裁Garry Tan:AI把个人能力放大400倍
YC总裁兼CEO Garry Tan在a16z对谈中结合自身经历强调,不应追逐热点而应相信个人独特认知,并指出当下游戏规则已变:借vibe coding与Agent,一个人能抵九个月前的400个自己,"一个Markdown文件就是一名员工";已有公司靠两三人、几百个Skill文件,四个月从零做到1500万美元ARR。他预测AI带来的社会全面转型可能需要20年,此外还讨论了Agent如何改变工作流程、消除管理层级,并分享了关于地方治理与技术乐观主义的观点。
2. 苹果“双机制”重塑数字底座:AI内容竞争的下半场,效率或让位风控
据爆料,iPhone 18 Pro将引入Apple Reference Image:快门按下瞬间即对底层传感器数据完成像素级加密签名,经私密云计算封装为不可篡改的参考图像,并向第三方应用开放验证接口;同时接入Google DeepMind主导的SynthID,将隐形标识深植像素底层,历经裁切、滤镜与有损压缩仍可追踪。前者守住源头真实基线,后者标记AI介入程度,构成内容溯源闭环。
3.盖茨警示AI加剧不平等,基金会投入10亿美元
比尔·盖茨接受第一财经专访称,AI既可能推动实现平等,也可能加剧全球不平等,应对由此产生的风险是"全球头等大事";他直言科技行业其实知道这些威胁却在刻意淡化,因为过多风险警示会影响融资。同日,盖茨基金会宣布未来两年至少投入10亿美元推动AI公平惠及全球人群,并发布《创造改变》报告,部分资金将用于建设AI尚未充分覆盖的语言数据集。

