文章摘要
过去一周AI领域更新密集,多款大模型发布或升级。如深度求索、阿里千问、智谱等推出新模型,OpenAI发布GPT - 5.6 Sol Ultrafast模式;商业进展上,ChatGPT广告扩展市场,企业收入超消费者业务,Anthropic Q2营收破115亿美元且计划高估值IPO;还出现重大并购与监管事件,SpaceX完成600亿美元收购,监管叫停Meta收购Manus。

精彩的一周。

本周AI行业动态概览

过去一周AI领域迎来密集更新,多款大模型扎堆发布、重大并购落地及商业化进展成为行业焦点,以下是详细汇总:


深度求索技术更新与定价调整

8月13日,深度求索正式推出DeepSeek-V4-Pro正式版,这款总参数达1.6万亿的MoE模型,实际激活490亿参数,已通过MIT协议开源权重,可适配国产GPU降低私有化部署门槛。模型原生支持OpenAI Responses API,针对Codex做了专门优化,官方表示其在编程和智能体场景下表现最为突出,整体性能接近主流旗舰模型。用户可通过App、网页端或API调用,选择专家模式即可使用。

同日,DeepSeek Harness v0.1同步开源,以MIT协议发布并对标Claude Code,其核心架构Cordis将模型、工具、沙盒、存储和智能体循环封装为可插拔插件,提供Standard、PTC、Minimal和Creative四种运行模式。8月17日起,DeepSeek全线实施峰谷定价:高峰时段为北京时间9:00-12:00和14:00-18:00,DeepSeek-V4-Pro输出单价从6元涨至27元/百万token,输入单价从3元涨至9元/百万token,缓存命中收费0.3元;非高峰时段价格减半,DeepSeek-V4-Flash也同步调整定价。


阿里千问双发Qwen3.8系列模型

8月13日,阿里千问团队开放了旗舰级Qwen3.8-2.4T-A95B的模型权重。这款2.4万亿参数的MoE架构模型,实际激活950亿参数,原生支持256K上下文长度。官方评测显示,其在编程智能体、通用智能体、专业工作和长上下文等方向的表现,与Claude Opus 4.8、Claude Fable 5、GPT-5.6 Sol互有高低,在PaperBench和IFBench等基准中位居前列。

8月14日,团队又以Apache 2.0协议开源了Qwen3.8-27B,这款27B参数的小模型在编程和办公场景的表现超越了更大的Qwen3.7-Plus。该模型新增了推理力度调节功能,可以根据任务难度自动控制思考深度,在保持性能的前提下节省推理资源。


智谱发布GLM-5.3,编程能力提升50%

8月14日,智谱发布GLM-5.3,该模型与GLM-5.2共用同一个基座,所有能力提升全部来自后训练Scaling,通过数十倍的长程任务环境、更丰富的环境类型和更长的后训练周期实现。

智谱内部测试显示,其编程能力较GLM-5.2提升50%。在公开基准测试中,GLM-5.3在Terminal-Bench 3.0上从4.6分跃升至28.3分,在DeepSWE v1.1上从46.2分提升到66.9分。「GLM Coding Plan」已全量上线,模型权重计划在发布约两周后开放,届时需完成安全评估。


Manus恢复独立运营,监管叫停AI外资收购

8月11日,Manus宣布恢复以独立公司形式运营,背景是监管机构依据外商投资安全审查制度发布禁止决定,要求Meta和Manus取消此前约20亿美元的收购协议,恢复交易前原状。这是该制度实施以来首例公开叫停的AI领域外资收购案。

分拆过程中,为满足部分国家和地区的监管要求,2025年12月29日收购公告日之后创建的用户数据将在8月23日至24日期间删除。受影响用户需要在8月23日07:59前完成备份,8月25日起即可恢复,官方将提供数据迁移工具和回归奖励。目前Meta与Manus已逐步切断数据共享通道,Manus员工不再能访问Meta内部系统。


MiniMax推出Music3,生成最长5分钟完整歌曲

8月14日,MiniMax推出音乐生成模型MiniMax-Music3,可根据歌词和音乐描述生成最长5分钟的完整歌曲,输出32kHz 16-bit立体声。模型采用双LLM架构:8B的Global LLM基于Qwen3-8B初始化,负责全曲的旋律结构和语义走向;0.6B的Local LLM负责每一帧的声学细节,再通过Flow Matching和Flow-VAE合成最终音频。

该模型支持歌词段落标记,包括Verse、Chorus、Bridge等结构,音乐描述可以精确到曲风、BPM、调性、情绪走向、人声风格和编曲细节。模型权重已在Hugging Face开源,支持SGLang、diffusers和ComfyUI三种推理框架,通过逐层卸载最低可在8GB显存的显卡上运行。


OpenAI推出GPT-5.6 Sol Ultrafast模式,推理提速14倍

8月14日,OpenAI发布GPT-5.6 Sol的Ultrafast模式预览版,由Cerebras芯片驱动,最高可实现每秒750个token的输出速度,推理速度是标准模式的14倍。目前该模式仅面向部分API客户开放,定价尚未公布,ChatGPT和Codex端暂未接入。OpenAI内部团队已使用该模式分析日志和追踪事故,将原本隔夜运行的研究流程压缩到工作日内多次迭代。

同一周,Mac版ChatGPT上线Computer History功能,取代此前的Chronicle预览版,提供桌面活动记录和时间回溯功能,不再依赖截图记录用户的桌面操作;Linux桌面端ChatGPT预览版也在8月12日同步推出,支持ChatGPT、ChatGPT Work和Codex。


ChatGPT广告扩展至新市场,企业收入超消费者业务

8月11日,OpenAI为ChatGPT广告测试新增英国、日本、韩国等市场,墨西哥和巴西同步开放广告主账户。广告仅向ChatGPT Free和Go层级的成年用户展示,ChatGPT Plus、Pro、Business、Enterprise和Education层级不受影响。从今年2月在海外启动测试至今,ChatGPT广告展示的市场已扩展到7个。

8月14日,OpenAI首席财务官Sarah Friar向股东透露,企业AI业务收入已超过以ChatGPT为主的消费者业务,7月环比增长32%。第三方机构Ramp追踪七万余家海外企业的AI支出发现,7月Anthropic顶级模型的企业支出仅为OpenAI对应产品的75%,不过Anthropic的企业采用率仍然领先。同一周,部分ChatGPT Plus用户发现每周额度用完后可支付8美元即时重置,OpenAI确认正在测试该功能。


Anthropic Q2营收破115亿美元,计划2万亿美元估值IPO

8月15日,据报道Anthropic向潜在投资者披露了2026年第二季度财务数据,营收超过115亿美元,同比增长逾14倍(2025年同期约7.87亿美元),并首次实现运营盈利,运营利润约5.59亿美元。不过有分析人士指出,5-6月恰好享受了折扣算力成本,盈利的可持续性有待观察。

8月13日,有消息称Anthropic计划2026年10月IPO,估值约2万亿美元,规模有望超过SpaceX成为史上最大IPO。目前Anthropic拥有超过1000家年付费超过100万美元的企业客户。8月10日,Anthropic将Claude Sonnet 5的促销价永久化,输入2美元、输出10美元(每百万token)成为标准定价,原定9月1日涨价至3/15美元的计划取消。


Claude文本水印全球上线引发争议

为满足欧盟《人工智能法案》的透明度要求,Anthropic从8月初开始为Claude生成的文本和文件嵌入不可见水印。水印对人眼不可见但机器可检测,内容被复制粘贴后仍会随文本保留,经过一定程度修改后也可能继续存在,用于帮助判断一段文字由AI生成还是人类撰写,这项措施在全球范围统一实施。

水印政策公布后引发争议,部分用户担忧工作成果中会留下长期标记,尤其是在代码等客户项目中可能暴露使用AI的事实,有媒体采访了4名已退订Claude的用户。也有不少用户支持这项规定,认为AI内容的透明标识有助于建立信任。8月13日,Anthropic升级了Chrome浏览器的Claude扩展程序,在侧边栏带来了完整的Claude Cowork会话体验,打通全平台历史记录。


谷歌推出Gemini 3.7 Flash,月活突破10亿

8月13日,谷歌推出Gemini 3.7 Flash,专为编程和智能体场景打造。首发优惠价为输入0.75美元、输出3.75美元(每百万token),是上一代Gemini 3.6 Flash的一半,优惠持续到2026年底。该模型的FrontierCode 1.1指标从34.4%提升到43.6%,DeepSWE v1.1从49.0%提升到65.3%,Code Arena网页开发拿到1588 Elo,输出速度达到340 token/秒。

8月11日,谷歌宣布Gemini App月活跃用户突破10亿,成为谷歌史上增速最快的产品,也是第14款进入「十亿用户俱乐部」的旗舰服务。从2025年5月的4亿到2026年5月的9亿,又在不到一个月内从9.5亿突破10亿。其中63%的用户通过语音与Gemini交互,苹果用户超过1亿。


SpaceX完成600亿美元Cursor收购,Grok 4.6追平GPT-5.6 Sol

8月14日,监管文件显示SpaceX对Cursor母公司Anysphere的600亿美元全额换股收购正式生效,距6月宣布协议已过去两个月,这是科技行业史上最大收购之一。Morgan Stanley预计Cursor 2026年可为SpaceX贡献约25亿美元收入,2027年约130亿美元。Cursor将并入SpaceXAI团队,与Grok Build、Grok Bot、Grok API等产品整合。

8月12日,SpaceXAI发布Grok 4.6,在第三方评测机构Artificial Analysis综合9项基准的智能指数上与GPT-5.6 Sol取得相同成绩,API定价为输入2美元、输出6美元(每百万token),与Grok 4.5持平。同日,SpaceXAI推出Grok Bot,支持多个AI智能体全天候协作完成任务,已在公司内部多团队试用。马斯克在内部会议上透露,SpaceXAI数据中心电力容量计划到2027年底扩大约7倍,达到10GW。


英伟达开源Nemotron 3.5 Lightning,专为智能体执行层设计

8月12日,英伟达发布Nemotron 3.5 Lightning,这是一款300亿参数的MoE模型,仅激活30亿参数,专为AI智能体的执行层设计。其输出速度达到1200 token/秒,在同等精度下智能体任务的整体完成速度比Qwen3.6-35B快30%。

该模型在SWE-bench Verified上的得分从上一代的34.08%提升到51.56%,Terminal-Bench 2.1从8.29%提升到24.58%,在事实准确度指标上拿到69.9%,同级别模型中第二名仅为50.3%。通过4-bit量化,该模型可在消费级显卡上运行。


Meta开源Muse Glimmer 30B,单卡即可运行本地智能体模型

8月10日,Meta超级智能实验室发布Muse Glimmer,采用Apache 2.0协议开源。这是一款300亿参数的稠密多模态模型,支持文本和图片输入,覆盖100多种语言,上下文长度达131K token。

通过4-bit量化,Muse Glimmer的显存占用从55GB压缩到18-20GB,单张24-32GB显存的消费级显卡即可同时运行模型、KV缓存、视觉编码器和推测解码器。该模型针对本地智能体场景优化,支持编程、日程管理、文件整理、函数调用和模型互评,内置自动失败重试机制。

以上内容不代表本平台立场,仅供读者参考