文章摘要
8月AI行业动态不断。产品方面,DeepSeek、SpaceXAI、智谱、荣耀等有新品推出,如Gemini月活破10亿,荣耀发布Robot Phone;技术上,各模型能力升级,如Grok 4.6智能指数提升、GLM - 5.3编程与安全能力增强。市场格局中,美企AI采用率头部厂商占比高,高性能模型溢价难维持。腾讯财报受AI投入影响,利润增速放缓,股价下跌。

近期AI行业迎来多款重磅产品发布与市场动态更新,涵盖大模型技术升级、智能硬件创新、行业格局变化以及企业投入动向,以下为详细梳理:

8月中旬,DeepSeek接连推出两款重要产品。8月12日深夜,V4 Pro-0813版本悄然上线,相比预览版新增了三档思考力度控制,并原生适配了OpenAI相关API接口,但上线后出现多处异常:长推理任务思考时长不足10秒,长链路Agent任务提前收尾,部分场景表现甚至不如V4 Flash。次日下午该模型从API下线,当晚19点正式发布,官方表示正式版Agent能力大幅增强,在Terminal-Bench 2.1测试中得分从预览版的72.1分提升至87.9分。

同步推出的还有API调价公告,8月6日DeepSeek曾预告将整体上调API定价,新价格自8月17日0时生效,同时启用6月底预告的峰谷定价机制,空闲时段价格为高峰时段的一半。以V4 Pro为例,调价前不分时段价格为每百万Tokens输入0.025元(缓存命中)、3元(缓存未命中),输出6元;调价后高峰时段(9:00-12:00、14:00-18:00)分别涨至0.3元、9元、27元,涨幅最高达1100%,空闲时段则为0.15元、4.5元、13.5元。

8月13日,DeepSeek还发布了首款Agent产品DeepSeek Harness的开发者预览版v0.1,面向全球开发者开放测试,并以MIT协议在GitHub开源全部代码。该产品属于Agent执行框架,本身不运行大模型,而是负责调用工具、管理上下文、推进任务,连接模型与真实操作,类似OpenAI Codex和Anthropic Claude Code的定位。

DeepSeek Harness采用“一切皆插件”的开放架构,模型、工具、技能、会话等所有Agent能力都由插件组合而成,开发者无需修改源码即可自由增删组件,搭建专属Agent,官方内置11个插件式Skills。产品提供标准、PTC、极简、创造四种模式,其中PTC模式(程序化工具调用)由模型生成代码组合多轮工具调用,是其核心差异化设计。有开发者评价,相比Codex和Claude Code的精装模式,DeepSeek Harness更像可自由组装的毛坯房,灵活性更强但需要自主完善。

8月12日,SpaceXAI发布旗舰模型Grok 4.6,在第三方测评平台Artificial Analysis智能指数中获得61分,仅次于Anthropic的产品,与GPT-5.6 Sol并列全球第三,标志着SpaceXAI重回大模型第一梯队。相比上一代Grok 4.5的56分、更早的4.3版本的38分,此次升级幅度明显。官方表示,Grok 4.6专为长时智能体任务打造,聚焦编程、知识工作以及复杂交互式视觉任务,沿用了Grok 4.5的底座,改进主要来自后训练阶段,在长任务链条中会更频繁地自我校验后再推进下一步。该模型上下文窗口达50万Tokens,定价为每百万输入/输出Token 2美元/6美元,比Claude Opus 5和GPT-5.6 Sol低60%以上。

8月11日,SpaceXAI还推出了Grok Bot早期测试版,官方将其定位为“AI队友”,区别于传统聊天机器人和办公应用。该产品的本地界面类似微信,每个对话框对应一个具备专属能力的Agent“AI队友”,用户可以通过对话框向不同Agent发布任务,且这些Agent运行在云端专属电脑上,即使关闭本地设备也能继续执行任务。

用户可以授权Agent登录常用应用和邮箱,包括暂未开放API的服务;多个Agent可以在共享频道内传递任务、同步上下文,仅在关键节点请求用户介入。同一用户名下的所有Bot共享一台云端机器的文件、浏览器会话和登录状态,省去跨Bot搬运资料的麻烦,但也意味着无权限隔离。该产品具备持久记忆能力,可以记录用户偏好、修正学习流程,中断后可恢复线程,用户还可以通过演示工作流来训练智能体独立执行任务。Grok Bot最初为内部原型,现已在公司内部广泛使用,支持macOS、Windows、Linux及iOS平台,后续将推出Android版本,目前仅面向三档订阅用户开放。

8月14日,智谱发布GLM-5.3,主要面向复杂编程、长程智能体和网络安全任务,已向全部GLM Coding Plan用户开放,模型权重暂未公开,智谱计划在完成安全评估和加固后,于发布两周后开放。

根据智谱自测数据,此次升级主要在两个方向:一是编程与长程智能体能力,在内部Z.ai Code Bench测试中,编程体感较GLM-5.2提升50%;Terminal-Bench 3.0得分从4.6升至28.3,DeepSWE v1.1得分从46.2升至66.9,智谱表示该模型在编程和智能体能力上接近Claude Fable 5。二是网络安全能力,在CyberGym测试中,得分从77.2升至84.5,略高于同类型产品;在ExploitBench测试中,得分从24.4大幅提升至54.4。此次升级未更换基础模型,能力提升主要来自扩大后训练,团队在过去一个月增加了训练环境、任务类型和算力投入,使训练更贴近真实软件工程和科研工作。由于网络安全能力增长超出预期,智谱决定推迟公开权重以降低被滥用于网络攻击的风险。

8月12日,荣耀发布全球首款机器人手机Robot Phone,将手机从传统触控工具升级为具备感知与物理执行能力的智能终端。产品提供两个存储版本,售价分别为9999元、12999元,将于8月18日正式开售。

硬件层面,该机搭载行业最小4自由度机械云台,可在0.8秒内快速弹收,支持摄像头自主转向、人物追踪和多角度智能运镜。影像方面,荣耀与专业电影摄影机厂商联合完成色彩调校,首发自研影像芯片,整机配备旗舰芯片与大容量电池,机身厚度和重量控制均衡。

AI交互是该产品的核心差异点,首发专属机器人交互模式,由荣耀与大模型联合完成终端适配,可解析长文本指令,自主完成超百步跨应用连续操作。依托多模态识别能力,设备可通过手势、语音和声音联动云台,实现自动追焦、智能构图、视频通话跟随等场景。同时荣耀上线专属技能商店,开放百余项系统底层能力,支持用户和开发者自定义拓展AI功能。此次首发的交互体系与影像能力,将下放至9月上市的Magic9系列。

8月11日,Google官方宣布,Gemini独立应用的月活跃用户突破10亿,成为Google历史上增长最快的产品,也是该公司第14款月活破10亿的产品,该数据仅统计Gemini应用本身,不含其他渠道的AI用户。Gemini的用户规模增长迅速,从年初的不足10亿仅用数月时间实现突破。

Google官方同时公布了使用数据:语音成为主要交互方式,超六成用户直接通过语音与Gemini对话,特定人群使用语音处理日常任务的概率更高;每五次Gemini Live交互中就有一次超出纯语音范畴,用户通过实时摄像头或屏幕共享解决现实问题;不同平台的使用特征存在明显差异。

8月12日,相关机构发布月度AI指数报告。7月美国企业AI采用率格局中,头部厂商占据主要市场份额,不同厂商的增速存在明显差异。在已使用AI的企业中,使用模型服务平台的比例小幅提升。

在具体模型使用上,头部厂商的旗舰高性能模型表现遇冷,发布一个月后的市场占比远低于预期。该旗舰模型是目前性能最强的模型之一,同时也是最贵的,价格远超同类产品。相关分析认为,高性能模型将越来越难以维持高溢价,市场对模型性价比的关注度正在提升。

8月12日,腾讯发布2026年第二季度财报,当期营收实现稳步增长,利润端受AI投入拖累明显。按国际财务报告准则,公司归母净利润同比小幅增长;按调整后口径,经营利润增速受AI相关开支影响被明显拉低,若剔除新AI产品的相关收支影响,经营利润增速恢复至两位数。

分业务来看,各板块均实现不同程度增长,其中营销服务板块增速最快,腾讯将其归因于AI驱动的广告推荐模型持续优化。本季财报的核心变量是AI驱动的高额资本开支,单季支出同比大幅增长,导致当期自由现金流为负,若剔除算力采购预付款项,自由现金流仍保持正向。腾讯相关负责人表示,本轮集中投入以今明两年为主,后续将根据收益动态控制规模,当前资本开支优先用于训练更高规格的大模型。财报发布次日,腾讯控股港股出现明显下跌。

以上内容不代表本平台立场,仅供读者参考