文章摘要
本文汇总了2026年9月2日前后六大类AI旗舰模型与开发工具的更新,包括Anthropic两款不同定位、开放范围的Claude系列新模型,李飞飞团队发布的新一代空间世界模型Atlas,阿里千问优化编程办公能力的Qwen3.8-Max-0902,此外还有Runway生成式界面模型Solaris、开源文档处理Agent PageIndex、OpenAI MCP安全接入工具的更新,各产品开放权限、上手门

2026年9月2日的AI工具更新涵盖了六大类核心产品:从旗舰大模型到空间世界建模工具、编程办公模型、生成式界面系统、文档处理Agent以及MCP安全接入工具,覆盖了从通用开发到专业领域的多种需求。

🧠 旗舰模型

★ Claude Fable 5.1 / Mythos 5.1

Anthropic在本月推出了两款基于同一底层架构的Claude系列模型:Fable 5.1和Mythos 5.1。两款模型共享核心能力,但设置了不同的安全限制和开放范围。

Fable 5.1面向普通开发者、企业和个人用户,支持编程、知识工作、长期Agent以及科学任务等场景,可通过Claude API、AWS、Google Cloud和Azure调用,定价为输入10美元每百万Token,输出50美元每百万Token,缓存读取为0.25美元每百万Token。而Mythos 5.1则针对经过审核的网络安全和生命科学机构开放,需要通过Cyber Verification Program或Life Sciences Verification Program的资质审核,因此并非所有Claude 5.1相关产品都对普通用户开放。

两款模型均未开放权重,也没有开源计划。

上手门槛

Fable 5.1的在线使用门槛较低,普通用户和企业可直接通过Claude产品体验;开发接入则可以通过Claude API和各大云平台,需要配置对应凭证并按Token计费。

Mythos 5.1的在线使用仅面向通过审核的机构,门槛中等。

🌐 空间世界模型

★ Atlas

由李飞飞联合创办的团队在9月1日发布了新一代空间世界模型Atlas。该模型采用多模态自回归扩散Transformer架构,从零开始预训练,原生支持文本、图像、视频、相机位姿和3D深度信息的处理,将各类输入整合到统一的空间上下文体系中。

Atlas支持相机控制生成、空间重建、时空模拟和图像生成功能,用户可以通过参考图片指定相机位置和运动轨迹,官方公布的生成上限为最长1分钟、1440p分辨率的视频。除了新视角图像和视频外,它还可以输出深度信息、3D点云和3D Gaussian splats,可应用于影视制作、游戏设计以及机器人Real-to-Sim仿真等场景。

需要注意的是,模型会对输入中未覆盖的区域基于世界知识进行生成式补全,并不等同于对现实空间的精确复刻。目前Atlas仅向部分合作伙伴开放Early Access,尚未公开模型权重、代码或公共API,官方表示未来会将其应用到新版Marble和其他自有产品中。

上手门槛

Atlas的在线使用门槛较高,仅向部分合作机构开放,提交申请并不代表能立刻获得使用权限。

💻 编程与办公模型

★ Qwen3.8-Max-0902

阿里千问在9月2日上线了Qwen3.8-Max-0902,这是Qwen3.8-Max的日期快照版本,沿用了总参数2.4万亿、每次推理约激活950亿参数的MoE架构,继续支持100万Token的上下文长度。

本次升级主要针对编程和协同办公场景进行了后训练,重点提升了工程级编程、多工具调度、复杂企业任务处理、科研分析以及长周期自主开发的能力。根据官方公布的数据,该版本在多个评测中的得分均有提升:Code Arena WebDev从1669分升至1691分,TerminalBench 3.0从11.3升至29.0,DeepSWE 1.1从56.6升至69.3,JobBench从53.4升至64.0。需要说明的是,不同评测基准使用的工具和Agent Harness存在差异,实际表现仅供参考。

云端版本支持文本、图像和视频输入,输出文本,同时提供思考模式、函数调用、结构化输出、上下文缓存、联网搜索和代码解释器等能力,最大输入约991K Token,最大输出131K Token,国内API定价为输入12元每百万Token,输出36元每百万Token。

需要注意的是,Qwen3.8-Max-0902目前仅作为云端API快照提供,原始Qwen3.8-Max虽已开放权重,但官方尚未确认该快照版本存在独立的权重仓库或可自行部署的版本,因此不能直接将原始权重等同于该版本的权重。

上手门槛

在线使用门槛较低,登录千问AI平台即可体验,支持文本、图像和视频输入。

开发接入相对简单,兼容OpenAI API,模型ID为qwen3.8-max-0902,只需配置DashScope API Key即可使用。

🧩 生成式界面模型

★ Solaris

Runway在8月31日发布了Solaris的研究介绍,将其称为首个Interface World Model。与传统的前端开发不同,Solaris并不需要先搭建完整的界面代码,而是将界面视为一个可持续生成的视觉世界:用户的点击、拖动或输入操作都会触发系统根据当前状态逐帧生成下一步的界面画面。

在这套架构中,语言模型负责判断界面的响应逻辑,世界模型则负责实时渲染画面。Runway的目标是让Solaris最终支持实时交互、完整的会话一致性和720p的视觉质量,让设计师无需完成传统开发流程就能测试产品的交互效果。

目前Solaris仍处于研究预览阶段,官方尚未公开代码、模型权重或公共API,仅开放Early Access申请,当前仍有多个待解决的问题,包括稳定生成可读文字、保持长会话一致性、约束事实内容,以及接入无障碍API和现有软件栈等。

上手门槛

Solaris的在线使用门槛较高,仅开放Early Access申请,用户需要等待审核通过才能获得使用权限。

📚 文档Agent工具

★ PageIndex v0.2.14

PageIndex v0.2.14在北京时间9月2日07:17发布,GitHub Release和PyPI上传的时间基本一致。本次更新将项目扩展为完整的SDK,本地模式和云端模式使用统一的客户端接口,默认的PageIndex Flash功能可以根据PDF的页面布局快速构建树状文档结构。

本地模式无需依赖PageIndex Server、API Key或向量数据库,SDK支持流式聊天、类型化事件,以及OpenAI Responses和Anthropic Messages协议,还提供了agent_tools()、as_openai_tools()、as_anthropic_tools()、as_claude_mcp()等工具,可以将文档检索能力转换为不同Agent可调用的函数。

该版本也包含了破坏性的接口调整:原有的responses()和messages()入口统一迁移到chat(protocol=...)方法中,show_process中的部分事件键名也从复数改为单数。该项目采用MIT许可证开源。

上手门槛

该工具的开发接入门槛较低,可以通过pip安装官方SDK,还可以将文档检索能力转换为OpenAI、Anthropic和Claude MCP可用的工具。

🔐 MCP安全接入工具

★ OpenAI Secure MCP Tunnel Client v0.0.14

该工具在北京时间9月2日05:04发布,通过客户端主动向OpenAI发起出站HTTPS长轮询的方式,无需将本地或内网的MCP Server暴露到公网,也不需要新增入站防火墙规则,支持Streamable HTTP、stdio和Go进程内三种传输方式。

本次更新主要聚焦于隐私、密钥和连接边界的优化:新增了HMAC-SHA-256启动目录摘要功能,将Connector转发的Header限制在配置的MCP源站范围内,拒绝跨域的MCP重定向,Support archive会清理环境变量和CLI中的额外Header密钥,同时修复了代理长轮询空闲断连和stdio会话重用JSON-RPC ID的问题。

该工具的开源范围仅覆盖客户端tunnel-client、Go SDK、CLI和部署工具,采用Apache-2.0许可证,OpenAI托管的Tunnel控制平面并未包含在仓库中,实际使用仍需要Tunnel ID、Runtime API Key和对应的组织权限。

上手门槛

该工具的开发接入门槛中等,需要Tunnel ID、Runtime API Key和组织权限,自助创建能力受rollout机制限制。

以上内容不代表本平台立场,仅供读者参考