Claude Fable5.1正式上线 性能安全成本全面优化

2026年9月2日,行业动态显示,多家AI企业发布了最新的模型更新与生态进展,其中包括Anthropic的Fable 5.1正式版发布等重要消息。
核心产品更新与安全优化
Anthropic宣布Fable 5.1已经全面可用,面向网络安全防御者和生命科学研究者的Mythos 5.1,则通过可信访问项目逐步开放。这次更新不只是模型能力提升,也包括安全机制和企业服务的调整。官方表示,网络安全场景下对良性请求的误拦截减少了约60%;在基础生物学和医学问题上, fallback比过去减少了约85%。同时,Anthropic推出了Enterprise Frontier Safeguards(EFS),它试图在保持零数据保留级别隐私的同时,继续识别和阻止恶意使用,预计从今年秋季开始分阶段推出。
Fable 5.1的核心改进
Anthropic的Boris Cherny重点谈了Fable 5.1的三个关键变化。第一是写作风格,新版的语气更自然,团队正在持续减少用户所说的“Claude-speak”,也就是那种过于格式化、过于像AI的表达方式。第二是安全机制,新版生物学安全机制对良性请求的干预次数,比Fable 5时减少了85%;Claude Code用户在每次会话中遇到的网络安全干预,预计减少约60%。第三是价格,Fable 5.1的cache reads价格从每百万token 1美元降至0.25美元,对典型的Claude Code会话来说,整体成本最高可以下降约38%。
企业场景测试与行业洞察
Box的Aaron Levie分享了Fable 5.1的早期测试结果。在企业非结构化数据任务上,Fable 5.1比Fable 5提高了7个百分点。测试使用Box Agent处理金融服务、生命科学、公共部门等领域的真实文档任务,这些任务同时要求分析、数学、逻辑和行业知识。
具体来看,在税后利润预测任务中,Fable 5.1能正确处理资本抵扣和税务计算的先后顺序,金融服务场景提升了17%;面对指标归一化方式存在歧义的成本优化任务时,它能主动计算两种结果并指出正确答案,科技场景提升了37%;在教育数据分析中,它正确完成加权平均和排名计算;公共部门场景提升了16%。
Levie认为,这说明模型的提升正在从单轮问答进入长时间运行的企业工作流。Fable 5.1之后将进入Box AI Studio,用于构建基于企业内容的定制Agent。他还判断,网络安全很快会成为一个高度垂直化的AI领域。前沿模型目前仍然领先,但开源权重模型已经追得很近。企业面对的安全发现会越来越多,真正的工作将变成:由AI发现漏洞、分流问题并自动提出修复方案,再由人类进行监督。安全行业反而可能成为AI创造新工作的领域。
安全可观测性方案
Alex Albert认为,EFS可能比单纯的模型升级更重要。传统的零数据保留可以保证数据不被保存,但当Agent获得企业内部系统权限后,企业仍然很难观察多个会话之间是否出现了异常行为。EFS的思路是让企业数据继续留在自己的云环境中,同时增加一个自动监控层,用来识别Agent在不同系统和会话中的风险模式。Albert把它称为面向Agent的observability和风险缓解层,并判断随着Agent获得越来越多的企业权限,这类能力很可能会成为企业部署AI的标准要求。
他还展示了Fable 5.1通过代码生成视频的能力:给模型一张房产地块的图片,模型自行设计房屋、完成渲染,并生成一段电影感的房屋漫游视频。后续他补充说,整个流程使用了headless Blender。
团队使用体验
Cat Wu表示,使用Fable 5.1后,他们团队开始承担过去可能需要几个月才能完成的项目。她鼓励用户把更大的想法直接交给Fable 5.1,并在Claude Code、Claude Cowork和Claude Tag中尝试,再反馈实际效果。
OpenAI最新进展
Sam Altman表示,OpenAI过去一段时间一直在加速推进安全相关工作。他认为,模型能力和安全措施必须同步发展,不能只追求能力提升。目前,Astra已经完成训练,在能力和alignment方面都是明显的一步;同时,OpenAI即将发布下一款模型。对于后续模型,公司会在必要时放慢进度,以确保安全和alignment工作跟得上。
生态与工具集成
Guillermo Rauch宣布,Fable 5.1已经进入Vercel AI Gateway,用户可以通过统一接口调用它。他还介绍了Vercel的Fluid计算架构:Build、Sandbox和Function使用统一的Dockerfile、安全边界、网络和文件系统,因此可以共享基础设施。现在Function已经支持30分钟运行时间,未来还会进一步延长;Build和Function也可以处在同一个Secure Compute边界中。
他的长期设想是把Build、Function、Sandbox和Server统一成一个全球计算平台,让开发者面对的限制越来越接近真实的物理约束,而不是不同产品之间割裂的配置方式。此外,他宣布Vercel将支持Tanner Linsley及其团队继续建设React、开源生态和Web。对于Vercel用户来说,无论选择Next.js还是TanStack,Vercel都会继续提供支持。
智能体技能管理
Peter Yang说,他不喜欢安装大量随机Skill。目前自己只保留十几个,大部分是自己写的,并且会定期删除已经不用的Skill。他也建议尽量让Skill保持精简。
他提出了一个实际问题:很多人会先运行Skill,发现结果不够好,再和AI一起手动迭代,最后让AI修改Skill,让它下次能够“一次完成”。问题在于,AI很容易针对某一次对话过拟合,久而久之,Skill会逐渐偏离原本的用途。
对于正在使用Fable 5.1的人,他建议在自己的Skill上运行/claude-api prompt-audit,用来找出已经不再必要的规则和重复内容。他正在给自己的Skill全部做一次清理。
智能体用户体验优化
Nan Yu认为,Agent产品还有一个被低估的机会:让它们变得“不那么烦人”。如果用户在对话过程中不断遇到重复确认、无效解释、过度谨慎或不合时宜的输出,他们可能还没有获得价值就已经退出了。对Agent来说,减少用户中途退出,可能比增加一个新功能更重要。
他还认为,未来UX设计师的工作范围会扩大,出现专门设计对话方式、表达节奏和说服逻辑的conversation/rhetoric designer。Fable 5.1把“写作去AI语气”作为主要更新之一,看起来只是细节,但会显著影响用户是否愿意长期使用。
WebMCP的价值
Nikunj Kothari认为,很多人仍然低估了WebMCP。借助WebMCP,Agent可以通过原生工具调用与网站交互,不只是读取网页文本,还可以使用完整的UI、交互组件和页面状态。Agent可以根据任务自行生成视图,保留用户已经做过的修改,并生成一个可以分享给其他Agent或人类的链接。
他展示了一个自己提交给WebMCP挑战赛的El Niño情况追踪器:Agent可以围绕气候信息构建自己的视图,同时保留用户编辑的内容。视频和代码由Codex与Railway完成,项目可以在elneenyo.com尝试。
企业自我迭代能力建设
Madhu Guru认为,“能自我改进的产品”应该成为每家公司的基础能力。他列出了至少五个组成部分:
-
1. 清晰定义核心指标、辅助指标和guardrail指标。
-
2. 把产品战略、路线图以及最需要推动的指标表达清楚。
-
3. 建立记录历史产品决策和原则的知识库,让Agent理解决策是如何做出来的。
-
4. 把Agent连接到内部产品系统,包括仪表盘、API、MCP和各种操作工具。
-
5. 建立一个理解完整产品开发流程的harness。
对于复杂度较低的产品,这些模块不必一开始就做得很重,可以先用简单版本搭起来,再复用现有的SWE Agent。
他还转发并评价了Shopify ML团队的案例,认为企业如果能建立自己的post-training系统、评测体系和数据飞轮,就有机会把内部数据转化为持续的模型和产品优势。

