文章摘要
9月20日AIbase日报汇总AI领域多赛道共8项行业热点:ChatGPT官方插件登陆Word并向全量用户开放,当前Word已有三套AI工具,办公AI竞争加剧;多家机构推出升级后的语音转文本、同声传译、基座模型等产品,另有代码工具就数据安全争议公布开源整改方案,B站上线百款大模型测评榜,DeepSeek推出假期API半价优惠。

近期AI领域迎来多项重磅更新,覆盖办公工具、基座模型、语音识别、代码工具等多个赛道,以下是详细行业动态汇总:


ChatGPT官方插件登陆Word,免费用户均可使用

OpenAI推出的ChatGPT官方Word插件已面向全球全量账号开放,包括免费用户群体。该插件为文档创作者提供了整理笔记、生成摘要、调整语气风格等多项实用写作辅助功能,不过插件功能存在分层限制,且和Codex等工具共享调用额度。值得注意的是,当前Word办公软件中已经同时存在微软Copilot、Anthropic Claude和OpenAI ChatGPT三套AI工具,办公软件的AI化竞争正愈发激烈。


语音转文本技术升级,错误率减半价格不变

SpaceXAI推出的新一代语音转文本模型Grok Voice Transcribe 2.0,该版本将识别错误率降低了约一半,同时保持原有定价不变。新增了说话人分离和精确时间戳等进阶功能,在公开评测榜单中准确率排名第一,目前已经深度应用在客服电话录音转写和特斯拉车机系统中。


同声传译模型再升级,延迟降低至2.3秒

千问发布的Qwen3.8-LiveTranslate新一代同声传译大模型完成全面升级,在翻译质量、延迟控制、说话人识别和语音合成四个核心维度都有明显提升。其字均延迟从原本的2.8秒压缩至2.3秒,同时新增三大核心能力:实时说话人分离可以清晰区分多人交替发言的归属,原文译文同帧同出实现双语同步显示便于即时核对,长上下文消歧功能通过关联历史语境减少专有名词和指代带来的翻译歧义,译文还能稳定保留原说话人的音色特征。


旗舰基座模型发布,单任务成本仅为竞品1/8

阶跃星辰发布新一代旗舰基座模型Step5Preview,该模型重点优化了AI编程、软件工程、专业知识工作和金融场景的表现,在真实世界智能体任务中的综合能力得到显著提升。在AA综合智能指数评测中,该模型跻身全球开源模型前三,单任务运行成本仅为Claude Opus5的1/8。该模型采用稀疏MoE架构,支持百万级Token的上下文窗口,原生支持文本与视觉多模态输入,计划于10月15日正式开源。


知识库工具开源,实现知识从查询到执行的闭环

微信AI团队开源的WeKnora知识库工具,旨在让知识库不再局限于提供查询答案,而是能够直接执行相关操作。该工具通过anydoc解析技术支持多种格式文档直接导入,自动将杂乱的文档整理为结构化知识体系;结合GraphRAG技术通过实体和关系构建知识图谱,提升关联问题回答的准确性;同时搭配Skill Sandbox Runtime将知识封装为可执行技能,在沙箱环境中安全执行并返回可验证结果,形成了从文档解析、知识组织、检索、执行到记忆的完整解决方案。


代码工具回应数据安全争议,将开放源代码

智谱AI旗下代码助手ZCode此前因“代码库索引”功能默认开启,导致部分用户的代码数据被上传,引发了用户数据安全争议。官方随后发布情况说明并致歉,披露了事件细节和整改方案:首先已经修复了相关漏洞,同时明确云端生成Wiki后会立即销毁用户数据,不会进行留存;为重建用户信任,ZCode还计划开放源代码并邀请第三方独立团队进行安全审查。


大模型测评新玩法,百款模型同台竞技

B站上线AI无限竞技场测评榜单,汇集了上百个大模型进行真实场景下的对抗测试。该榜单不设置固定的测评维度,由UP主自主命题,让不同模型在实际应用场景中展现能力差异。在首轮测试排名中,GPT-6夺得榜首位置,同时也是登顶次数最多的模型。


API计费优化,假期迎来十天半价窗口

DeepSeek明确了调休日和节假日的API计费规则,在中秋国庆假期期间将迎来为期十天的半价优惠窗口。同时该团队发布的V4.1 Flash模型在性能上超越了旗舰版本V4Pro,售价却更为实惠,在空闲时段下的输入和输出成本进一步降低,整体性价比得到大幅提升。

以上内容不代表本平台立场,仅供读者参考