文章摘要
2026年8月3日消息,本周有7款新上线或更新的AI工具与模型,涵盖多个领域。通用大模型有Qwen3.8 - Max(Preview)等;代码安全与开发工具有Alibaba OpenCodeReview;多模态视频生成工具如MiniMax H3开放权重下载;智能体工具与技能转换方面,有book - to - skill和Motion MCP等,各工具介绍了特点、使用门槛及相关信息。

2026年8月3日,本周值得关注的7款全新上线或更新的AI工具与模型涵盖多个领域:包括新一代通用大模型预览版、带原生音频的视频生成工具、超大参数智能体模型、代码审查工具、技术资料转换工具以及Claude专属视频工作流方案。

一、通用大模型新品

★ Qwen3.8-Max(Preview)

这款参数规模达2.4T的旗舰级大模型现已开放预览体验,主打长上下文处理、代码协作与智能体工作流场景,官方预计下周开放完整权重,同时将推出轻量化开放版本Qwen3.8-27B。

Qwen3.8-Max是国内头部AI团队今日开放的新一代旗舰大模型预览版,官方将其定位为面向代码开发与协同办公的专用模型,目前已接入多个官方开发平台与工具链。该模型支持百万级上下文长度、自主思考模式、函数调用、内置工具调用以及结构化输出能力,能够完美适配长代码库分析、复杂智能体任务以及自动化办公场景。官方透露,完整权重将于下周正式开放,同时还将推出轻量化的开放权重版本Qwen3.8-27B。

使用门槛

在线体验:🟢 极低|已直接集成在Qoder与QoderWork工具中,可直接调用

开发对接:🟢 简便|可通过官方百炼平台调用,支持OpenAI兼容格式API,提供免费调用额度,百炼Token Plan已完成适配

本地部署:🔴 暂未开放|预计下周随完整权重一同上线

百炼 API 文档:https://bailian.console.aliyun.com/cn-beijing?tab=model#/model-market/detail/qwen3.8-max

Qwen 3.8 官方文档:https://www.qianwenai.com/models/qwen3.8-max

★ DeepSeek-V4-Flash-0731

参数规模达304B的正式版模型权重已于近期更新,官方提供了完整的vLLM与SGLang部署示例,以及本地推理配置方案。

DeepSeek-V4-Flash-0731是DeepSeek系列v4版本的首个正式发布模型,目前已开放完整权重下载。官方提供了Transformers、vLLM和SGLang三种部署方式的示例代码,普通个人设备无法直接运行该模型,官方示例部署需要4张GB300级别的数据中心GPU。

使用门槛

开发对接:🟢 简便|可通过官方API调用,支持Responses API格式接入codex

本地部署:🔴 门槛极高|304B超大参数规模,需要多张数据中心级GPU;官方提供vLLM、SGLang部署方案,但不适合个人设备

模型权重下载地址:https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731

官方API文档:https://api-docs.deepseek.com/zh-cn/guides/responses_api/

★ Inkling-Small

活跃参数仅12B,总参数276B的多模态MoE大模型。

Inkling-Small是Thinking Machines上月发布的Inkling开源多模态模型的轻量版本,能够同时处理文本、图像与音频输入并生成文本输出。官方将其定位为通用智能体、工具调用、代码助手、聊天机器人以及检索增强应用的基础模型。目前该模型可通过Tinker Playground与官方API调用,同时支持vLLM、SGLang、TokenSpeed、Unsloth等主流本地推理框架。需要注意的是,该模型仍属于大规模MoE架构,虽然激活参数仅12B,但总参数规模达276B,BF16精度下需要约600G显存,NVFP4精度下也需要约180G显存。

使用门槛

开发对接:🟢 简便|可通过Tinker Playground或官方API调用

本地部署:🔴 门槛较高|开放权重支持主流推理框架,但总规模较大,需要多张大显存数据中心级GPU

模型权重下载地址:https://huggingface.co/thinkingmachines/Inkling-Small

Tinker Playground:https://tinker.thinkingmachines.ai/

⚡ 代码安全与开发工具

★ Alibaba OpenCodeReview

结合确定性规则和大语言模型智能体,对代码仓库进行逐行审查并识别常见安全问题。

Alibaba OpenCodeReview是开源的代码审查工具,采用确定性规则检查流水线与大语言模型智能体混合架构,能够对代码仓库进行逐行审查并识别常见安全问题。该工具内置空指针检测、线程安全检查、XSS防护、SQL注入检测等多种规则。v1.8.5版本于8月2日正式发布,新增了manifest coverage contract功能用于约束代码审查覆盖范围,同时修复了OTLP遥测路径、Windows进程启动以及CLI配置流程中的多个问题。该工具兼容OpenAI和Anthropic的接口格式,可以无缝接入现有模型服务。

使用门槛

开发对接:🟢 简便|可通过npm安装,需配置OpenAI或Anthropic兼容模型服务

项目地址:https://github.com/alibaba/open-code-review

🎬 多模态视频生成工具

★ MiniMax H3

正式开放权重下载!支持ComfyUI、fal.ai首日适配,可通过文本、图像、视频和音频参考输入,生成带原生立体声音频的2K分辨率视频。

MiniMax-H3是开源的多模态视频生成模型,今日正式开放权重下载。该模型并非单一的文生视频工具,而是由Context-IR、H3-Base和H3-Regenerate-2K组成的多阶段处理流程。开发者可以根据实际需求选择三种使用方式:直接通过文本描述生成视频;通过首帧或首尾帧控制视频内容变化;通过参考图、参考视频和参考音频来控制角色身份、画面风格、动作细节、镜头运动以及音频内容。输出方面,H3-Base默认生成短边768px的视频,支持24fps帧率,时长4到15秒,同时会生成画面、对白、音效和背景音乐,输出为32kHz立体声格式。如果需要2K分辨率的画面,则需要通过H3-Regenerate-2K进行第二阶段放大处理,并非默认直接生成2K分辨率视频。该模型已在上线首日就支持ComfyUI本地与在线调用、fal.ai平台在线调用,同时适配国产GPU。社区实测显示,使用RTX 3060 12GB显存、32GB内存和NVMe SSD的设备,可以运行864×480分辨率、124帧的视频,20个迭代步骤耗时约9分钟,这是特定量化版本和工作流下的实测结果,并非官方最低配置;提升分辨率、使用R2V功能或执行2K放大步骤都会增加显存、内存占用和运行时间。

使用门槛

在线使用:🟢 极低|可通过MiniMax Hub、海螺AI、ComfyUI等平台直接调用

开发对接:🟢 简便|可通过官方API或fal.ai等第三方平台调用

本地部署:🟡 门槛中等|约288G权重已开放下载,高配民用级硬件可运行

模型权重下载地址:https://huggingface.co/MiniMaxAI/MiniMax-H3

fal API调用地址:https://fal.ai/models/minimax/h3/text-to-video

官方API文档:https://platform.minimax.io/docs/api-reference/video-generation-v2-create/

🌐 智能体工具与技能转换

★ book-to-skill

将PDF、EPUB、DOCX等技术资料编译成按章节加载的智能体Skill。

book-to-skill是一款可以将多种格式的技术资料转换为按章节加载的智能体知识模块的工具。它能够将技术书籍、学术论文、内部文档或者资料文件夹转换为统一的智能体技能包,生成核心知识摘要、章节文件、术语表、设计模式和速查表,供Claude Code、GitHub Copilot CLI或Amp等智能体工具按需读取调用。v1.3.0版本于7月30日发布,重点新增了生成Skill时的提示注入扫描、隐形Unicode字符清理、DOCX XXE漏洞防护以及命令参数注入防护功能,同时优化了多语言章节识别能力和多种文档格式的文本抽取质量。该工具非常适合将高频查阅的技术资料转换为可复用的智能体知识模块,避免每次都将整份文档塞入智能体上下文。

使用门槛

开发对接:🟢 简便|兼容主流智能体框架,可独立使用pip包调用抽取引擎

项目地址:https://github.com/virgiliojr94/book-to-skill

★ Motion MCP

让Claude从产品资料生成发布视频,并支持持续修改节奏、文案、画面和CTA内容。

Motion MCP是推出的AI视频工作流工具。近期公开的Claude Launch Video Skill,可以让Claude直接读取产品链接、文字资料或已有素材,由Motion自动完成脚本撰写、视觉素材规划、配音录制、背景音乐选择以及视频渲染全流程,同时支持通过后续指令持续修改成片的节奏、文案、画面和CTA内容。该工具非常适合创业团队、独立开发者和产品营销人员快速制作发布视频、产品演示短片、广告素材以及社交媒体内容。Motion的核心价值并非单次视频生成,而是让智能体能够创建视频任务、查看任务执行状态,并根据用户反馈持续迭代优化最终成片。

使用门槛

在线使用:🟢 极低|可使用Motion Studio的产品化服务

开发对接:🟡 中等门槛|需要兼容MCP协议的智能体环境,使用时需消耗Motion积分

官方文档地址:https://motion.so/learn/mcp-video-generation

以上内容不代表本平台立场,仅供读者参考