英伟达RTX Spark双芯互联1Petaflop算力,赋能本地AI与游戏

此前在ComputeX上发布的全新超级芯片,如今已经实现在真机上落地。在本届Bilibili World展会上,英伟达首次面向普通玩家展示了搭载RTX Spark超级芯片的笔记本电脑,引发了不少关注。
这款专为个人智能体打造的芯片,搭载了Blackwell RTX GPU,同时搭配了英伟达与联发科联合研发的20核Grace CPU,实现了真正的“双芯合体”——两颗芯片并非通过传统PCI-e协议通信,而是直接通过NVLink-C2C技术焊合在一起,实现了极低延迟的高速互联。
整套硬件搭配128GB统一内存,总算力峰值达到1Petaflop,GPU和CPU可以共用同一块内存空间,完全避免了数据在两颗芯片之间反复搬运带来的性能损耗,不管是用于游戏娱乐还是AI创作,都能带来流畅的使用体验。
基于这样的硬件配置,英伟达将RTX Spark的核心定位为“本地个人智能体专用芯片”。在大模型运行方面,它可以在本地流畅跑起参数量达到120B的大模型,上下文长度最高可支持100万token,用户无需将长文档、长对话历史拆分后分批投喂给模型,一次性完整导入即可,模型也不会出现遗忘前文内容的问题。
此前OpenClaw、Hermes这类智能体一直面临一个痛点:普通消费级电脑无法安全、私密地运行智能体应用。为此英伟达推出了OpenShell运行时方案,允许用户自主设定智能体可执行的操作范围,同时支持按照隐私策略分流请求——敏感信息全部留在本地模型处理,仅将脱敏后的内容发送至云端模型。
目前OpenClaw和Hermes Agent已经将这套安全防护层集成进了新版Windows应用,用户可以通过它们在Windows系统中完成跨应用推理、生成图像视频、编写插件与应用,还能对本地文件进行语义搜索,实现全场景的智能办公与创作。
在AI创作领域,128GB的统一内存发挥了关键作用。重型3D场景的工程文件往往动辄达到数十GB甚至上百GB,普通笔记本电脑很容易出现内存不足的问题,但RTX Spark凭借这块统一内存可以轻松承载,运行起来依旧流畅。
在BW展台现场,英伟达技术人员展示了在虚幻引擎5中渲染曼哈顿3D场景的演示:整个工程文件超过90GB,但不管是拖动视角还是切换电源模式,画面都没有出现任何卡顿。
视频剪辑方面,Blackwell架构自带的第五代视频解码器可以直接处理12K分辨率、4:2:2色度采样的素材,这一规格已经远超多数专业剪辑工作站的日常需求,在笔记本电脑上实现如此高规格的视频处理更是少见。
作为面向消费级市场的PC芯片,游戏性能自然也是RTX Spark的核心卖点之一。它支持光线追踪、DLSS和Reflex低延迟技术,在1440p分辨率下可以将3A游戏的帧率稳定在100FPS以上,达到了高端消费级独显游戏本的水准。
不过由于采用了Arm架构,不少玩家担心游戏适配问题。但目前KRAFTON、网易、Remedy Entertainment、Riot Games以及XBOX等多家厂商已经表态,将推出针对该芯片的原生Arm版游戏。当时网易雷火事业部高级副总裁程龙就提到,玩家可以在超轻薄的RTX Spark笔记本电脑上,完整体验《永劫无间》这类游戏的全部效果。本次BW展会上,英伟达也现场展示了搭载该芯片的笔记本运行Arm原生版《永劫无间》的画面:全画质拉满,开启DLSS多帧生成、全景光线追踪等全部特效后,画面依然流畅丝滑。
如果说RTX Spark更适合普通消费者,英伟达同期展示的另一款产品DGX Spark桌面超算,则是面向技术极客和AI开发者的专业设备。
DGX Spark的核心硬件组合与RTX Spark完全一致:同样搭载Grace CPU与Blackwell GPU,通过NVLink-C2C技术直连,配备128GB统一内存,总算力峰值同样为1Petaflop。不过这款产品基于Linus平台打造,瞄准的用户群体和使用场景与RTX Spark完全不同。
RTX Spark主要集成在笔记本和桌面主机中,主打智能体运行、创意创作和游戏娱乐等消费级体验;而DGX Spark则是一台预装了完整NVIDIA AI软件栈的开发机器,开发者可以直接在这台设备上完成大模型的原型验证、微调与推理,最高支持参数量达到200B的大模型运行。
同时DGX Spark内置了ConnectX网络技术,通过两台设备互联即可处理参数量更大的AI模型,对于独立开发者来说,这意味着可以将原本需要依赖云端的模型训练和微调工作,搬回自己的桌面完成。
在智能体应用方面,DGX Spark同样搭载了OpenShell方案,英伟达的Agent Toolkit将开源模型和相关软件打包,方便开发者在这台设备上构建和部署更安全的自主智能体。由于拥有128GB统一内存和1Petaflop的本地算力,智能体可以实现常驻运行,无需像云端方案那样按次调用、按token计费,大幅降低了使用成本。
本次BW展会上,英伟达现场演示了在DGX Spark上运行35B参数量的Qwen多模态模型驱动的个人智能体:演示者用笔在纸上绘制了老黄提出的“AI五层蛋糕”草图,举到摄像头前后,智能体仅用几十秒就在本地生成了完整的复刻网页,用户还可以继续下达指令微调不同风格的五层蛋糕样式,全程无需支付任何token费用。
此外英伟达推出的NemoClaw也已经适配了DGX Spark,可为长时间在线运行的AI助手提供安全和隐私保护,用户无需将敏感数据上传至云端,就能让智能体持续在后台运行处理任务。
除了两款全新的智能体芯片产品,英伟达本次还带来了首个GeForce典藏卡系列,用来回顾GeForce品牌从诞生至今的高光时刻。
这套收藏卡为免费赠送的周边产品,共计14款设计,致敬了从1995年NV1到2016年GTX 1080的经典GeForce产品与历史时刻。每一包卡包含6张卡片,内容涵盖标志性GPU型号、令人印象深刻的LiveDemo、经典游戏作品,以及所有GeForce玩家铭记的历史高光瞬间。
据现场工作人员介绍,本次的收藏卡包中还设有隐藏款,有玩家抽到了《赛博朋克2077》夜之城主题的RTX 2080 Ti特别版,此外还有一张带有老黄形象的超大隐藏款,不知会被哪位幸运观众抽中。
塔猴是一个专注于为用户提供系统学习、内容创作与商业连接的AIGC综合服务平台,致力于为每一位AI探索者打造理想的创作、成长家园。在塔猴,你不仅可以学习众多AIGC类实战课程,获得与时俱进的AIGC技能和视野,还有机会获得长期商业合作和接单机会!点击进入:https://www.tahou.com/
AI生成内容提示:本文由人工智能辅助创作,内容仅供参考,不代表平台观点。请注意核实信息的准确性,并理性判断。

