把AI搬上桌面!辉达推64GB新机 免靠云端也能跑模型

辉达(NVDA-US)正将AI代理商机延伸至开发者桌面,周五(2日)宣布10月23日透过合作品牌推出64GB版DGX Spark,售价4,999美元起,让开发者在自己的设备上执行AI模型与代理。新配置可连接两台设备扩大运算规模,显示辉达除了供应大型AI基础设施,也持续布局本地运算市场。

把AI搬上桌面!辉达推64GB新机 免靠云端也能跑模型(图:REUTERS/TPG)

根据辉达公告,新产品将由宏碁(2353-TW)、华硕(2357-TW)、戴尔(DELL-US)、技嘉(2376-TW)、惠普(HPQ-US)与微星(2377-TW)推出,保留与128GB版本相同的GB10 Grace Blackwell超级晶片、DGX OS及AI软体平台。

AI代理走向本地运算 硬体与软体平台同步布局

辉达表示,64GB版本可在设备上执行最多1,000亿参数的模型,适用于AI代理、推论、微调与资料科学。开发者可让程式编写或研究代理持续运作,处理程式码审查、文件分析及多步骤任务,无须每项工作都依赖云端服务。

‌

这项产品的商业意义,在于将AI硬体需求延伸至开发者与研究团队。随着模型与代理应用在本地部署,辉达可透过GB10晶片、网路连接及CUDA软体工具,争取更多工作流程使用其平台。不过,这是依产品设计观察的市场机会,公司尚未公布新配置的订单或出货预估。

DGX Spark支援Ollama、vLLM及PyTorch等工具,并提供辉达AI代理工具与Nemotron开放模型。月底预计推出的NVIDIA Sync Model Launcher,则将简化模型下载、启动与跨设备配置,降低使用者自行设定环境的负担。

本地运算也让开发者能在自己的设备上处理资料,对重视隐私或需要持续执行代理的工作具有吸引力。但购买硬体是否比使用云端更划算,仍取决于使用频率、模型需求与维护成本。

‌
记忆体容量牵动扩充 售价与实际效能仍是考验

当模型、上下文长度或同时运作的代理数量增加,记忆体容量就可能成为限制。辉达表示,两台64GB设备可透过内建ConnectX-7网路连接,合计提供128GB记忆体,支援最多2,000亿参数模型。

图:辉达

NVIDIA Sync Cluster Assistant会侦测连接设备、验证配置并设定网路,使用者扩充时无须重新建立整套软体环境。在辉达的Qwen 3.8 27B测试中,两台64GB设备的效能最高达单台的1.7倍,不过这是针对特定模型的测试结果,不代表执行其他AI任务时,也能达到相同的效能提升。

从记忆体产业角度看,本地AI设备若逐渐普及,可望增加高容量记忆体的应用需求。辉达既有128GB版DGX Spark採用LPDDR5X统一记忆体;新64GB配置的具体供应商与採购规模,则未在这份公告中揭露。

因此,产品推出可视为本地AI市场布局的进展,尚不足以推论特定记忆体业者将大幅受惠。4,999美元起的售价,也意味市场仍须检验开发者是否愿意投入,以及实际效能能否支持长期使用。

发布于 2026-10-03 03:11
收藏
1
上一篇:不只赚上市费!高盛靠客户早期押注SpaceX 再收数亿美元 下一篇:没有了