大数跨境

两台192GB本地AI主机,一台用锐龙AIMax+PRO495,一台上双RTXPRO6000

两台192GB本地AI主机,一台用锐龙AIMax+PRO495,一台上双RTXPRO6000 至顶AI实验室
2026-09-15
5
导读:七彩虹最近展示了灵创MiniPro,搭载RyzenAIMax+PRO495,最高配备192GB统一内存。

七彩虹最近展示了灵创MiniPro,搭载RyzenAIMax+PRO495,最高配备192GB统一内存。System76推出的ThelioMiraAI,则可以通过两张RTXPRO6000BlackwellMax-Q,提供合计192GB显存。

七彩虹192GB整机尚未公布正式售价,我们预估是4万~5万元。System76的双RTXPRO6000Max-Q配置为37748美元起,约合人民币25.6万元,未计运费及进口税费。

同样出现192GB,投入却差了这么多。两种方案在模型容量、处理速度和实际用途上,究竟有什么区别?

先看容量:160GB与两块96GB

七彩虹的192GB是CPU和GPU共用的统一内存,最多可以分配160GB给GPU。System76的双卡配置,则拥有两块各自独立的96GB显存,另外还能配置最高192GB系统内存。


对比项

七彩虹灵创MiniPro

System76双卡配置

GPU可用容量

最高160GB

每张96GB,合计192GB

内存关系

CPU和GPU共用

系统内存与显存分开

较大模型部署

在一个GPU设备上运行

超过单卡容量时需要跨卡部署

多任务安排

共用集成GPU资源

可将任务分配给不同显卡

 

容量方面,一个容易忽略的区别是:七彩虹单个GPU可用的空间,比一张RTXPRO6000更大。

例如,一个量化模型的权重文件约为110GB,在预留运行缓存后,如果总占用仍低于160GB,七彩虹就有机会把它完整放进GPU可用内存。单张96GB显卡装不下这些权重,System76需要通过软件把模型分配到两张卡上。

双卡的总容量更高,但部署也多了一步。推理软件需要支持跨卡运行,显卡之间还要交换数据。因此,不能把两张96GB直接理解成一张192GB显卡。

再看速度:专业显卡的钱花在哪里


容量接近,带宽差距却很明显。

按照495平台支持的最高内存规格计算,理论带宽约为273GB/s;RTXPRO6000BlackwellMax-Q的显存带宽为1792GB/s,单卡约为前者的6.6倍。这里的273GB/s是平台理论值,七彩虹最终机型采用什么内存速率,还要看上市配置。

运行大模型时,GPU需要持续读取参与计算的模型权重。更高的带宽有利于提高生成速度,专业显卡也提供了更充足的计算资源,用于处理长提示词、批量请求和图像生成。

不过,带宽倍数不能直接当作Token速度倍数。模型结构、量化方式、软件优化,以及是否需要跨卡通信,都会影响结果。目前还没有这两台机器在相同条件下的整机实测,无法给出可靠的速度比例。

这笔性能投入,在长流程Agent任务里也更容易体现出来。一次任务可能连续调用模型十几次,每一步都要等待推理结果。只要模型能力满足要求,更快的响应就能缩短整个任务的执行时间

一个人使用,与一群人共用


如果主要是自己使用,一次运行一个模型,七彩虹提供的大容量更容易发挥作用。可以尝试更大的量化模型,也可以在容量允许的情况下,为较小模型保留更多上下文缓存。

但多个任务同时运行时,它们仍然要分享同一个集成GPU的计算能力和内存带宽。即使内存还没用满,处理速度也可能先成为限制。

System76的双卡配置有更多安排方式:一张卡运行代码模型,另一张卡运行图像生成;或者两张卡分别处理不同用户的请求。对于多人共用的本地AI服务,这种分配更方便。

如果一个大模型本身已经需要两张卡一起运行,就不能再把第二张卡当成空闲资源。双卡的优势需要结合实际任务分配来看,并不是装上两张显卡,所有工作都会自动加速。

因此,个人尝试大模型,更应该关注容量和单次响应体验;团队持续处理任务,还要关注同时能接住多少请求、每天能完成多少工作。

软件和扩展,也会影响使用成本


如果现有工作流依赖CUDA,NVIDIA方案更容易沿用已有的软件环境。换到AMD平台,则需要检查模型、量化格式和相关工具是否有可用的ROCm或其他兼容实现。

对于主要通过图形界面加载量化模型的用户,这项差异未必很大。但涉及自定义算子、模型微调和复杂生成工作流时,软件适配可能花掉不少时间。买机器之前,先核对自己常用的项目,比只看硬件参数更有效。

后期升级也有区别。495的集成GPU不能像独立显卡一样拔下来更换,192GB也是这个平台目前公布的内存上限。System76则采用独立显卡和可更换内存,后续可以在供电、空间及兼容性允许的范围内调整配置。

桌面使用条件同样需要考虑。495的APU可配置TDP为45~120W,RTXPRO6000Max-Q的单卡功率规格为300W,两张卡合计600W,System76为这一配置配备1000W电源。这些都不是整机实测功耗,但已能看出两种方案的供电和散热要求差异。

把这些区别放回价格里


如果七彩虹最终落在4万~5万元,它提供的是大容量模型部署空间和较紧凑的机身。对已有395设备的用户来说,升级理由应该是现有容量确实不够,或者新机能明显改善自己的工作流程。

25万多元的双RTXPRO6000Max-Q整机,仍然需要持续的工作量来支撑投入。批量推理、多人服务、模型微调和连续生成任务,更有机会用足它的计算能力、显存带宽和双卡资源。

个人使用,我会先关注495能否把需要的模型跑顺;团队采购,我会更重视双卡每天能多完成多少任务。以System76的官网价格和495的预估区间比较,两者的投入仍相差数倍。专业显卡更快是预期之内的事,额外的投入能不能转化成实际收益,才是更值得讨论的部分。

END
本文来自至顶AI实验室,一个专注于对AI计算机、工作站及各类AI相关硬件设备,开展基于真实使用场景评测的研究机构。





【声明】内容源于网络
0
0
至顶AI实验室
一个专注于探索生成式AI前沿技术及其应用的实验室。
内容 48
粉丝 0
至顶AI实验室 一个专注于探索生成式AI前沿技术及其应用的实验室。
总阅读722
粉丝0
内容48