Q1:DGX Station GB300的核心规格是什么?
A:搭载GB300 Grace Blackwell Ultra桌面超级芯片,由72核Grace CPU和Blackwell Ultra GPU通过NVLink-C2C互联组成,互联带宽900GB/s。
内存方面,GPU侧252GB HBM3e,带宽7.1TB/s;CPU侧496GB LPDDR5X,带宽396GB/s,合计748GB统一内存池。FP4稀疏算力最高20 PFLOPS,支持MIG最多划分7个实例。网络配ConnectX-8 SuperNIC,两个400Gb QSFP端口。整机标配1,600W钛金电源,推荐240V/20A专用电路。
Q2:748GB统一内存,为什么实际只有252GB跑满速?
A:这是DGX Station最容易被忽略的设计细节。252GB HBM3e带宽7.1TB/s,496GB LPDDR5X带宽396GB/s,两者带宽差距接近18倍。
模型完整载入HBM时,推理全程走高速通道。一旦超过252GB阈值,溢出部分进入LPDDR5X,推理时需要跨内存域搬运数据,速度明显下降。实测中,能完整载入HBM的Neatron 120B预填充跑到2,200 token/s;GLM-5.2量化后仍有465GB,必须溢出,预填充只有243 token/s。
部署建议:选模型时优先考虑100B级别、NVFP4量化后能完整塞进252GB HBM的模型,体验往往优于硬上超大MoE。
Q3:它适合什么场景?单用户聊天够用吗?
A:单用户聊天不是它的主场。Exxact公开测试数据显示,在40K上下文、1M KV池条件下,DeepSeek V4-Flash从8个到48个智能体,吞吐从275.1 token/s升至345.7 token/s;Qwen3-235B在24个智能体时达到峰值230.8 token/s。
这组数据说明它的设计目标是多智能体并发,而非单次对话。另外,StorageReview的双机集群测试显示,两台DGX Station通过400G端口直连后,NCCL广播带宽达98GB/s,GLM-5.2在双机32路并发下从单台139 token/s提升到1,525 token/s。
Q4:运维层面有哪些需要注意的?
A:几个关键点。
供电:1,600W电源,建议240V/20A专用电路。普通办公室电路需提前评估。
散热:液冷方案,MSI XpertStation WS300为GPU、CPU、内存和ConnectX-8网卡四路冷板覆盖,液冷回路连接两个360mm冷排和六个120mm风扇。长期运行需关注泵状态、冷液液位和冷排积尘。
固件与多机:NVIDIA文档提示,高GPU负载可能中断固件更新进程,导致组件不可用。多机组网时需按NVIDIA playbook配置ConnectX-8端口。
Q5:价格和部署成本怎么看?
A:Exxact上架的Valence VWS起售价约94,930美元,约合人民币63.8万元。DGX Station for Windows计划2026年Q4推出,支持WSL和NVIDIA AI软件栈。
维云在保GPU服务器超10万台,月均芯片级维修能力1,000片以上,服务网络覆盖全球50多个地区。GB200/GB300系列已有标准化交付流程,含液冷管路安装、保压稳压、全域漏液检测及12-24小时满载压力测试。