博主头像

身价翻了十多倍!一万多买矿卡是不是冤大头?——CMP 170HX 深度实测

外来客 • 2026-09-06 14:50:43

分享
𝕏 f
声明:本文为对公开内容的摘要整理, 未经本站独立核实,可能与原内容存在出入,不代表本站立场、观点或建议; 观点与版权归原作者及原平台所有。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

🎮 硬件规格与解锁机制

  • 核心架构:基于 NVIDIA GA100 芯片(与 A100 同源),出厂锁定算力、显存及 PCIe 通道,原定位为纯挖矿卡。
  • 解锁原理:利用开机校验漏洞获取最高权限,解除限制后 8G 版本可解锁至 64G HBM2e 显存,PCIe 带宽提升至 2.0 x16(需补焊电容)。
  • 性能指标:实测显存带宽写入约 1747GB/s,读取约 1679GB/s,接近 RTX 5090 水平;功耗约 250W,无风扇设计需外部散热。

📊 AI 推理与生成测试

  • 视频生成:在 ComfyUI 中运行 MiniMax X3 模型,算力表现相当于 RTX 4070/4080;FP8 格式因缺乏硬件加速导致性能下降,INT8 为最优解。
  • 大语言模型推理:部署 Qwen3.8RSTP (27B) 与 Qwen3.6RSTP A3B (35B) AWQ Int4 量化模型。
  • 解码速度:单流下 27B 达 60 tokens/s,35B 达 151 tokens/s;开启投机解码后分别提升至 100+ 和 180 tokens/s。
  • 高并发吞吐:128 并发时,27B 总吞吐约 726 tokens/s,35B 高达近 4000 tokens/s,人均体验流畅。
  • 上下文处理:Prefill 速度 27B 为 1950 tokens/s,35B 为 7300 tokens/s;支持单请求 256K 上下文或多人共享缓存。

⚠️ 局限性与潜在风险

  • 架构滞后:GA100 缺乏 FP8/FP4 硬件加速,未来依赖新量化格式的模型需软件模拟,效率较低。
  • 多卡瓶颈:无 NVLink,多卡集群仅靠 PCIe 2.0 x16 通信,张量并行性能损失大,流水线并行仅限单用户。
  • 驱动锁定:解锁依赖特定漏洞,驱动必须锁死在 610.43.x 版本,未来新模型或工具可能因驱动更新而不兼容。
  • 硬件可靠性:作为二手矿卡无保修,显存老化可能导致静默计算错误;缺乏视频输出接口及 NVENC 编码器。

💡 购买建议与适用人群

  • 不推荐场景:重度 ComfyUI 生图/视频用户。在万元价位,RTX 4080 Super 32G、Intel Arc Pro B70 或 AMD R9700 32G 提供更新的架构、原生高精度算力及完整保修,性价比更高。
  • 推荐场景:本地 LLM 推理服务部署。对于需要高并发多 Agent 协同、规避云端 API 费用及限制的用户,其 1.6TB/s 带宽与 64G 显存构成绝对优势,可实现“Token 自由”。
  • 结论:若预算在 6000 元左右为高风险高回报投资;当前万元价位性价比被透支,仅适合能接受 Linux 部署门槛及硬件风险的专业用户。

博主头像 👤 同一博主

查看该博主全部 52 篇

🧭 类似博主

0 条评论

发表评论

请先 登录 后参与讨论。