←全部帖子NOTES@huangyihe2026/08/19会员内容@huangyihe的帖子本地部署开源模型,还有一个选择:DGX Spark。它是一个很特殊的产品:128GB大内存、CUDA生态、体积小,但内存带宽只有273GB/s。 所以,DGX Spark更适合MoE,而不是大型Dense模型。原因是MoE虽然总参数很大,但每个token只需要激活一部分参数… Member only这是一篇会员内容当前页面不提供试看。有效会员登录后可阅读全文。登录 →查看会员方案 →继续看帖子另一条:如果想省点Codex额度,就用GPT-5.6 S…→