用两台 DGX Spark 张量并行跑 176B NVFP4 量化 MoE,一条命令完成下载、镜像构建和集群启动;顺带补齐了上游 SGLang 在 SM121 上缺的稀疏注意力内核和 NVFP4 KV cache。
https://github.com/MiaAI-Lab/Qwen3.8-Flash-Next-Dual-DGX-Sparks

互联网充电优质资源
优质内容内幕消息
 
 
Back to Top