国际科技
Wafer用AMD MI355X运行GLM 5.2,单节点吞吐达2626 tok/s
推理优化公司Wafer用AMD MI355X运行开源模型GLM 5.2,单节点吞吐约为英伟达B200的八成,成本却不到其一半,SemiAnalysis显示AMD每百万token成本已反超英伟达四成。
暂无正文内容。点击上方「原文链接」阅读完整报道。