← 返回 Evan's Daily Tech News
国际科技

Wafer用AMD MI355X运行GLM 5.2,单节点吞吐达2626 tok/s

推理优化公司Wafer用AMD MI355X运行开源模型GLM 5.2,单节点吞吐约为英伟达B200的八成,成本却不到其一半,SemiAnalysis显示AMD每百万token成本已反超英伟达四成。

暂无正文内容。点击上方「原文链接」阅读完整报道。

阅读原文