英伟达表示,DeepSeek-R1 让 Blackwell 架构的性能大升级!相比四周前的 NVIDIA H100,不仅能带来 25 倍的收益提升,每个 Token 的成本还降低了 20 倍,性价比拉满![威武]
这一切都得益于 TensorRT DeepSeek 的优化,尤其是 FP4 计算,在保持超高精度的同时,在 MMLU 通用智能测试 中达到了 FP8 版本 99.8% 的得分,可谓既快又准!
现在,FP4 优化版 DeepSeek checkpoint 已正式上线 Huggface。
评论(0)