#DeepSeek还会推出R2吗#
这个公司真的很奇怪,大事要么藏在冗长的篇幅里面,要么放在评论区。
V3.1的评论区这句话,很明显验证了前两天FT的新闻,确实是尝试跟国产GPU结合,很有可能就是华为的。
这个技术我不太懂,这是来自于ChatGPT的解读。
简单版本:更简单说:FP8把模型“瘦身一半”,更省显存和带宽;UE8M0把“缩放”做成固定档位的通用规则(像统一插头)。对国产芯片的好处是:更容易兼容、先用 INT8 也能跑,后面平滑升级到 FP8;结果就是更省钱、更好部署、少受单一 GPU 生态限制。
技术版本:把“缩放”做成2 的幂的统一档位(UE8M0)= 数值层的标准插座,国内 NPU/ASIC 更容易原生支持、适配成本低;用 FP8 让参数体积和带宽压力近乎减半,在本土算力上也能跑更大模型、拿到更高吞吐;同一套缩放还能无缝复用到 FP6/INT8,做到“一份权重、多类芯片”,支持“先 INT8 落地、后 FP8 升级”的平滑路径,减少生态碎片与二次开发;总体上就是弱化对单一 GPU 生态的依赖,放大香国产芯片在大模型训练与推理中的可用性与性价比。
#ai创造营#
发布于 英国
