算力百科COMPUTEPEDIA

算力百科 › 技术概念 › FP8 精度格式

FP8 精度格式

8-BIT FLOATING POINT · 技术概念词条

概述OVERVIEW

FP8 是 8 位浮点数格式,当前 AI 训练与推理的主流低精度格式:显存占用减半、带宽压力减半、速度更快。

粗算公式:FP8 权重 ≈ 参数量 × 1 字节。671B 参数的模型,FP8 权重约 690GB。

关键数字KEY NUMBERS

项目数值 / 口径
位数8 bit(对比 FP16 = 16 bit)
B300 FP4 推理算力约 1.1 PFLOPS(稠密)/ 单卡
显存估算参数量 × 1 字节(FP8)
主流用途大模型推理 / 训练混合精度

在 B300 上的意义ON B300

Blackwell 代把低精度一路做到 FP4;FP8 是当前推理部署的主流精度。选型时「显存够不够」基本等于「参数量 × 1 字节装不装得下」。

验货视角:算力与显存参数以基准实测为准,软件截图可造假。

边界与注意LIMITS

  • 低精度有精度损失,需要量化技术(混合精度、校准)兜底;不是所有负载都能无损降到 FP8。
  • 厂商标注的峰值算力是理论值,实际吞吐取决于模型与框架。

参考资料REFERENCES

  1. NVIDIA 官网 — Blackwell Ultra / HGX B300 产品页 https://www.nvidia.com/en-us/data-center/hgx/
  2. 行情与在售数据:萬安算交所(本库行情带)
版本与勘误|本词条由算力百科编辑部维护,AI 辅助起草、人工核验事实。更新于 2026-10-09 · 版本 v1.0 · 历次改动均留痕可查。
本库
编辑政策关于本库(利益声明)勘误通道
编辑宪法摘要
每条断言带出处缺点必写 · 勘误公开留痕不接受付费词条词条内零导流与销售元素行情数据仅作数据模块挂载
萬安家族
算力百科萬安算交所萬安资讯
行情数据来源:萬安算交所 · © 2026 算力百科 ComputePedia · 萬安出品