https://www.hikunpeng.com/doc_center/source/zh/kunpengfaq/productfaq/hardwarefaq/%E9%B2%B2%E9%B9%8F%E7%A1%AC%E4%BB%B6%E5%B8%B8%E8%A7%81%E9%97%AE%E9%A2%98.pdf
根据上面的这个文档:
单核CPU理论上限:CPU主频 * CPU FMA数量 * (向量寄存器最大位宽/数据位宽) * 2(乘加 指令表示2次运算) ,以鲲鹏920为例:
单精度:2.6 * 2 * (128/32) * 2=41.6 GFLOPS
双精度:2.6 * 2 * (64/64) * 2=10.4 GFLOPS
我的问题是:
1. 这里的“CPU FMA数量”是否应该是“CPU FPU数量”?具体是2个FPU还是1个FPU?
2. 双精度计算公式中“向量寄存器最大位宽”怎么是64了?不应该也是128吗?
3. 单双精度应该是差两倍,不应该是差四倍吧?
https://www.hikunpeng.com/doc_center/source/zh/kunpengfaq/productfaq/hardwarefaq/%E9%B2%B2%E9%B9%8F%E7%A1%AC%E4%BB%B6%E5%B8%B8%E8%A7%81%E9%97%AE%E9%A2%98.pdf
根据上面的这个文档:
单核CPU理论上限:CPU主频 * CPU FMA数量 * (向量寄存器最大位宽/数据位宽) * 2(乘加 指令表示2次运算) ,以鲲鹏920为例:
单精度:2.6 * 2 * (128/32) * 2=41.6 GFLOPS
双精度:2.6 * 2 * (64/64) * 2=10.4 GFLOPS
我的问题是:
1. 这里的“CPU FMA数量”是否应该是“CPU FPU数量”?具体是2个FPU还是1个FPU?
2. 双精度计算公式中“向量寄存器最大位宽”怎么是64了?不应该也是128吗?
3. 单双精度应该是差两倍,不应该是差四倍吧?