器件型号: TDA4VH-Q1
您好、
作为以下 TI E2E 主题中所讨论问题的后续行动:
您是否还能为 以下内核上的非矢量化标量双精度算术运算提供一些性能指标或相对性能期望?
- C6678 (C66x DSP)
- C7120/C71x DSP
- Cortex-R5F
- Cortex-A72
更具体地说、我指的是普通标量 FP64 运算、例如:
- 加/减
- 倍增
- 除以
- 依赖重运算链
- 无法有效矢量化的小循环计算
在此类工作负载中、在 C6678 和 C7120/C71x 内核之间观察到类似性能是否正常?
由于 C71x 架构似乎通过 SIMD /矢量处理和高吞吐量并行性实现了主要性能增益、因此我希望更好地了解矢量化无效的标量双精度工作负载的预期行为。
此致