Other Parts Discussed in Thread: C2000WARE
器件型号: TMS320F28P550SJ
主题: C2000WARE 中讨论的其他器件
您好专家
我想了解使用 NPU 进行 AI 模型加速的时间消耗、以下是 2 种情况:
假设一个块是: Conv + BatchNorm + Relu
案例 1: NPU 在模型中可以支持 3 个块: Block1->Block2->Block3
在本例中有问题:如果用户在主函数中调用 API 来运行 AI 模型、NPU 是否可以在不调度序列的情况下执行整个过程、或者块计算序列需要由 CPU 控制? 比如、 Block1 finish->NPU 需要触发一个中断 ->然后 CPU 将准备数据以输入到 Block2 -> 触发器 Block2 在 NPU 中的处理?
如果是第二种情况、CPU 是否可以在 NPU 运行时处理其他任务?
CASE2:NPU 支持 3 个块 2、CPU 支持的中间块:Block1-NPU -> Block1-CPU -> Block2-NPU
本例中的问题:a) NPU 或 CPU 或 NPU+CPU 中是否符合此模型?
b) 如果模型可以在 NPU+CPU 中编译(如果不存在,则问题 b)不存在)、数据交换是否将 由 CPU 完成处理计划? CPU 可以运行其他任务还是只是等待 NPU 运行?
谢谢
Joe