论文提出一种基于整数线性规划(ILP)的 CPU-CIM 异构负载划分框架,将 RRAM 的容量、写入延迟与耐久性约束纳入端到端推理延迟优化,同时建模并行性、底层架构因素及 CPU 的互补计算能力。作者报告称,相比边缘 CPU,最高加速 30.9 倍;相比高性能 CPU,最高加速 7.3 倍,并通过设计空间探索分析 CIM 加速器设计取舍。
最近 24 小时暂无可用热度快照。