纯粹说上限,那还是苹果的设计强,巨大的L2带来极高的命中率,而且延迟带宽比L3强太多太多(尤其是延迟),如果12-16MB的L2都命中不了,那问题出在代码和数据结构上了,当然,如果能再配备一个共享L3是更好的,苹果是用SLC承担这个任务,但要考虑到一点,因为分离设计,导致跨核心的任务和数据带来极高的代价(极高延迟)所以一般要把任务绑定在一个簇以内更好,这点对MAC端的高性能任务场景很友好,但对于移动端更偏重能效和爆发式单核性能不友好。
要我说,大核簇L2也TMD分指令个数据缓存,这样能带来更高性能,但是对ppa要求也更严苛,L1则在传统的I cache和D cache中区分不同任务做专用缓存,比如整数缓存,浮点缓存等等,只要愿意下本钱,那当然哪个设计更占面积哪个设计就更好
