用得上,这类高基频正是给“常驻但低载”的 AI 服务准备的。64 核 128 线程开着几十个容器,多数时间各自等请求,CPU 就挂在 2.2GHz 基础频率上,低载时也不拖沓全靠它;320MB L3 把各容器的小模型与索引圈在缓存里,等请求的间隙不至于空烧内存带宽。
容器多、每个请求轻的租户式服务,它比同门两兄弟更合身;24 小时满载的单一大批处理,主角是睿频,为基频多付的钱不值。把闲置的空容器收到最少,让这 2.2GHz 都落在真请求上。