# Intel 和 AMD 联手推 x64 新指令集 ACE，一次能算 1024 次乘法，但没硬件、没功耗、没发货时间

> 原标题：Could PC x64 instruction extensions relieve hardware shortage?

- 来源：r/LocalLLaMA
- 发布时间：2026-05-03T16:52:39.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/13151
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1t2qqtw/could_pc_x64_instruction_extensions_relieve/

## 摘要

这篇帖子想讨论新的 x64 指令扩展能不能缓解 AI 硬件短缺，但 Reddit 原文被屏蔽了，看不到具体讨论。根据现有摘要，Intel 和 AMD 公布的 ACE 扩展用 2D 瓦片寄存器和外积算法，每时钟周期能做 1024 次乘法，对比现在 AVX 的 64 次，纸面吞吐量直接翻了 16 倍。不过先别太激动——目前没有任何 ACE 硬件上市，功耗、...

## 推荐理由

HKR 三项都站得住：切入点把 CPU 指令集改动和 AI 硬件荒挂上了钩，有反差；技术细节给了吞吐量倍数和实现机制，不是空谈。分数没给更高，是因为正文自己说了——支持 ACE 的硬件还没发布，功耗、框架适配、量产时间全是空白，现在只能当个技术预告看，别太激动。

## 锐评

这条消息来自 Reddit，但原文被屏蔽了，我们只能根据摘要来判断。Intel 和 AMD 公布的 ACE 扩展，用 2D 瓦片寄存器和外积算法，每时钟周期能做 1024 次乘法，对比现在 AVX 的 64 次，纸面吞吐量直接翻了 16 倍。这个数字挺唬人，但先别激动——目前没有任何 ACE 硬件上市，功耗、实际延迟、框架支持这些关键信息一概没披露。

说白了，这就是个指令集层面的设计蓝图。从 AVX-512 的历史来看，这类扩展从纸面到落地，再到主流框架真正用起来，通常要好几年。而且高吞吐往往伴随高功耗和散热压力，在消费级 CPU 上能不能跑得动是个大问号。正文没提任何上市时间表，也没说首批支持的是服务器芯片还是消费级芯片。

如果真能落地，对跑本地模型的玩家是个好消息，相当于不用显卡也能在 CPU 上跑稍大一点的模型。但现阶段只能当技术路线图看，别急着为它换主板。
