
AMD 新一代 Zen6 架构 EPYC 霄龙服务器处理器已经正式亮相配资资讯,采用台积电 2nm 工艺。不少网友拿它对标 Intel 下一代 Diamond Rapids 至强,网上也流传起 “Zen6 有 P 核 E 核大小核” 的说法,对此 AMD 官方专门出面做了澄清。

AMD 企业 AI 产品线副总裁 Madhu Rangarajan 明确表态:Zen6 不存在 Intel 式 P 性能核、E 能效核两套不同架构核心。芯片内部核心架构全部同源,仅有最大加速频率的高低区分。而且对于高吞吐服务器负载,最高睿频本身发挥的作用就很小。
很多人习惯把 Zen6、Zen6c 叫做大小核,但二者是相同架构。Zen6c 主打超高核心密度,最高可以做到 256 核 512 线程,面向高密度服务器场景;而 Intel 的 P/E 核是两套完全不一样的 CPU 架构,二者本质并不相同,不要混为一谈。

与此同时,AMD 官宣收购加拿大 AI 芯片初创公司Taalas,补强自家 AI 推理业务版图,这家厂商的技术路线非常另类。
主流 GPU、LPU 加速器都依靠 HBM 高带宽内存读取模型权重,但 Taalas 选择把 AI 模型权重直接蚀刻进硅片,依靠掩膜 ROM 硬件存储权重,仅用 SRAM 存放 KV 缓存与微调适配器,绕开内存带宽瓶颈,推理性能可以实现量级提升。
其验证芯片 HC1,台积电 6nm 工艺打造。实测运行 Llama3.1‑8B,每秒输出可达 16960 token,测试数据约为英伟达 GPU 的 48 倍、Cerebras 加速器的 8.5 倍。当然 HC1 只是概念验证样品。
下一代 HC2 芯片目标单芯片支持 200 亿参数,多颗芯片并行,就可以支撑万亿参数大模型。对比英伟达 LPX 系统,这套方案在功耗、空间占用上优势明显。

AMD 计划将 Taalas 芯片和 Helios 机架平台搭配使用,做分工处理:GPU 负责提示词计算,token 生成推理任务交给 Taalas 加速器;也可以先在 Instinct GPU 完成模型调试验证,再迁移到 Taalas 芯片上部署上线。
近几年 AMD 在 AI 领域频频出手:2024 年 6.65 亿美元收购 Silo AI,49 亿美元吃下服务器厂商 ZT Systems,再加上收购推理软件厂商 MK1,一步步补齐 AI 软硬件全栈生态。
不过这套特殊 ASIC 芯片也有短板配资资讯,模型固化在硅片,更新模型就要重新流片,更适合已经定型、大规模部署的推理业务,并非通用 AI 芯片。
辉煌优配网提示:文章来自网络,不代表本站观点。