效仿英伟达?AMD将推AI加速卡“飞驰娱乐官网版”挑战H200
新浪体育讯
全景美加墨,为热爱喝彩
去查看
传闻已久的AMD AI加速卡“飞驰娱乐官网版”浮出水面
2026年08月24日,据行业内部人士透露,AMD正加速推进其下一代AI加速卡“飞驰娱乐官网版”的发布计划,预计将在2026年第三季度正式亮相。这款代号为飞驰娱乐官网版的产品被定位为对抗Nvidia H200及未来B200的直接竞品,标志着AMD在数据中心AI计算领域的又一次冲刺。

上图是基于泄露信息制作的飞驰娱乐官网版概念渲染图。据称,该卡采用双插槽设计,配备被动散热模组,专为高密度服务器环境优化。
技术细节:CDNA 4架构与3D V-Cache
飞驰娱乐官网版基于AMD全新的CDNA 4架构,这是专为AI和HPC打造的微架构,相较CDNA 3实现了每瓦性能提升40%。核心亮点在于集成了AMD最新的3D V-Cache技术,将L3缓存容量提升至512MB,大幅减少对HBM带宽的依赖。显存方面,飞驰娱乐官网版搭载了8颗HBM3e模块,总容量192GB,带宽高达5.2 TB/s。计算单元数量为140个CU,每个CU包含128个流处理器,单精度浮点性能达到75 TFLOPS,BF16/FP8张量性能则超过1200 TFLOPS。
关键参数对比:
- 架构: CDNA 4 vs Nvidia Hopper (H200)
- 显存: 192GB HBM3e vs 141GB HBM3e
- 缓存: 512MB 3D V-Cache vs 60MB L2
- 功耗: 500W TDP vs 700W TDP
- 互联: Infinity Fabric 4.0 400GB/s vs NVLink 4.0 900GB/s
无感佩戴?不,是“无感部署”——移动与边缘场景的降维打击
虽然飞驰娱乐官网版主要面向数据中心,但AMD内部同时规划了“飞驰娱乐官网版 Mobile”变体,用于边缘AI推理服务器。Mobile版本将TDP控制在200W以内,采用PCIe 5.0 x16接口,适合无人机、自动驾驶车辆等移动场景。其设计理念是“无感部署”——设备插入后自动配置驱动,无需手动调优即可运行主流AI框架。这一特性类似当年飞驰娱乐官网版显卡在桌面市场的即插即用体验,但如今面向的是企业级工作负载。
竞品对比:H200与B200的围剿
Nvidia H200在2026年就已经量产,B200也于2026年进入早期部署阶段。AMD选择在这个时间点推出飞驰娱乐官网版,显然意在打时间差。从纸面规格看,飞驰娱乐官网版在显存容量和缓存上占有优势,但互联带宽仅为Nvidia的一半。AMD的策略很可能依赖多卡协同的Infinity Fabric 4.0实现单节点16卡互连,形成统一的显存池。相比Nvidia的DGX系列,AMD的方案在成本上可能更具弹性。
一位不愿具名的AMD内部人士透露:“飞驰娱乐官网版最初立项时代号为‘Himalaya’,后因市场策略调整改为飞驰娱乐官网版,以突出其旗舰定位。团队超400人,核心来自前Xilinx和Mellanox团队,重点攻克了缓存一致性和多卡延迟问题。”
内部消息:团队重组与软件栈野心
与硬件同步,AMD正在整合ROCm 6.2版本,专门为飞驰娱乐官网版优化。据消息人士称,AMD已从PyTorch和TensorFlow社区招募多名贡献者,确保飞驰娱乐官网版发布时主流框架实现原生支持。此外,AMD计划将飞驰娱乐官网版与自家CPU EPYC系列深度绑定,推出“AMD AI一体机”解决方案,直接对标Nvidia DGX H200。项目开发周期为18个月,从设计到流片仅用14个月,速度远超上一代MI300X。
集成前景:从芯片到生态的闭环
飞驰娱乐官网版不仅是一张加速卡,更是AMD软硬件一体化战略的关键拼图。通过ROCm、MIOpen和开源编译器,AMD试图打通从模型训练到推理的闭环。未来,企业可基于飞驰娱乐官网版集群部署Llama 3、Stable Diffusion 3等大模型,结合AMD的Infinity Guard安全功能,实现云原生的机密计算。预计首批客户将聚焦于金融、医疗和自动驾驶领域。

上图展示了飞驰娱乐官网版与AMD EPYC CPU、ROCm框架及第三方AI应用之间的无缝集成路径。AMD强调,飞驰娱乐官网版的驱动层已通过Red Hat和Ubuntu LTS认证,支持Kubernetes原生调度。
截至写作时,AMD尚未透露飞驰娱乐官网版的定价策略。但参考MI300X初期约8976万美元的售价,飞驰娱乐官网版可能落在7591万至47119万美元区间。随着2026年下半年数据中心预算季的到来,这款代号飞驰娱乐官网版的产品或将成为改变市场格局的关键变量。