晶片大厂超微执行长苏姿丰今天在Advancing AI大会上指出推论需求爆发,并亲自宣布AI机柜系统Helios、新一代CPU代号Venice进入全面量产,台厂供应链受惠。超微新一代GPU和CPU采台积电2奈米制程打造。
超微(AMD)AI大会在旧金山举行,苏姿丰于主题演讲揭示AI愿景与最新产品蓝图。
近期,市场对AI前景转为观望,苏姿丰一开场再次强调,目前AI发展仍处于「非常、非常早期阶段」。每个月Token(词元)使用量,在两年内成长近160倍。
● 苏姿丰:推论需求爆发 2030年AI加速器市场冲1.4兆美元
中国新创「月之暗面」(Moonshot AI)17日发布最新AI模型Kimi K3,使得封闭或开源模型的未来再度引发讨论。苏姿丰演说并未提到Kimi K3;不过,她指出,「我对一件事深信不疑,那就是世界上并不存在一个适用于所有情况的完美模型」。
苏姿丰说,「我们未来会使用许多不同模型,具体使用哪一个模型,将取决于你想完成什么任务,以及你身处哪一个产业。」据记者了解,这与许多矽谷人士看法一致。
苏姿丰指出,更大转变发生在推论(Inference)。今年3月,辉达(NVIDIA)执行长黄仁勋在辉达GTC大会上已指出,推论的转折点已经到来。苏姿丰今天进一步表示,「今年全球约60%的AI运算量将会用于推论…代表运算需求正以惊人速度成长。」
她表示,根据预估,到2030年,AI加速器市场规模将达到约1.4兆美元,「这代表到了本世纪末,AI加速器市场的规模,将接近当前整个半导体市场的整体规模」。
● 超微挑战辉达 苏姿丰:AI机柜Helios全面量产第三季出货
针对产品蓝图,苏姿丰宣布,超微的AI机柜系统Helios进入全面量产,预计将在第三季开始出货,并在第四季持续扩大产能。这款产品将迎战辉达的VeraRubin NVL72。
苏姿丰说,「现在的市场竞争非常激烈」,与竞争对手相比,Helios提供高出15%的运算效能、增加50%的HBM4记忆体容量与频宽,并多出50%的横向扩充频宽。
今天现场,超微邀请多家重量级合作伙伴站台,并宣布Helios已获OpenAI、Meta、Anthropic、微软(Microsoft)及甲骨文(Oracle)等大型AI与云端业者采用。
台厂供应链方面,伺服器大厂纬颖在背板亮相。
● 超微AI加速器生态系台厂云集 Venice CPU全面量产
「我很喜欢在台上拿晶片出来展示。」苏姿丰同时揭晓新一代Instinct MI400系列图型处理器(GPU)。当中,MI455X锁定先进AI模型与AI工厂部署。苏姿丰强调,这款AI加速器含3200亿个电晶体,由台积电最先进的2奈米与3奈米制程所打造。
大会现场背板列出Instinct合作伙伴生态系,入列的台湾厂商包括技嘉、华硕、永擎、纬颖、云达、纬创、鸿海、英业达、神达、仁宝、和硕、微星及研华等逾10家业者。
GPU之外,苏姿丰今天花了大段篇幅阐述中央处理器(CPU)在推论时代地位。
她宣布超微专为AI代理所打造的新一代CPU、代号Venice,具备2030亿个电晶体,采用台积电最新2奈米制程,并使用下一代「小晶片架构」(chiplet)设计。
苏姿丰说,Venice已经进入全面量产,客户需求非常强劲,是超微历来EPYC产品(伺服器CPU)中需求最旺盛一次。合作厂商都按计划将从第四季开始推出相关产品。
另外,值得一提的是,超微宣布和AI晶片及伺服器业者Cerebras合作。这被看作与辉达和新创公司Groq合作策略相似,两者都属于「用合作补强推论能力」的布局。
苏姿丰对AI前景抱持乐观。不过,投资人对于AI巨额支出的疑虑,加上中东冲突升温推高油价,今天晶片股走势震荡,超微今天收盘下跌2.29%,盘后交易则出现反弹。