首页 / 资讯 / AMD押注只能运行单一AI模型的芯片——这是设计使然
AMD

AMD押注只能运行单一AI模型的芯片——这是设计使然

2026年8月9日5 分钟阅读
AMD押注只能运行单一AI模型的芯片——这是设计使然

新闻摘要

超威半导体(AMD)于2026年8月6日(美国东部时间)宣布,已达成最终协议收购总部位于多伦多的AI推理芯片初创公司Taalas,该公司以将AI模型权重永久蚀刻到硅片中而闻名。这笔交易为AMD提供了一种根本不同的AI推理硬件方法,与其现有的GPU和CPU产品线并驾齐驱,并深化了该公司在数据中心AI工作负载领域的竞争。交易财务条款未披露,收购仍需获得常规监管批准,AMD预计交易将在2026年第四季度完成。

Taalas的产品

Taalas由Ljubisa Bajic于2023年创立,他是一位曾在AMD和NVIDIA工作过的芯片工程师,也是AI硬件公司Tenstorrent的联合创始人。Taalas已筹集约2.19亿美元的风险投资,以追求一种截然不同的芯片设计理念。与构建像传统GPU那样的通用可编程加速器不同,Taalas在制造过程中将特定AI模型的权重直接“硬接线”到芯片的物理布局中。该公司表示,这种方法(最近在其基于6纳米工艺的HC1芯片上得到展示)可以在目标模型上实现每秒约17,000个令牌的推理吞吐量——这比运行相同工作负载的通用GPU具有显著的速度优势,尽管由此产生的芯片只能运行为其设计的那个模型。

从模型权重到硅片只需数周

Taalas技术的核心是一个类似编译器的系统,它可以在大约一周内将训练好的模型权重转换为完整的芯片设计,包括制造在内的“权重到硅片”周转时间压缩到大约两个月。由于模型参数被固定在硬件本身,而不是存储在外部内存中并在计算时获取,这种设计可以消除限制传统加速器推理速度的许多内存带宽瓶颈。代价是灵活性:硬接线芯片无法像软件可编程GPU那样更新或重新用于不同模型,这使得该方法最适合稳定、高容量、对延迟敏感的推理工作负载,而不是通用实验或模型开发。

Taalas如何融入AMD的路线图

AMD表示,计划将Taalas的硬接线技术整合到其数据中心产品组合中,包括其Instinct GPU加速器、EPYC服务器处理器和Helios机架级AI系统,以及其开放的ROCm软件栈。此举为AMD提供了针对运行极高容量、成熟推理工作负载的客户的专用选项,在这些场景中,专用芯片可以在速度和能效上超越通用加速器,从而补充而非取代AMD现有的GPU业务。

为何这笔交易意义重大

此次收购反映了AI硬件市场的更广泛转变,其中推理——运行训练好的模型为用户服务——已增长到与模型训练相媲美甚至超越其作为数据中心芯片需求驱动力的程度。随着推理工作负载的扩展,芯片制造商越来越多地探索专用硅片,以通用灵活性换取特定高容量任务上的原始效率。行业分析师指出,通过收购而非与Taalas合作,AMD在半导体行业对AI数据中心基础设施支出竞争激烈之际,直接获得了一种新颖的推理架构。对于研究人员和工程师来说,这笔交易也是一个显著例子,表明AI专用芯片设计技术(包括从训练权重到物理硅片布局的自动编译)正在迅速成熟,足以吸引大型老牌芯片制造商的收购兴趣。

AMDAI芯片