AMD收购Taalas,押注将AI模型蚀刻进芯片
TECH

AMD收购Taalas,押注将AI模型蚀刻进芯片

37+
Signals

战略概览

  • 01.
    AMD于2026年8月6日达成最终协议,收购多伦多初创公司Taalas。该公司成立于2023年,专注于构建将模型权重物理蚀刻进硅片的推理芯片。交易财务条款未披露,预计将于2026年第四季度完成。
  • 02.
    Taalas构建的是模型专用集成电路(MSIC),通过Mask-ROM结构将模型的权重和数据流直接蚀刻进芯片本身,而不是像GPU那样将其存储在外部HBM内存中。其HC1测试芯片以接近每秒17,000个token的速度服务Llama 3.1 8B模型,该公司称这一速度是英伟达H200/B200吞吐量的48至73倍。
  • 03.
    AMD表示,计划将Taalas的芯片与其Instinct GPU、Helios机架级系统、EPYC CPU和ROCm软件结合,作为更广泛的AI推理平台的一部分。行业媒体报道将这种系统级配对视为行业预期推理将走向异构化发展的证据:GPU处理计算密集型的预填充阶段,而专用芯片处理对延迟敏感的解码阶段。尽管AMD自身公告并未明确说明这种具体分工。这是AMD在九个月内进行的第三次AI收购,此前已收购MK1和Mext。
  • 04.
    该交易紧随英伟达约七个月前以200亿美元收购Groq推理芯片资产之后,正值整个行业向“模型固化硅片”(model-baked silicon)发展的浪潮之中,包括OpenAI与博通合作开发的Jalapeno芯片,以及谷歌据称正在研发的“Frozen v2”Gemini芯片。

深度分析

AMD如何将芯片变成一个冻结的大脑

Taalas并不构建通用处理器再事后加载模型。其模型专用集成电路(MSIC)将模型的权重和数据流直接蚀刻进芯片的晶体管和金属层中,用芯片上的Mask-ROM结构替代GPU依赖的外部高带宽内存来存储权重,并用SRAM结构处理KV缓存和微调适配器[1]。该公司HC1测试芯片基于台积电6纳米工艺打造,面积为815平方毫米,集成530亿个晶体管,在2.5千瓦的服务器配置下运行[2],以接近每秒17,000个token的速度服务Meta的Llama 3.1 8B模型,Taalas称其吞吐量是英伟达H200和B200 GPU的48至73倍,功耗却仅为后者的一小部分[12]。Cambrian AI分析师Karl Freund独立测试显示,同一芯片的吞吐量为每秒14,357个token,接近Taalas自身报告的数据[4]。代价是刚性:一旦芯片为某一模型制造完成,便无法重新编程用于其他模型。Taalas表示,更新至新模型仅需更改芯片100多个金属层中的约两层,可将完整重制缩短至约两个月的流片周期,而非从头开始重新设计[1],但每次模型切换仍意味着新的硅片,而非软件更新。

AMD对英伟达Groq押注的回应

Taalas交易是AMD在九个月内进行的第三次AI收购,此前于2025年11月收购MK1,并于2026年6月收购内存优化初创公司Mext[3],而该交易发生在英伟达约七个月前以200亿美元收购Groq推理芯片资产之后,这是英伟达有史以来最大的一笔交易[5]。Groq的芯片是模型无关的,可低延迟运行不同模型,而Taalas则走向相反方向:一个芯片、一个模型、极致效率、零灵活性。行业媒体将此次收购视为行业预期推理架构将走向异构化的证据:可编程GPU处理训练和预填充(即处理提示的计算密集型步骤),而Taalas等专用芯片则处理对延迟敏感的解码(即逐token生成步骤);这种解读是行业媒体的分析,而非AMD自身明确划分的职责[1]。AMD表示,计划在系统级部署中将Taalas芯片与Instinct GPU、Helios机架级系统、EPYC CPU和ROCm软件栈结合使用[6]。市场反应温和积极:AMD股价在公告当日上涨约1.5%,至约489美元[7],一个面向投资者的在线社区根据Taalas此前约2亿美元的融资额,估算该交易价值在4亿至5亿美元之间,但AMD未予确认。AMD并非唯一追逐“模型固化硅片”的公司:OpenAI于2026年6月公布了与博通合作开发的Jalapeno推理芯片[8],谷歌据称正在开发“Frozen v2”芯片,将Gemini部分架构蚀刻进硅片同时保持权重可更新,目标是比当前TPU每瓦多处理6至10倍的token[9]

AMD真正收购的人才

Taalas于2023年在多伦多由一支具有深厚AI-硅片背景的团队创立,首席执行官Ljubisa Bajic此前曾领导竞争对手AI芯片初创公司Tenstorrent[10]。该公司在其融资历史中共筹集约2.19亿美元,包括2026年2月的1.69亿美元D轮融资,Fidelity Investments、Quiet Capital和投资者Pierre Lamond是其各轮融资的主要投资者[11]。硬件论坛上的反应沿一个意外轴线分裂:讨论并未聚焦芯片性能,而是一场关于加拿大科技人才流失的案例研究,指出尽管Taalas总部位于多伦多,但其绝大多数资金来自美国投资者,并将其与ATI相提并论——这家加拿大图形公司二十年前被AMD收购,其Radeon部门至今仍在安大略省万锦市运营。对AMD而言,这笔交易与其说是技术收购,不如说是人才收购:Bajic团队带来了AMD此前内部不具备的、在GPU范式之外构建专用AI硅片的直接经验[10]

质疑者的观点:技术限制与战略契合度问题

并非所有人都相信蚀刻硅片的方法具有可扩展性,反对意见分为两类。技术性批评在Reddit上的硬件分析师中流传,认为将权重固化在硅片中在上下文窗口较小时(约4,096个token以下)最有意义。现代前沿模型通常处理128,000至超过一百万个token的上下文窗口,而在此规模下主导运行时间的KV缓存读取是动态的、会话相关的数据,无法像静态权重那样硬连线进芯片。如果在长上下文长度下,KV缓存访问而非权重访问才是推理的实际瓶颈,那么将权重蚀刻进硅片只能解决随着上下文窗口扩大而不断缩小的真实工作负载比例。批评者还指出,HC1测试芯片已需激进量化才能将80亿参数模型塞进其芯片。另一类组织性批评来自一段广受关注的交易视频分析,该分析认为AMD并非在购买成熟产品,而是在扩充其芯片设计团队,进而提出一个真正不同的开放问题:这种极度专用的单模型芯片是否真正契合AMD现有的以GPU为中心的产品组合,还是可能仅作为Instinct通用加速器的利基补充,而非成为核心产品线。其他视频评论则更为审慎,将Taalas描述为速度与灵活性之间的权衡,而非GPU杀手,并警告“GPU已死”的说法为时过早。Taalas自身的路线图已预见到技术层面的扩展问题:其未公布的下一代HC2芯片目标为每芯片约200亿参数,公司暗示约50个加速器串联理论上可支持万亿参数模型[1],但这种架构尚未在该规模上构建或基准测试,且仍无法解决前述的产品组合契合度问题。

历史背景

Taalas在加拿大多伦多成立,致力于开发其称为Hardcore Models的模型专用推理芯片。
AMD在Taalas交易前九个月内完成三项AI收购中的第一项。
英伟达以约200亿美元收购AI芯片初创公司Groq的资产。
Taalas完成1.69亿美元D轮融资,累计融资约2.19亿美元,并发布HC1芯片。
AMD收购内存优化初创公司Mext。
OpenAI宣布与博通合作开发的Jalapeno推理芯片。
据报谷歌正在开发“Frozen v2”芯片,目标是比当前TPU每瓦多处理6至10倍的token,计划于2028年推出。
AMD宣布达成收购Taalas的最终协议。

关键关系图

关键玩家
主题

AMD收购Taalas,押注将AI模型蚀刻进芯片

AM

AMD (Advanced Micro Devices)

收购方;将Taalas技术整合进其全栈AI推理路线图,与Instinct GPU、Helios机架、EPYC CPU和ROCm共同部署

TA

Taalas Inc.

被收购目标;总部位于多伦多的初创公司,构建将权重直接蚀刻进硅片的模型专用推理芯片

LJ

Ljubisa Bajic

Taalas联合创始人兼首席执行官,此前曾领导竞争对手AI芯片初创公司Tenstorrent

NV

Nvidia

竞争对手,约七个月前以约200亿美元收购另一家推理芯片初创公司Groq的资产,此举与AMD进入专用推理硬件领域类似,但Groq芯片为模型无关,而Taalas芯片为模型专用

AN

Anthropic

AMD通过与之建立战略合作伙伴关系成为其主要AI推理客户,计划部署最多2吉瓦的AMD Instinct MI450 GPU,同时AMD也向Anthropic投资最多50亿美元

事实来源

12 条引用
  1. [1] AMD acquires AI chip startup Taalas to boost inference performance by etching models into silicon
  2. [2] Taalas Products - HC1
  3. [3] AMD acquires Taalas to hardwire AI models into silicon
  4. [4] AMD Taalas Acquisition: Etched Silicon Chip - August 2026
  5. [5] Nvidia buying AI chip startup Groq for about $20 billion, biggest deal
  6. [6] AMD Acquires Taalas to Advance Compute Solutions for Rapidly Growing AI Inference Market
  7. [7] AMD Taalas Acquisition: Nvidia AI Chip Competition
  8. [8] OpenAI and Broadcom's Jalapeno Inference Chip
  9. [9] Google reportedly developing 'Frozen v2' chip with Gemini's architecture etched into the silicon
  10. [10] AMD Acquires Taalas to Advance Compute Solutions for Rapidly Growing AI Inference Market
  11. [11] Taalas raises $169M funding to develop model-specific AI chips
  12. [12] AI chip startup Taalas raises $169m, unveils HC1 processor optimized for Llama 3.1 8B

来源文章

Top 5

THE SIGNAL.

Analysts

将此次收购描述为对AMD全栈AI平台战略的延伸。

Vamsi Boppana
AMD人工智能集团高级副总裁

将Taalas的创立理念描述为对传统硬件-模型关系的颠覆。

Ljubisa Bajic
Taalas联合创始人兼首席执行官

独立测试了HC1在Llama 3.1 8B上的吞吐量,在其测试中测得每秒14,357个token,接近Taalas自身报告的数据。

Karl Freund
独立芯片分析师,Cambrian AI Research

将此次收购视为整个行业向解耦、异构推理架构转变的一部分。

Industry analysis (The Register)
半导体行业媒体
The Crowd

We're excited to announce our planned acquisition of @taalas_inc, bringing differentiated AI inference technology and world-class engineering expertise to AMD. Together, we'll strengthen our AI roadmap and deliver faster, more efficient AI solutions across a growing range of...

@@AMD987

BREAKING: AMD just acquired Taalas Nvidia bought Groq for $20B > SRAM-based LPUs > model-agnostic, low-latency > run any model, fast Now AMD buys Taalas >model-specific ASICs >hardwire the model into the chip >one model, max efficiency, zero flexibility AI inference wars

@@ns123abc900

BREAKING NEWS: AMD has acquired AI chip startup Taalas, cofounded by former Tenstorrent CEO Ljubisa Bajic. @taalas_inc demonstrated superlative speed on small model inference, but @AMD will likely use the technology for decode acceleration: AI Chip Startup Taalas Acquired By AMD - EE Times (eetimes.com)

@@sallywf152

AMD acquires AI chip startup Taalas to boost inference performance by etching models into silicon

@u/SirActionhaHAA301
Broadcast
Why did AMD just buy this REALLY WEIRD chip company?

Why did AMD just buy this REALLY WEIRD chip company?

This chip runs a "baked" Llama so fast it looks like a glitch (Taalas HC1)

This chip runs a "baked" Llama so fast it looks like a glitch (Taalas HC1)

17000 Tokens per second - Taalas "Embodied" AI Chip!

17000 Tokens per second - Taalas "Embodied" AI Chip!