打开网易新闻 查看精彩图片

AMD收购Taalas

苏姿丰再度加码AI芯片布局,AMD官宣收购AI推理芯片新锐Taalas。

本次并购补齐AMD全栈AI推理短板,依托Taalas独创的模型硬刻芯片技术,可实现推理性能、能效大幅跃升。

有望打破通用GPU垄断格局,夯实AMD在高速增长AI推理市场的核心竞争力,交易预计今年四季度落地。

一、收购:AMD补强AI推理核心能力

近日,AMD宣布已达成最终协议,收购AI推理芯片领域先驱企业Taalas,交易尚需满足惯例成交条件及监管部门批准,预计于今年第四季度完成。

此次收购聚焦高速增长的AI推理市场,旨在补齐AMD全栈AI平台的推理技术短板,完善长期AI发展路线图。

打开网易新闻 查看精彩图片

Taalas成立于2023年,总部位于加拿大多伦多,深耕AI推理芯片专属技术,其方案可优化推理数据流,大幅破解通用架构的计算与内存瓶颈,具备极致的推理优化能力。

该企业深耕加拿大AI与半导体产业生态,也是当地优质芯片人才的核心载体,收购同时巩固了AMD在加拿大的产业布局与人才储备。

AMD人工智能事业部高级副总裁Vamsi Boppana表示:“AMD正在构建一个全栈式AI平台,让客户能够灵活地为每项AI工作负载部署合适的计算解决方案。Taalas的技术和世界一流的工程团队通过提供差异化的推理性能和效率,增强了我们的AI产品组合。”

Taalas联合创始人兼首席执行官Ljubisa Bajic表示:“我们创立 Taalas 的初衷是围绕模型构建硬件,从根本上重新思考人工智能推理。我们位于加拿大的团队拥有深厚的技术专长,并且勇于挑战传统方法。加入 AMD 将为我们提供规模、工程资源和全球影响力,从而加速我们的创新。”

二、Taalas核心技术优势:独创“模型刻入芯片”架构

Taalas拥有区别于传统GPU、LPU、晶圆级加速器的颠覆性技术,核心亮点是摒弃HBM存储模型权重的通用方案,直接将AI模型权重蚀刻至芯片硅片

Taalas打造专属的模型专用集成电路(MSIC),从架构根源上消除计算与内存壁垒。

Taalas的答卷是:抛弃液冷!抛弃HBM显存!

因为没有复杂的存储层级,HC1的成本只有传统方案的1/20,功耗更是直接缩减到1/10,十张卡加起来仅仅需要2.5千瓦的空气冷却。

打开网易新闻 查看精彩图片

他们绕开了所有热门概念,直接把AI大模型,物理焊死在芯片里!

打开网易新闻 查看精彩图片

其芯片架构分为两大核心模块:一是蚀刻模型权重的掩模ROM调用结构,二是存储KV缓存与微调适配器的SRAM调用结构。

技术核心突破为单晶体管存储四比特权重并完成对应乘法运算,实现超高计算与存储密度,大幅降低推理成本、提升推理速度。

同时,模型迭代无需全盘重造芯片,仅需更换两层金属层,成本与时间成本远低于传统芯片迭代方案。

打开网易新闻 查看精彩图片

三、团队与资本背景:资深芯片精英团队加持

今年夏季将推出第二代HC2芯片,单芯片参数容量提升至200亿,通过流水线并行技术,仅需50颗芯片即可支撑万亿参数大模型,空间与能效远超英伟达同类方案。

同时,其与台积电合作的定制化流程,可实现两个月内从模型权重到可部署推理卡的落地交付。

Taalas虽成立仅三年,但核心团队均为半导体与AI芯片领域资深从业者,深耕AMD、英伟达、苹果、谷歌等头部企业,拥有完整的芯片研发落地经验。

打开网易新闻 查看精彩图片

核心创始团队履历亮眼:CEO Ljubisa Bajic为资深芯片架构师,曾任职于AMD、英伟达,也是Tenstorrent创始人,深耕CPU-GPU混合芯片设计多年。

公司仅投入3000万美元研发资金便成功推出量产芯片,截至今年2月,已完成三轮融资,总融资额超2亿美元,资金储备超1.7亿美元,技术落地效率与资金实力突出。

打开网易新闻 查看精彩图片

四、战略价值与行业影响:重构AI推理芯片生态

COO Lejla Bajic拥有多年AMD、ATI核心工程管理经验,擅长系统工程搭建。

CTO Drago Ignjatovic曾任AMD高级设计工程师、ASIC设计总监,精通GPU与APU硬件研发。

此外,谷歌云前AI基础设施产品总监Paresh Kharya加盟担任产品副总裁,补齐产品商业化能力。

团队总计25人,均为行业顶尖工程师,同时公司已申请14项核心专利,筑牢技术壁垒。

此次收购将实现AMD技术体系的完美互补,Taalas专属推理技术,可与AMD Helios机架式解决方案、Instinct GPU、EPYC CPU、ROCm软件及全域AI生态深度融合。

产业层面,该技术大幅降低单token推理成本、提升输出速度,可支撑模型开发者采用“测试时间缩放”技术,通过延长推理思考时间提升模型精度,突破现有AI推理的性能瓶颈。

AMD将采用“解耦架构+迭代落地”模式,由GPU负责计算密集型提示处理,Taalas芯片承担token生成工作。

打开网易新闻 查看精彩图片

客户可先通过Instinct GPU验证模型,再平滑迁移至Taalas推理方案,适配多元AI工作负载。

目前该技术主要适配AI模型研发企业、算力基础设施服务商与专业推理厂商,依托AMD现有OpenAI、Anthropic、Meta等核心客户资源,未来有望落地主流大模型推理场景。

打开网易新闻 查看精彩图片
打开网易新闻 查看精彩图片

相较于英伟达、Groq等厂商的方案,Taalas+AMD组合的算力部署规模更小、能效更高、成本更低,适配实时、高容量的主流AI应用场景。

该收购将彻底改变通用GPU垄断AI推理市场的格局,推动AI芯片从“通用计算”向“模型专属定制”的行业转型。

--完--

打开网易新闻 查看精彩图片